Calculateur de coût des tokens
Convertissez gratuitement en ligne des décomptes de tokens en coûts API estimés sur plus de 20 modèles. Comparez OpenAI, Anthropic, Google, xAI, DeepSeek, Mistral et plus côte à côte. Modélisez les économies de cache de prompts, ajoutez des tarifs personnalisés et prévoyez les dépenses mensuelles - dans votre navigateur, sans inscription.
Enter your input and output token counts to instantly calculate API costs across 20+ models from OpenAI, Anthropic, Google, xAI, DeepSeek, Mistral, Cohere, and Meta. Compare providers side-by-side, add custom pricing, and forecast monthly or annual spending.
Token Counts
Workload Volume
Primary Model
Monthly Cost - GPT-4o
Cost / Call
$0.0225
Input Cost
$0.0125
Output Cost
$0.0100
Cache Savings
-
Daily
$22.50
1,000 calls
Monthly
$675.00
30,000 calls
Yearly
$8,212.50
365,000 calls
Full Provider Comparison
| Model | Cost / Call | Input Cost | Output Cost | Monthly Total | Features |
|---|---|---|---|---|---|
Mistral SmallMistralCost-Effective $0.1000/M in · $0.3000/M out | $0.000800 | $0.000500 | $0.000300 | $24.00 | - |
GPT-4o miniOpenAICost-Effective $0.1500/M in · $0.6000/M out | $0.001350 | $0.000750 | $0.000600 | $40.50 | Caching |
Command RCohereCost-Effective $0.1500/M in · $0.6000/M out | $0.001350 | $0.000750 | $0.000600 | $40.50 | - |
Grok 3 MinixAICost-Effective $0.3000/M in · $0.5000/M out | $0.002000 | $0.001500 | $0.000500 | $60.00 | - |
DeepSeek-V3DeepSeekCost-Effective $0.2700/M in · $1.1000/M out | $0.002450 | $0.001350 | $0.001100 | $73.50 | Caching |
Gemini 2.5 FlashGoogleCost-Effective $0.3000/M in · $2.5000/M out | $0.004000 | $0.001500 | $0.002500 | $120.00 | Caching |
Llama 3.1 70BMetaCost-Effective $0.7200/M in · $0.7200/M out | $0.004320 | $0.003600 | $0.000720 | $129.60 | - |
DeepSeek-R1DeepSeek $0.5500/M in · $2.1900/M out | $0.004940 | $0.002750 | $0.002190 | $148.20 | Caching |
Claude 3.5 HaikuAnthropicCost-Effective $0.8000/M in · $4.0000/M out | $0.008000 | $0.004000 | $0.004000 | $240.00 | Caching |
o4-miniOpenAICost-Effective $1.1000/M in · $4.4000/M out | $0.009900 | $0.005500 | $0.004400 | $297.00 | Caching |
Gemini 1.5 ProGoogle $1.2500/M in · $5.0000/M out | $0.0112 | $0.006250 | $0.005000 | $337.50 | Caching |
Mistral LargeMistral $2.0000/M in · $6.0000/M out | $0.0160 | $0.0100 | $0.006000 | $480.00 | - |
Gemini 2.5 ProGoogle $1.2500/M in · $10.0000/M out | $0.0163 | $0.006250 | $0.0100 | $487.50 | Caching |
o3OpenAI $2.0000/M in · $8.0000/M out | $0.0180 | $0.0100 | $0.008000 | $540.00 | Caching |
GPT-4oOpenAI Primary $2.5000/M in · $10.0000/M out | $0.0225 | $0.0125 | $0.0100 | $675.00 | Caching |
Command R+Cohere $2.5000/M in · $10.0000/M out | $0.0225 | $0.0125 | $0.0100 | $675.00 | - |
Claude 3.7 SonnetAnthropicCapable $3.0000/M in · $15.0000/M out | $0.0300 | $0.0150 | $0.0150 | $900.00 | Caching |
Grok 3xAI $3.0000/M in · $15.0000/M out | $0.0300 | $0.0150 | $0.0150 | $900.00 | - |
Llama 3.1 405BMeta $5.0000/M in · $16.0000/M out | $0.0410 | $0.0250 | $0.0160 | $1,230.00 | - |
GPT-5.5OpenAICapable $5.0000/M in · $30.0000/M out | $0.0550 | $0.0250 | $0.0300 | $1,650.00 | Caching |
Claude 3 OpusAnthropicCapable $15.0000/M in · $75.0000/M out | $0.1500 | $0.0750 | $0.0750 | $4,500.00 | Caching |
Click any row to set it as the primary model. 21 models shown.
Comment convertir des tokens en coût
Le calcul est direct : multipliez les tokens d'entrée par leur tarif, les tokens de sortie par le leur, puis additionnez. La difficulté réside dans le choix du modèle et dans la connaissance réelle des tokens générés.
Les tokens de sortie coûtent 3 à 8 fois plus cher, donc maîtriser la longueur des réponses apporte souvent la plus grosse économie.
- Coût = tokens d'entrée × tarif d'entrée + tokens de sortie × tarif de sortie.
- Les tarifs sont exprimés par million de tokens.
- Choisissez l'unité de période pour voir le total pertinent.
Cache de prompts et modèles personnalisés
Si vous réutilisez un grand préfixe stable, le cache réduit fortement son coût. Saisissez les tokens mis en cache pour mesurer l'économie réelle.
- Cache : généralement 10-25 % du tarif d'entrée standard.
- Avantageux avec prompts système, instructions fixes ou contexte partagé.
- Ajoutez des tarifs personnalisés pour comparer des modèles privés ou ajustés.
Comparer les fournisseurs et prévoir la dépense
L'objectif est de trouver le modèle le moins cher qui respecte votre niveau de qualité, pas le moins cher dans l'absolu.
- Obtenez votre décompte réel de tokens d'entrée et de sortie par appel.
- Saisissez le volume de requêtes et la période.
- Comparez les modèles candidats dans le tableau.
- Vérifiez la prévision mensuelle et annuelle avant de vous engager.
Foire aux questions
Il convertit les décomptes de tokens en coûts API estimés chez les fournisseurs de modèles de langage. Vous saisissez vos quantités de tokens d'entrée et de sortie - issues de votre tokenizer, de votre modèle de prompt ou des métadonnées API - et l'outil calcule instantanément le coût par appel et la dépense mensuelle ou annuelle projetée. Il diffère d'un compteur de tokens, qui estime les tokens à partir de texte brut.
Les tokens d'entrée représentent le prompt envoyé au modèle, les tokens de sortie la réponse générée. Ces derniers sont plus coûteux en calcul et facturés à un tarif bien plus élevé - généralement 3 à 8× celui de l'entrée. Pour la plupart des charges, réduire les tokens de sortie inutiles a plus d'impact que réduire les tokens d'entrée.
Le cache de prompts stocke les contenus répétitifs dans un cache temporaire. Les requêtes suivantes réutilisant exactement ce préfixe sont facturées à un tarif nettement réduit (souvent 10-25 % du tarif d'entrée standard, soit 75-90 % d'économie). Le calculateur permet de saisir votre nombre de tokens mis en cache pour modéliser ces économies précisément.
Le calculateur inclut plus de 20 modèles d'OpenAI (GPT-5.5, GPT-4o, o3, o4-mini), Anthropic (Claude 3.7 Sonnet, Claude 3.5 Haiku, Claude 3 Opus), Google (Gemini 2.5 Pro/Flash, Gemini 1.5 Pro), xAI (Grok 3, Grok 3 Mini), DeepSeek (V3, R1), Mistral (Large, Small), Cohere (Command R+/R) et Meta (Llama 3.1 70B/405B).
Oui. Dépliez la section « Tarifs de modèles personnalisés » pour ajouter des modèles avec vos propres tarifs par million de tokens. Ils apparaissent dans le tableau comparatif aux côtés des préréglages, vous permettant de comparer des modèles ajustés ou privés aux fournisseurs d'API hébergés.
Tous les tarifs reflètent les prix Pay-As-You-Go standard de la documentation publiée de chaque fournisseur. Les coûts réels peuvent varier selon les taxes régionales, les remises de volume ou les accords entreprise. Vérifiez toujours sur la page tarifaire officielle du fournisseur avant toute décision de facturation en production.
Oui. Le calculateur fonctionne 100 % côté client dans votre navigateur. Vos décomptes de tokens, volumes de requêtes et estimations de coûts sont calculés localement sur votre appareil et jamais transmis à un serveur. Aucune donnée ne quitte votre navigateur et aucune inscription n'est requise.