Aller au contenu
Aback Tools Logo

Calculateur de coût des tokens

Convertissez gratuitement en ligne des décomptes de tokens en coûts API estimés sur plus de 20 modèles. Comparez OpenAI, Anthropic, Google, xAI, DeepSeek, Mistral et plus côte à côte. Modélisez les économies de cache de prompts, ajoutez des tarifs personnalisés et prévoyez les dépenses mensuelles - dans votre navigateur, sans inscription.

Token Cost Calculator

Enter your input and output token counts to instantly calculate API costs across 20+ models from OpenAI, Anthropic, Google, xAI, DeepSeek, Mistral, Cohere, and Meta. Compare providers side-by-side, add custom pricing, and forecast monthly or annual spending.

Token Counts

tokens
tokens

Workload Volume

reqs

Primary Model

Monthly Cost - GPT-4o

$675.00for 30,000 calls

Cost / Call

$0.0225

Input Cost

$0.0125

Output Cost

$0.0100

Cache Savings

-

In rate: $2.5000/M tokensOut rate: $10.0000/M tokensCache rate: $1.2500/M tokens

Daily

$22.50

1,000 calls

Monthly

$675.00

30,000 calls

Yearly

$8,212.50

365,000 calls

Full Provider Comparison

ModelCost / CallInput CostOutput CostMonthly TotalFeatures
Mistral SmallMistralCost-Effective
$0.1000/M in · $0.3000/M out
$0.000800$0.000500$0.000300$24.00-
GPT-4o miniOpenAICost-Effective
$0.1500/M in · $0.6000/M out
$0.001350$0.000750$0.000600$40.50Caching
Command RCohereCost-Effective
$0.1500/M in · $0.6000/M out
$0.001350$0.000750$0.000600$40.50-
Grok 3 MinixAICost-Effective
$0.3000/M in · $0.5000/M out
$0.002000$0.001500$0.000500$60.00-
DeepSeek-V3DeepSeekCost-Effective
$0.2700/M in · $1.1000/M out
$0.002450$0.001350$0.001100$73.50Caching
Gemini 2.5 FlashGoogleCost-Effective
$0.3000/M in · $2.5000/M out
$0.004000$0.001500$0.002500$120.00Caching
Llama 3.1 70BMetaCost-Effective
$0.7200/M in · $0.7200/M out
$0.004320$0.003600$0.000720$129.60-
DeepSeek-R1DeepSeek
$0.5500/M in · $2.1900/M out
$0.004940$0.002750$0.002190$148.20Caching
Claude 3.5 HaikuAnthropicCost-Effective
$0.8000/M in · $4.0000/M out
$0.008000$0.004000$0.004000$240.00Caching
o4-miniOpenAICost-Effective
$1.1000/M in · $4.4000/M out
$0.009900$0.005500$0.004400$297.00Caching
Gemini 1.5 ProGoogle
$1.2500/M in · $5.0000/M out
$0.0112$0.006250$0.005000$337.50Caching
Mistral LargeMistral
$2.0000/M in · $6.0000/M out
$0.0160$0.0100$0.006000$480.00-
Gemini 2.5 ProGoogle
$1.2500/M in · $10.0000/M out
$0.0163$0.006250$0.0100$487.50Caching
o3OpenAI
$2.0000/M in · $8.0000/M out
$0.0180$0.0100$0.008000$540.00Caching
GPT-4oOpenAI Primary
$2.5000/M in · $10.0000/M out
$0.0225$0.0125$0.0100$675.00Caching
Command R+Cohere
$2.5000/M in · $10.0000/M out
$0.0225$0.0125$0.0100$675.00-
Claude 3.7 SonnetAnthropicCapable
$3.0000/M in · $15.0000/M out
$0.0300$0.0150$0.0150$900.00Caching
Grok 3xAI
$3.0000/M in · $15.0000/M out
$0.0300$0.0150$0.0150$900.00-
Llama 3.1 405BMeta
$5.0000/M in · $16.0000/M out
$0.0410$0.0250$0.0160$1,230.00-
GPT-5.5OpenAICapable
$5.0000/M in · $30.0000/M out
$0.0550$0.0250$0.0300$1,650.00Caching
Claude 3 OpusAnthropicCapable
$15.0000/M in · $75.0000/M out
$0.1500$0.0750$0.0750$4,500.00Caching

Click any row to set it as the primary model. 21 models shown.

Pricing Disclaimer: Rates reflect standard Pay-As-You-Go pricing from each provider's published documentation. Actual costs may vary due to regional taxes, volume discounts, promotional credits, or custom enterprise agreements. Cached token rates apply to supported models only. All calculations run locally in your browser - no data is sent to any server.

Comment convertir des tokens en coût

Le calcul est direct : multipliez les tokens d'entrée par leur tarif, les tokens de sortie par le leur, puis additionnez. La difficulté réside dans le choix du modèle et dans la connaissance réelle des tokens générés.

Les tokens de sortie coûtent 3 à 8 fois plus cher, donc maîtriser la longueur des réponses apporte souvent la plus grosse économie.

  • Coût = tokens d'entrée × tarif d'entrée + tokens de sortie × tarif de sortie.
  • Les tarifs sont exprimés par million de tokens.
  • Choisissez l'unité de période pour voir le total pertinent.

Cache de prompts et modèles personnalisés

Si vous réutilisez un grand préfixe stable, le cache réduit fortement son coût. Saisissez les tokens mis en cache pour mesurer l'économie réelle.

  • Cache : généralement 10-25 % du tarif d'entrée standard.
  • Avantageux avec prompts système, instructions fixes ou contexte partagé.
  • Ajoutez des tarifs personnalisés pour comparer des modèles privés ou ajustés.

Comparer les fournisseurs et prévoir la dépense

L'objectif est de trouver le modèle le moins cher qui respecte votre niveau de qualité, pas le moins cher dans l'absolu.

  1. Obtenez votre décompte réel de tokens d'entrée et de sortie par appel.
  2. Saisissez le volume de requêtes et la période.
  3. Comparez les modèles candidats dans le tableau.
  4. Vérifiez la prévision mensuelle et annuelle avant de vous engager.

Foire aux questions

Il convertit les décomptes de tokens en coûts API estimés chez les fournisseurs de modèles de langage. Vous saisissez vos quantités de tokens d'entrée et de sortie - issues de votre tokenizer, de votre modèle de prompt ou des métadonnées API - et l'outil calcule instantanément le coût par appel et la dépense mensuelle ou annuelle projetée. Il diffère d'un compteur de tokens, qui estime les tokens à partir de texte brut.

Les tokens d'entrée représentent le prompt envoyé au modèle, les tokens de sortie la réponse générée. Ces derniers sont plus coûteux en calcul et facturés à un tarif bien plus élevé - généralement 3 à 8× celui de l'entrée. Pour la plupart des charges, réduire les tokens de sortie inutiles a plus d'impact que réduire les tokens d'entrée.

Le cache de prompts stocke les contenus répétitifs dans un cache temporaire. Les requêtes suivantes réutilisant exactement ce préfixe sont facturées à un tarif nettement réduit (souvent 10-25 % du tarif d'entrée standard, soit 75-90 % d'économie). Le calculateur permet de saisir votre nombre de tokens mis en cache pour modéliser ces économies précisément.

Le calculateur inclut plus de 20 modèles d'OpenAI (GPT-5.5, GPT-4o, o3, o4-mini), Anthropic (Claude 3.7 Sonnet, Claude 3.5 Haiku, Claude 3 Opus), Google (Gemini 2.5 Pro/Flash, Gemini 1.5 Pro), xAI (Grok 3, Grok 3 Mini), DeepSeek (V3, R1), Mistral (Large, Small), Cohere (Command R+/R) et Meta (Llama 3.1 70B/405B).

Oui. Dépliez la section « Tarifs de modèles personnalisés » pour ajouter des modèles avec vos propres tarifs par million de tokens. Ils apparaissent dans le tableau comparatif aux côtés des préréglages, vous permettant de comparer des modèles ajustés ou privés aux fournisseurs d'API hébergés.

Tous les tarifs reflètent les prix Pay-As-You-Go standard de la documentation publiée de chaque fournisseur. Les coûts réels peuvent varier selon les taxes régionales, les remises de volume ou les accords entreprise. Vérifiez toujours sur la page tarifaire officielle du fournisseur avant toute décision de facturation en production.

Oui. Le calculateur fonctionne 100 % côté client dans votre navigateur. Vos décomptes de tokens, volumes de requêtes et estimations de coûts sont calculés localement sur votre appareil et jamais transmis à un serveur. Aucune donnée ne quitte votre navigateur et aucune inscription n'est requise.