Aller au contenu
Aback Tools Logo

Calculateur de coûts Claude

Estimez gratuitement en ligne vos coûts d'API Anthropic Claude. Prise en charge du choix de modèle, de l'estimation des tokens, du cache de prompt, des remises Batch API et des projections mensuelles/annuelles. Comparez les coûts côte à côte entre tous les modèles Claude (Claude 3.5, Opus, Sonnet, Haiku et les paliers nouvelle génération Claude 5) pour trouver le meilleur équilibre entre vitesse, capacité et budget. Sans inscription – les calculs s'exécutent localement dans votre navigateur.

Claude Cost Calculator

Estimate standard and cached input/output token pricing, configure Batch discounts, and analyze overall API workloads and model comparisons locally.

Input/1M: $3.00Output/1M: $15.00Cache/1M: $0.30

Prompt Tokens

tokens
tokens

Cost Optimizations

Workload Call Volume

reqs

Projected Monthly Workload Cost

$900.00for 30,000 total requests

Cost per Single Call

$0.0300

Input Token Cost

$0.0150

Output Token Cost

$0.0150

Model Pricing Comparisons

Sorted by lowest cost
Model NameCost/CallMonthly ForecastOptimization Match
Claude 3 Haiku
In: $0.25/M • Out: $1.25/M • Cache: $0.03/M
$0.002500$75.00Caching Supported
Claude Haiku 4.5Cost-Effective
In: $1.00/M • Out: $5.00/M • Cache: $0.10/M
$0.0100$300.00Caching Supported
Claude 3.5 HaikuCost-Effective
In: $1.00/M • Out: $5.00/M • Cache: $0.10/M
$0.0100$300.00Caching Supported
Claude Sonnet 4.6Capable
In: $3.00/M • Out: $15.00/M • Cache: $0.30/M
$0.0300$900.00Caching Supported
Claude 3.5 SonnetCapable Selected
In: $3.00/M • Out: $15.00/M • Cache: $0.30/M
$0.0300$900.00Caching Supported
Claude 3 Sonnet
In: $3.00/M • Out: $15.00/M • Cache: $0.30/M
$0.0300$900.00Caching Supported
Claude Opus 4.8Capable
In: $5.00/M • Out: $25.00/M • Cache: $0.50/M
$0.0500$1,500.00Caching Supported
Claude Fable 5Capable
In: $10.00/M • Out: $50.00/M • Cache: $1.00/M
$0.1000$3,000.00Caching Supported
Claude 3 Opus
In: $15.00/M • Out: $75.00/M • Cache: $1.50/M
$0.1500$4,500.00Caching Supported
Calculations Disclaimer: Estimations are computed based on standard Anthropic Claude per-token pricing sheets. Real-world API expenses may deviate slightly due to tokenization rounding differences (Word count to Token conversion ratio varies by text content), regional tax schedules, or custom SLA pricing. Context caching read rates apply standardly at a 90% input read discount.

Comprendre la structure de coûts Claude

Le coût de Claude dépend de trois variables : le modèle choisi, la répartition entre tokens d'entrée et de sortie, et le volume de requêtes. Les tokens de sortie coûtent généralement 3 à 5 fois plus cher que ceux d'entrée : la longueur des réponses domine la facture.

Saisissez les tokens d'entrée et de sortie par requête, le volume mensuel et le modèle pour obtenir la projection et comparer les options.

  • Les tokens de sortie dominent le coût par requête : contrôler la longueur des réponses est le levier le plus efficace.
  • Le cache de prompt peut réduire jusqu'à 90 % le coût des tokens d'entrée réutilisés.
  • La Batch API applique une remise fixe de 50 % quand la réponse en temps réel n'est pas nécessaire.

Quand chaque économie vaut la peine

Cache et Batch ne sont pas toujours utiles. Le cache exige des prompts longs et répétés ; le Batch exige de tolérer une latence de 24 heures.

  • Cache : utile avec de longs prompts système stables répétés à chaque requête.
  • Batch : utile pour le traitement de masse, les évaluations et les tâches non urgentes.
  • Aucune des deux ne réduit le coût d'un prompt court et unique.

Budgéter avec une marge de sécurité

Les estimations valent ce que valent vos hypothèses de tokens. Mesurez un échantillon réel avant d'extrapoler à tout le volume.

  1. Mesurez les tokens d'entrée et de sortie réellement observés sur un échantillon représentatif.
  2. Saisissez le volume mensuel prévu et sélectionnez le modèle.
  3. Activez le cache ou le Batch si votre usage s'y prête et comparez le scénario optimisé.
  4. Ajoutez une marge de 20-30 % pour les variations de longueur et la croissance d'usage.

Foire aux questions

C'est un outil conçu pour estimer les coûts d'usage de l'API Anthropic Claude. En saisissant les tokens d'entrée/prompt, les tokens de sortie/complétion, le volume de requêtes et en choisissant un modèle, les développeurs et fondateurs de SaaS peuvent projeter les dépenses mensuelles/annuelles et comparer les coûts entre modèles.

Le cache de prompt réduit fortement les coûts (jusqu'à 90 %) des tokens d'entrée que vous réutilisez sur plusieurs requêtes. Lorsqu'il est activé, seuls les tokens non cachés sont facturés au tarif standard ; les tokens cachés le sont à un tarif de lecture très réduit. Par exemple, sur Claude 3.5 Sonnet, les lectures en cache coûtent 0,30 $/M tokens contre 3,00 $/M au tarif standard.

Le cache de prompt exige une longueur minimale de 10 000 tokens pour Claude 3.5 Sonnet et Claude 3 Opus, et de 20 000 tokens pour Claude 3.5 Haiku. Les prompts plus courts ne peuvent pas être cachés et sont toujours facturés aux tarifs d'entrée standard.

La Batch API permet d'envoyer des lots de requêtes traitées de manière asynchrone sous 24 heures plutôt qu'en temps réel. En échange de ce délai de traitement, Anthropic offre une remise fixe de 50 % sur les tokens d'entrée et de sortie de tous les modèles. Activez l'option Batch API dans notre calculateur pour appliquer cette remise.

En règle générale, 1 token correspond à environ 4 caractères de texte anglais, soit environ 0,75 mot. Ainsi, 100 mots équivalent à environ 133 tokens et 1 000 mots à environ 1 333 tokens. Les tokens de sortie varient selon la complexité de la réponse et le format (code ou balises JSON par exemple, qui consomment davantage de tokens).

Oui, le tarif de base des modèles Claude hébergés sur Amazon Bedrock ou Google Vertex AI est généralement identique aux tarifs directs d'Anthropic. Des surcharges régionales ou des remises entreprise personnalisées de votre fournisseur cloud peuvent toutefois s'appliquer. Utilisez notre calculateur comme estimation de référence.

Oui, absolument. Le calculateur de coûts Claude fonctionne entièrement dans votre navigateur en JavaScript. Aucun nombre de tokens, volume de requêtes ou donnée projet n'est envoyé à un serveur externe ni enregistré. Vos calculs restent totalement privés.