Calculateur de coûts Claude
Estimez gratuitement en ligne vos coûts d'API Anthropic Claude. Prise en charge du choix de modèle, de l'estimation des tokens, du cache de prompt, des remises Batch API et des projections mensuelles/annuelles. Comparez les coûts côte à côte entre tous les modèles Claude (Claude 3.5, Opus, Sonnet, Haiku et les paliers nouvelle génération Claude 5) pour trouver le meilleur équilibre entre vitesse, capacité et budget. Sans inscription – les calculs s'exécutent localement dans votre navigateur.
Estimate standard and cached input/output token pricing, configure Batch discounts, and analyze overall API workloads and model comparisons locally.
Prompt Tokens
Cost Optimizations
Workload Call Volume
Projected Monthly Workload Cost
Cost per Single Call
$0.0300
Input Token Cost
$0.0150
Output Token Cost
$0.0150
Model Pricing Comparisons
Sorted by lowest cost| Model Name | Cost/Call | Monthly Forecast | Optimization Match |
|---|---|---|---|
Claude 3 Haiku In: $0.25/M • Out: $1.25/M • Cache: $0.03/M | $0.002500 | $75.00 | Caching Supported |
Claude Haiku 4.5Cost-Effective In: $1.00/M • Out: $5.00/M • Cache: $0.10/M | $0.0100 | $300.00 | Caching Supported |
Claude 3.5 HaikuCost-Effective In: $1.00/M • Out: $5.00/M • Cache: $0.10/M | $0.0100 | $300.00 | Caching Supported |
Claude Sonnet 4.6Capable In: $3.00/M • Out: $15.00/M • Cache: $0.30/M | $0.0300 | $900.00 | Caching Supported |
Claude 3.5 SonnetCapable Selected In: $3.00/M • Out: $15.00/M • Cache: $0.30/M | $0.0300 | $900.00 | Caching Supported |
Claude 3 Sonnet In: $3.00/M • Out: $15.00/M • Cache: $0.30/M | $0.0300 | $900.00 | Caching Supported |
Claude Opus 4.8Capable In: $5.00/M • Out: $25.00/M • Cache: $0.50/M | $0.0500 | $1,500.00 | Caching Supported |
Claude Fable 5Capable In: $10.00/M • Out: $50.00/M • Cache: $1.00/M | $0.1000 | $3,000.00 | Caching Supported |
Claude 3 Opus In: $15.00/M • Out: $75.00/M • Cache: $1.50/M | $0.1500 | $4,500.00 | Caching Supported |
Comprendre la structure de coûts Claude
Le coût de Claude dépend de trois variables : le modèle choisi, la répartition entre tokens d'entrée et de sortie, et le volume de requêtes. Les tokens de sortie coûtent généralement 3 à 5 fois plus cher que ceux d'entrée : la longueur des réponses domine la facture.
Saisissez les tokens d'entrée et de sortie par requête, le volume mensuel et le modèle pour obtenir la projection et comparer les options.
- Les tokens de sortie dominent le coût par requête : contrôler la longueur des réponses est le levier le plus efficace.
- Le cache de prompt peut réduire jusqu'à 90 % le coût des tokens d'entrée réutilisés.
- La Batch API applique une remise fixe de 50 % quand la réponse en temps réel n'est pas nécessaire.
Quand chaque économie vaut la peine
Cache et Batch ne sont pas toujours utiles. Le cache exige des prompts longs et répétés ; le Batch exige de tolérer une latence de 24 heures.
- Cache : utile avec de longs prompts système stables répétés à chaque requête.
- Batch : utile pour le traitement de masse, les évaluations et les tâches non urgentes.
- Aucune des deux ne réduit le coût d'un prompt court et unique.
Budgéter avec une marge de sécurité
Les estimations valent ce que valent vos hypothèses de tokens. Mesurez un échantillon réel avant d'extrapoler à tout le volume.
- Mesurez les tokens d'entrée et de sortie réellement observés sur un échantillon représentatif.
- Saisissez le volume mensuel prévu et sélectionnez le modèle.
- Activez le cache ou le Batch si votre usage s'y prête et comparez le scénario optimisé.
- Ajoutez une marge de 20-30 % pour les variations de longueur et la croissance d'usage.
Foire aux questions
C'est un outil conçu pour estimer les coûts d'usage de l'API Anthropic Claude. En saisissant les tokens d'entrée/prompt, les tokens de sortie/complétion, le volume de requêtes et en choisissant un modèle, les développeurs et fondateurs de SaaS peuvent projeter les dépenses mensuelles/annuelles et comparer les coûts entre modèles.
Le cache de prompt réduit fortement les coûts (jusqu'à 90 %) des tokens d'entrée que vous réutilisez sur plusieurs requêtes. Lorsqu'il est activé, seuls les tokens non cachés sont facturés au tarif standard ; les tokens cachés le sont à un tarif de lecture très réduit. Par exemple, sur Claude 3.5 Sonnet, les lectures en cache coûtent 0,30 $/M tokens contre 3,00 $/M au tarif standard.
Le cache de prompt exige une longueur minimale de 10 000 tokens pour Claude 3.5 Sonnet et Claude 3 Opus, et de 20 000 tokens pour Claude 3.5 Haiku. Les prompts plus courts ne peuvent pas être cachés et sont toujours facturés aux tarifs d'entrée standard.
La Batch API permet d'envoyer des lots de requêtes traitées de manière asynchrone sous 24 heures plutôt qu'en temps réel. En échange de ce délai de traitement, Anthropic offre une remise fixe de 50 % sur les tokens d'entrée et de sortie de tous les modèles. Activez l'option Batch API dans notre calculateur pour appliquer cette remise.
En règle générale, 1 token correspond à environ 4 caractères de texte anglais, soit environ 0,75 mot. Ainsi, 100 mots équivalent à environ 133 tokens et 1 000 mots à environ 1 333 tokens. Les tokens de sortie varient selon la complexité de la réponse et le format (code ou balises JSON par exemple, qui consomment davantage de tokens).
Oui, le tarif de base des modèles Claude hébergés sur Amazon Bedrock ou Google Vertex AI est généralement identique aux tarifs directs d'Anthropic. Des surcharges régionales ou des remises entreprise personnalisées de votre fournisseur cloud peuvent toutefois s'appliquer. Utilisez notre calculateur comme estimation de référence.
Oui, absolument. Le calculateur de coûts Claude fonctionne entièrement dans votre navigateur en JavaScript. Aucun nombre de tokens, volume de requêtes ou donnée projet n'est envoyé à un serveur externe ni enregistré. Vos calculs restent totalement privés.