Calculateur de coûts DeepSeek
Estimez gratuitement les dépenses de l'API DeepSeek selon votre usage de tokens. Prise en charge des comparaisons de modèles (DeepSeek-V4-Flash, DeepSeek-V4-Pro, V3, R1), des remises de taux de succès du cache de prompt, de la modélisation des tokens de raisonnement et des prévisions mensuelles. Rapide, sécurisé et totalement privé.
Estimate input/output token pricing, compare legacy and active model tiers, configure context caching hit rates, and analyze overall API forecasts locally.
Prompt & Response Tokens
Cost Optimizations
Workload Call Volume
Projected Monthly Workload Cost
Cost/Call
$0.001120
Input Cost
$0.000700
Output Cost
$0.000280
Reasoning Cost
$0.000140
Model Pricing Comparisons
Sorted by lowest cost| Model Name | Cost/Call | Monthly Forecast | Caching / Reasoning |
|---|---|---|---|
| DeepSeek-V3 (Legacy) | $0.000980 | $29.40 | Cache Supported |
| DeepSeek-V4-FlashCost-Effective Selected | $0.001120 | $33.60 | Cache Supported Reasoning |
| DeepSeek-V4-ProCapable | $0.003480 | $104.40 | Cache Supported Reasoning |
| DeepSeek-R1 (Legacy) | $0.006035 | $181.05 | Cache Supported Reasoning |
Les quatre postes d'une facture DeepSeek
Chez DeepSeek, le coût ne se limite pas à l'entrée et à la sortie. Le cache peut fortement réduire le coût des tokens répétés, et les tokens de raisonnement ajoutent du coût sans apparaître dans la réponse.
Saisissez tokens d'entrée, tokens en cache, tokens de sortie et tokens de raisonnement avec votre volume de requêtes pour voir le coût réel par requête et la prévision mensuelle.
- Les tokens de sortie coûtent 2 à 4 fois plus cher que ceux d'entrée.
- Les tokens en cache peuvent être jusqu'à 98 % moins chers que les tokens d'entrée standard.
- Les tokens de raisonnement sont facturés comme de la sortie, même s'ils n'apparaissent pas dans la réponse.
Quand utiliser le cache ou le traitement par lots
Cache et Batch API ne sont pas concurrents : ils répondent à des besoins différents et peuvent se combiner.
- Cache : utile quand un même préfixe long se répète dans de nombreuses requêtes.
- Batch : utile quand vous tolérez 24 heures d'attente et n'avez pas besoin de réponse immédiate.
- Aucun des deux n'aide si chaque requête utilise un prompt court et différent.
Choisir son modèle avec discernement
La famille DeepSeek couvre du haut volume à faible coût jusqu'au raisonnement complexe. Choisir la mauvaise variante multiplie la facture sans améliorer le résultat.
- Mesurez les tokens réels d'une requête représentative, y compris le raisonnement.
- Calculez le coût par requête avec votre modèle actuel et votre volume mensuel.
- Comparez avec d'autres variantes DeepSeek sur la même charge de travail.
- Activez cache ou Batch si votre usage le permet et vérifiez l'économie obtenue.
Foire aux questions
C'est un outil qui estime la tarification de l'API DeepSeek selon vos tokens d'entrée, en cache et de sortie, vos volumes de requêtes et vos configurations de modèle. Il aide les développeurs à planifier leurs budgets et à choisir le modèle DeepSeek le plus économique. Il fonctionne entièrement dans votre navigateur, sans inscription.
Notre calculateur utilise les tarifs Pay-As-You-Go standards de la documentation officielle de l'API DeepSeek. Les coûts réels peuvent toutefois varier selon les plans personnalisés, les hébergeurs tiers (OpenRouter, Together AI, Novita) ou les mises à jour tarifaires de DeepSeek. Consultez toujours la page de tarification officielle pour les tarifs définitifs.
Les tokens d'entrée représentent le texte ou le média envoyé dans votre prompt. Les tokens de sortie représentent le texte de réponse généré par le modèle. Leur génération est plus coûteuse en calcul, ils sont donc facturés nettement plus cher (généralement 2 à 4 fois plus) que les tokens d'entrée sur tous les modèles DeepSeek.
Le cache de contexte permet de stocker en cache de grands blocs répétitifs (base de code volumineuse, livre, longues instructions système). Lors d'une requête, le modèle lit le cache au lieu de retraiter tout le prompt. Les tokens d'entrée en cache bénéficient d'une remise massive (souvent jusqu'à 98 % moins chers que les tokens d'entrée standard).
Les modèles de raisonnement génèrent des tokens internes de chaîne de pensée pendant leur traitement. Ces tokens ne sont pas renvoyés dans la réponse API mais sont facturés au prix des tokens de sortie standard. Incluez une estimation de ces tokens dans le champ dédié du calculateur pour un budget précis.
Oui. La Batch API est conçue pour les charges non sensibles à la latence (traitement de données hors ligne, par exemple). Les requêtes par lots bénéficient automatiquement de 50 % de remise sur les tarifs d'entrée et de sortie.
Non. Le calculateur fonctionne entièrement côté client dans votre navigateur. Vos saisies, tailles de tokens, coûts estimés et résultats de comparaison sont traités localement sur votre appareil et ne sont jamais envoyés à un serveur. Vos données restent 100 % privées et sécurisées.