Aller au contenu
Aback Tools Logo

Calculateur de coûts DeepSeek

Estimez gratuitement les dépenses de l'API DeepSeek selon votre usage de tokens. Prise en charge des comparaisons de modèles (DeepSeek-V4-Flash, DeepSeek-V4-Pro, V3, R1), des remises de taux de succès du cache de prompt, de la modélisation des tokens de raisonnement et des prévisions mensuelles. Rapide, sécurisé et totalement privé.

DeepSeek Cost Calculator

Estimate input/output token pricing, compare legacy and active model tiers, configure context caching hit rates, and analyze overall API forecasts locally.

Input/1M (miss): $0.1400Input/1M (hit): $0.0028Output/1M: $0.2800

Prompt & Response Tokens

tokens
tokens
tokens

Cost Optimizations

Workload Call Volume

reqs

Projected Monthly Workload Cost

$33.60for 30,000 total requests

Cost/Call

$0.001120

Input Cost

$0.000700

Output Cost

$0.000280

Reasoning Cost

$0.000140

Model Pricing Comparisons

Sorted by lowest cost
Model NameCost/CallMonthly ForecastCaching / Reasoning
DeepSeek-V3 (Legacy)$0.000980$29.40Cache Supported
DeepSeek-V4-FlashCost-Effective Selected$0.001120$33.60Cache Supported Reasoning
DeepSeek-V4-ProCapable$0.003480$104.40Cache Supported Reasoning
DeepSeek-R1 (Legacy)$0.006035$181.05Cache Supported Reasoning
Calculations Disclaimer: Estimations are computed based on standard DeepSeek API pricing sheets. Real-world API expenses may deviate slightly due to tokenization rounding differences (Word count to Token conversion ratio varies by content text), regional taxes, or custom enterprise SLAs. Cache hit rates represent the percentage of input tokens served by cache hits (billed at a massive discount). Reasoning tokens are generated internally by reasoning-capable models and are billed standardly per output token.

Les quatre postes d'une facture DeepSeek

Chez DeepSeek, le coût ne se limite pas à l'entrée et à la sortie. Le cache peut fortement réduire le coût des tokens répétés, et les tokens de raisonnement ajoutent du coût sans apparaître dans la réponse.

Saisissez tokens d'entrée, tokens en cache, tokens de sortie et tokens de raisonnement avec votre volume de requêtes pour voir le coût réel par requête et la prévision mensuelle.

  • Les tokens de sortie coûtent 2 à 4 fois plus cher que ceux d'entrée.
  • Les tokens en cache peuvent être jusqu'à 98 % moins chers que les tokens d'entrée standard.
  • Les tokens de raisonnement sont facturés comme de la sortie, même s'ils n'apparaissent pas dans la réponse.

Quand utiliser le cache ou le traitement par lots

Cache et Batch API ne sont pas concurrents : ils répondent à des besoins différents et peuvent se combiner.

  • Cache : utile quand un même préfixe long se répète dans de nombreuses requêtes.
  • Batch : utile quand vous tolérez 24 heures d'attente et n'avez pas besoin de réponse immédiate.
  • Aucun des deux n'aide si chaque requête utilise un prompt court et différent.

Choisir son modèle avec discernement

La famille DeepSeek couvre du haut volume à faible coût jusqu'au raisonnement complexe. Choisir la mauvaise variante multiplie la facture sans améliorer le résultat.

  1. Mesurez les tokens réels d'une requête représentative, y compris le raisonnement.
  2. Calculez le coût par requête avec votre modèle actuel et votre volume mensuel.
  3. Comparez avec d'autres variantes DeepSeek sur la même charge de travail.
  4. Activez cache ou Batch si votre usage le permet et vérifiez l'économie obtenue.

Foire aux questions

C'est un outil qui estime la tarification de l'API DeepSeek selon vos tokens d'entrée, en cache et de sortie, vos volumes de requêtes et vos configurations de modèle. Il aide les développeurs à planifier leurs budgets et à choisir le modèle DeepSeek le plus économique. Il fonctionne entièrement dans votre navigateur, sans inscription.

Notre calculateur utilise les tarifs Pay-As-You-Go standards de la documentation officielle de l'API DeepSeek. Les coûts réels peuvent toutefois varier selon les plans personnalisés, les hébergeurs tiers (OpenRouter, Together AI, Novita) ou les mises à jour tarifaires de DeepSeek. Consultez toujours la page de tarification officielle pour les tarifs définitifs.

Les tokens d'entrée représentent le texte ou le média envoyé dans votre prompt. Les tokens de sortie représentent le texte de réponse généré par le modèle. Leur génération est plus coûteuse en calcul, ils sont donc facturés nettement plus cher (généralement 2 à 4 fois plus) que les tokens d'entrée sur tous les modèles DeepSeek.

Le cache de contexte permet de stocker en cache de grands blocs répétitifs (base de code volumineuse, livre, longues instructions système). Lors d'une requête, le modèle lit le cache au lieu de retraiter tout le prompt. Les tokens d'entrée en cache bénéficient d'une remise massive (souvent jusqu'à 98 % moins chers que les tokens d'entrée standard).

Les modèles de raisonnement génèrent des tokens internes de chaîne de pensée pendant leur traitement. Ces tokens ne sont pas renvoyés dans la réponse API mais sont facturés au prix des tokens de sortie standard. Incluez une estimation de ces tokens dans le champ dédié du calculateur pour un budget précis.

Oui. La Batch API est conçue pour les charges non sensibles à la latence (traitement de données hors ligne, par exemple). Les requêtes par lots bénéficient automatiquement de 50 % de remise sur les tarifs d'entrée et de sortie.

Non. Le calculateur fonctionne entièrement côté client dans votre navigateur. Vos saisies, tailles de tokens, coûts estimés et résultats de comparaison sont traités localement sur votre appareil et ne sont jamais envoyés à un serveur. Vos données restent 100 % privées et sécurisées.