Zum Inhalt springen
Aback Tools Logo

DeepSeek-Kostenrechner

Schätzen Sie kostenlos DeepSeek-API-Ausgaben anhand Ihrer Token-Nutzung. Unterstützt Modellvergleiche (DeepSeek-V4-Flash, DeepSeek-V4-Pro, V3, R1), Rabatte über die Prompt-Cache-Trefferquote, Modellierung von Reasoning-Tokens und Monatsprognosen. Schnell, sicher und vollständig privat.

DeepSeek Cost Calculator

Estimate input/output token pricing, compare legacy and active model tiers, configure context caching hit rates, and analyze overall API forecasts locally.

Input/1M (miss): $0.1400Input/1M (hit): $0.0028Output/1M: $0.2800

Prompt & Response Tokens

tokens
tokens
tokens

Cost Optimizations

Workload Call Volume

reqs

Projected Monthly Workload Cost

$33.60for 30,000 total requests

Cost/Call

$0.001120

Input Cost

$0.000700

Output Cost

$0.000280

Reasoning Cost

$0.000140

Model Pricing Comparisons

Sorted by lowest cost
Model NameCost/CallMonthly ForecastCaching / Reasoning
DeepSeek-V3 (Legacy)$0.000980$29.40Cache Supported
DeepSeek-V4-FlashCost-Effective Selected$0.001120$33.60Cache Supported Reasoning
DeepSeek-V4-ProCapable$0.003480$104.40Cache Supported Reasoning
DeepSeek-R1 (Legacy)$0.006035$181.05Cache Supported Reasoning
Calculations Disclaimer: Estimations are computed based on standard DeepSeek API pricing sheets. Real-world API expenses may deviate slightly due to tokenization rounding differences (Word count to Token conversion ratio varies by content text), regional taxes, or custom enterprise SLAs. Cache hit rates represent the percentage of input tokens served by cache hits (billed at a massive discount). Reasoning tokens are generated internally by reasoning-capable models and are billed standardly per output token.

Die vier Posten einer DeepSeek-Rechnung

Bei DeepSeek beschränkt sich der Preis nicht auf Ein- und Ausgabe. Caching kann wiederkehrende Tokens stark verbilligen, und Reasoning-Tokens kosten zusätzlich, ohne in der Antwort zu erscheinen.

Tragen Sie Ein-, Cache-, Ausgabe- und Reasoning-Tokens mit Ihrem Anfragevolumen ein, um echte Kosten pro Anfrage und die Monatsprognose zu sehen.

  • Ausgabe-Tokens kosten 2- bis 4-mal mehr als Eingabe-Tokens.
  • Gecachte Tokens sind bis zu 98 % günstiger als Standard-Eingabe-Tokens.
  • Reasoning-Tokens werden wie Ausgabe berechnet, auch wenn sie nicht in der Antwort erscheinen.

Wann Cache und wann Batch nutzen

Caching und Batch API konkurrieren nicht: Sie lösen unterschiedliche Probleme und lassen sich kombinieren.

  • Caching: sinnvoll, wenn sich ein langer Prefix in vielen Anfragen wiederholt.
  • Batch: sinnvoll, wenn 24 Stunden Wartezeit akzeptabel sind und keine Sofortantwort nötig ist.
  • Keines von beiden hilft, wenn jede Anfrage einen kurzen, anderen Prompt nutzt.

Modell bewusst wählen

Die DeepSeek-Familie reicht von günstigem Hochvolumen bis zu komplexem Reasoning. Die falsche Variante vervielfacht die Rechnung, ohne das Ergebnis zu verbessern.

  1. Messen Sie reale Tokens einer repräsentativen Anfrage, inklusive Reasoning.
  2. Berechnen Sie Kosten pro Anfrage mit Ihrem aktuellen Modell und Monatsvolumen.
  3. Vergleichen Sie mit anderen DeepSeek-Varianten bei gleicher Last.
  4. Aktivieren Sie Cache oder Batch, wenn Ihr Muster passt, und prüfen Sie die Ersparnis.

Häufig gestellte Fragen

Er schätzt die DeepSeek-API-Preise anhand Ihrer Ein-, Cache- und Ausgabe-Tokens, Anfragevolumen und Modellkonfigurationen. Er hilft Entwicklern, Budgets zu planen und das wirtschaftlichste DeepSeek-Modell für ihre Last zu wählen. Er läuft vollständig im Browser, ohne Registrierung.

Der Rechner nutzt die Standard-Pay-As-You-Go-Tarife aus der offiziellen DeepSeek-API-Dokumentation. Reale Kosten können jedoch durch individuelle Preispläne, Drittanbieter-Hosting (OpenRouter, Together AI, Novita) oder Preisupdates von DeepSeek abweichen. Prüfen Sie stets die offizielle Preisseite für verbindliche Tarife.

Eingabe-Tokens sind der Text oder das Medium, das Sie im Prompt senden. Ausgabe-Tokens sind der vom Modell generierte Antworttext. Deren Erzeugung ist rechenintensiver und wird daher bei allen DeepSeek-Modellen deutlich teurer berechnet (meist 2- bis 4-fach).

Context Caching speichert große, wiederkehrende Inhaltsblöcke (etwa eine umfangreiche Codebasis, ein Buch oder lange Systemanweisungen) im Cache. Bei einer Anfrage liest das Modell aus dem Cache, statt den gesamten Prompt neu zu verarbeiten. Gecachte Eingabe-Tokens werden massiv rabattiert (meist bis zu 98 % günstiger als Standard-Eingabe-Tokens).

Reasoning-Modelle erzeugen intern Chain-of-Thought-Tokens während der Verarbeitung. Diese erscheinen nicht in der API-Ausgabe, werden aber zum Preis von Standard-Ausgabe-Tokens berechnet. Tragen Sie geschätzte Denk-Tokens im Feld für Reasoning-Tokens ein, um präzise zu budgetieren.

Ja. Die Batch API ist für latenzunempfindliche Lasten gedacht (z. B. Offline-Datenverarbeitung). Batch-Anfragen erhalten automatisch 50 % Rabatt auf Ein- und Ausgabetarife.

Nein. Der Rechner läuft vollständig clientseitig im Browser. Eingaben, Tokengrößen, geschätzte Kosten und Vergleichsergebnisse werden lokal auf Ihrem Gerät verarbeitet und nie an einen Server gesendet. Ihre Daten bleiben 100 % privat und sicher.