DeepSeek-Kostenrechner
Schätzen Sie kostenlos DeepSeek-API-Ausgaben anhand Ihrer Token-Nutzung. Unterstützt Modellvergleiche (DeepSeek-V4-Flash, DeepSeek-V4-Pro, V3, R1), Rabatte über die Prompt-Cache-Trefferquote, Modellierung von Reasoning-Tokens und Monatsprognosen. Schnell, sicher und vollständig privat.
Estimate input/output token pricing, compare legacy and active model tiers, configure context caching hit rates, and analyze overall API forecasts locally.
Prompt & Response Tokens
Cost Optimizations
Workload Call Volume
Projected Monthly Workload Cost
Cost/Call
$0.001120
Input Cost
$0.000700
Output Cost
$0.000280
Reasoning Cost
$0.000140
Model Pricing Comparisons
Sorted by lowest cost| Model Name | Cost/Call | Monthly Forecast | Caching / Reasoning |
|---|---|---|---|
| DeepSeek-V3 (Legacy) | $0.000980 | $29.40 | Cache Supported |
| DeepSeek-V4-FlashCost-Effective Selected | $0.001120 | $33.60 | Cache Supported Reasoning |
| DeepSeek-V4-ProCapable | $0.003480 | $104.40 | Cache Supported Reasoning |
| DeepSeek-R1 (Legacy) | $0.006035 | $181.05 | Cache Supported Reasoning |
Die vier Posten einer DeepSeek-Rechnung
Bei DeepSeek beschränkt sich der Preis nicht auf Ein- und Ausgabe. Caching kann wiederkehrende Tokens stark verbilligen, und Reasoning-Tokens kosten zusätzlich, ohne in der Antwort zu erscheinen.
Tragen Sie Ein-, Cache-, Ausgabe- und Reasoning-Tokens mit Ihrem Anfragevolumen ein, um echte Kosten pro Anfrage und die Monatsprognose zu sehen.
- Ausgabe-Tokens kosten 2- bis 4-mal mehr als Eingabe-Tokens.
- Gecachte Tokens sind bis zu 98 % günstiger als Standard-Eingabe-Tokens.
- Reasoning-Tokens werden wie Ausgabe berechnet, auch wenn sie nicht in der Antwort erscheinen.
Wann Cache und wann Batch nutzen
Caching und Batch API konkurrieren nicht: Sie lösen unterschiedliche Probleme und lassen sich kombinieren.
- Caching: sinnvoll, wenn sich ein langer Prefix in vielen Anfragen wiederholt.
- Batch: sinnvoll, wenn 24 Stunden Wartezeit akzeptabel sind und keine Sofortantwort nötig ist.
- Keines von beiden hilft, wenn jede Anfrage einen kurzen, anderen Prompt nutzt.
Modell bewusst wählen
Die DeepSeek-Familie reicht von günstigem Hochvolumen bis zu komplexem Reasoning. Die falsche Variante vervielfacht die Rechnung, ohne das Ergebnis zu verbessern.
- Messen Sie reale Tokens einer repräsentativen Anfrage, inklusive Reasoning.
- Berechnen Sie Kosten pro Anfrage mit Ihrem aktuellen Modell und Monatsvolumen.
- Vergleichen Sie mit anderen DeepSeek-Varianten bei gleicher Last.
- Aktivieren Sie Cache oder Batch, wenn Ihr Muster passt, und prüfen Sie die Ersparnis.
Häufig gestellte Fragen
Er schätzt die DeepSeek-API-Preise anhand Ihrer Ein-, Cache- und Ausgabe-Tokens, Anfragevolumen und Modellkonfigurationen. Er hilft Entwicklern, Budgets zu planen und das wirtschaftlichste DeepSeek-Modell für ihre Last zu wählen. Er läuft vollständig im Browser, ohne Registrierung.
Der Rechner nutzt die Standard-Pay-As-You-Go-Tarife aus der offiziellen DeepSeek-API-Dokumentation. Reale Kosten können jedoch durch individuelle Preispläne, Drittanbieter-Hosting (OpenRouter, Together AI, Novita) oder Preisupdates von DeepSeek abweichen. Prüfen Sie stets die offizielle Preisseite für verbindliche Tarife.
Eingabe-Tokens sind der Text oder das Medium, das Sie im Prompt senden. Ausgabe-Tokens sind der vom Modell generierte Antworttext. Deren Erzeugung ist rechenintensiver und wird daher bei allen DeepSeek-Modellen deutlich teurer berechnet (meist 2- bis 4-fach).
Context Caching speichert große, wiederkehrende Inhaltsblöcke (etwa eine umfangreiche Codebasis, ein Buch oder lange Systemanweisungen) im Cache. Bei einer Anfrage liest das Modell aus dem Cache, statt den gesamten Prompt neu zu verarbeiten. Gecachte Eingabe-Tokens werden massiv rabattiert (meist bis zu 98 % günstiger als Standard-Eingabe-Tokens).
Reasoning-Modelle erzeugen intern Chain-of-Thought-Tokens während der Verarbeitung. Diese erscheinen nicht in der API-Ausgabe, werden aber zum Preis von Standard-Ausgabe-Tokens berechnet. Tragen Sie geschätzte Denk-Tokens im Feld für Reasoning-Tokens ein, um präzise zu budgetieren.
Ja. Die Batch API ist für latenzunempfindliche Lasten gedacht (z. B. Offline-Datenverarbeitung). Batch-Anfragen erhalten automatisch 50 % Rabatt auf Ein- und Ausgabetarife.
Nein. Der Rechner läuft vollständig clientseitig im Browser. Eingaben, Tokengrößen, geschätzte Kosten und Vergleichsergebnisse werden lokal auf Ihrem Gerät verarbeitet und nie an einen Server gesendet. Ihre Daten bleiben 100 % privat und sicher.