Claude-Kostenrechner
Schätzen Sie kostenlos online Ihre Kosten für die Anthropic-Claude-API. Unterstützt Modellauswahl, Token-Schätzungen, Prompt-Caching, Batch-API-Rabatte sowie Monats- und Jahresprognosen. Vergleichen Sie Kosten direkt zwischen allen Claude-Modellen (inkl. Claude 3.5, Opus, Sonnet, Haiku und den Claude-5-Stufen der nächsten Generation), um die beste Balance aus Geschwindigkeit, Leistung und Budget zu finden. Ohne Registrierung – die Berechnungen laufen lokal im Browser.
Estimate standard and cached input/output token pricing, configure Batch discounts, and analyze overall API workloads and model comparisons locally.
Prompt Tokens
Cost Optimizations
Workload Call Volume
Projected Monthly Workload Cost
Cost per Single Call
$0.0300
Input Token Cost
$0.0150
Output Token Cost
$0.0150
Model Pricing Comparisons
Sorted by lowest cost| Model Name | Cost/Call | Monthly Forecast | Optimization Match |
|---|---|---|---|
Claude 3 Haiku In: $0.25/M • Out: $1.25/M • Cache: $0.03/M | $0.002500 | $75.00 | Caching Supported |
Claude Haiku 4.5Cost-Effective In: $1.00/M • Out: $5.00/M • Cache: $0.10/M | $0.0100 | $300.00 | Caching Supported |
Claude 3.5 HaikuCost-Effective In: $1.00/M • Out: $5.00/M • Cache: $0.10/M | $0.0100 | $300.00 | Caching Supported |
Claude Sonnet 4.6Capable In: $3.00/M • Out: $15.00/M • Cache: $0.30/M | $0.0300 | $900.00 | Caching Supported |
Claude 3.5 SonnetCapable Selected In: $3.00/M • Out: $15.00/M • Cache: $0.30/M | $0.0300 | $900.00 | Caching Supported |
Claude 3 Sonnet In: $3.00/M • Out: $15.00/M • Cache: $0.30/M | $0.0300 | $900.00 | Caching Supported |
Claude Opus 4.8Capable In: $5.00/M • Out: $25.00/M • Cache: $0.50/M | $0.0500 | $1,500.00 | Caching Supported |
Claude Fable 5Capable In: $10.00/M • Out: $50.00/M • Cache: $1.00/M | $0.1000 | $3,000.00 | Caching Supported |
Claude 3 Opus In: $15.00/M • Out: $75.00/M • Cache: $1.50/M | $0.1500 | $4,500.00 | Caching Supported |
Die Kostenstruktur von Claude verstehen
Die Claude-Kosten hängen von drei Variablen ab: gewähltes Modell, Verhältnis von Ein- zu Ausgabe-Tokens und Anfragevolumen. Ausgabe-Tokens kosten meist das 3- bis 5-Fache von Eingabe-Tokens – die Antwortlänge bestimmt die Rechnung.
Geben Sie Ein- und Ausgabe-Tokens pro Anfrage, Monatsvolumen und Modell ein, um die Prognose zu sehen und Alternativen zu vergleichen.
- Ausgabe-Tokens dominieren die Kosten pro Anfrage: die Antwortlänge ist der wirksamste Hebel.
- Prompt-Caching kann die Kosten wiederverwendeter Eingabe-Tokens um bis zu 90 % senken.
- Die Batch API gewährt 50 % Rabatt, wenn keine Echtzeitantwort nötig ist.
Wann sich welche Einsparung lohnt
Caching und Batch helfen nicht immer. Caching braucht lange, wiederkehrende Prompts, Batch erfordert Toleranz für 24 Stunden Latenz.
- Caching: sinnvoll bei langen, stabilen System-Prompts, die sich bei jeder Anfrage wiederholen.
- Batch: sinnvoll für Massenverarbeitung, Auswertungen und Aufgaben, die warten können.
- Beides senkt nicht die Kosten eines kurzen Einmal-Prompts.
Mit Sicherheitsmarge budgetieren
Schätzungen sind nur so gut wie Ihre Token-Annahmen. Messen Sie eine echte Stichprobe, bevor Sie auf das Gesamtvolumen hochrechnen.
- Messen Sie tatsächliche Ein- und Ausgabe-Tokens an einer repräsentativen Stichprobe.
- Tragen Sie das erwartete Monatsvolumen ein und wählen Sie das Modell.
- Aktivieren Sie Caching oder Batch, wenn Ihr Nutzungsmuster passt, und vergleichen Sie das optimierte Szenario.
- Planen Sie 20-30 % Marge für Längenvariation und Nutzungswachstum ein.
Häufig gestellte Fragen
Es ist ein Tool zur Schätzung der Nutzungskosten der Anthropic-Claude-API. Mit Eingabe- und Ausgabe-Tokens, Anfragevolumen und Modellwahl können Entwickler und SaaS-Gründer Monats- und Jahresausgaben prognostizieren und Kosten zwischen Modellen vergleichen.
Prompt-Caching senkt die Kosten für mehrfach wiederverwendete Eingabe-Tokens drastisch (bis zu 90 %). Bei aktiviertem Caching werden nur die nicht gecachten Tokens zum Standardtarif berechnet; gecachte Tokens werden zu einem deutlich reduzierten Lesetarif abgerechnet. Bei Claude 3.5 Sonnet kosten Cache-Lesevorgänge z. B. 0,30 $/Mio. Tokens statt 3,00 $/Mio.
Prompt-Caching erfordert eine Mindest-Promptlänge von 10.000 Tokens bei Claude 3.5 Sonnet und Claude 3 Opus sowie 20.000 Tokens bei Claude 3.5 Haiku. Kürzere Prompts können nicht gecacht werden und werden immer zu Standard-Eingabetarifen berechnet.
Die Batch API erlaubt das Hochladen von Anfrage-Batches, die asynchron innerhalb von 24 Stunden statt in Echtzeit verarbeitet werden. Im Gegenzug gewährt Anthropic einen pauschalen Rabatt von 50 % auf Ein- und Ausgabe-Tokens über alle Modelle. Aktivieren Sie die Batch-API-Option in unserem Rechner, um diesen Rabatt anzuwenden.
Faustregel: 1 Token entspricht etwa 4 Zeichen englischem Text bzw. rund 0,75 Wörtern. 100 Wörter sind also etwa 133 Tokens, 1.000 Wörter rund 1.333 Tokens. Ausgabe-Tokens variieren mit Antwortkomplexität und Formatierung (z. B. Code oder JSON-Tags verbrauchen mehr Tokens).
Ja, die Basistarife für Claude-Modelle auf Amazon Bedrock oder Google Vertex AI entsprechen in der Regel den Direkttarifen von Anthropic. Es können jedoch regionale Aufschläge oder individuelle Enterprise-Rabatte Ihres Cloud-Anbieters anfallen. Nutzen Sie unseren Rechner als Basis-Schätzung.
Ja, absolut. Der Claude-Kostenrechner läuft vollständig im Browser mit JavaScript. Keine Tokenzahlen, Anfragevolumina oder Projektdaten werden an einen externen Server übertragen oder gespeichert. Ihre Berechnungen bleiben vollständig privat.