Zum Inhalt springen
Aback Tools Logo

Claude-Kostenrechner

Schätzen Sie kostenlos online Ihre Kosten für die Anthropic-Claude-API. Unterstützt Modellauswahl, Token-Schätzungen, Prompt-Caching, Batch-API-Rabatte sowie Monats- und Jahresprognosen. Vergleichen Sie Kosten direkt zwischen allen Claude-Modellen (inkl. Claude 3.5, Opus, Sonnet, Haiku und den Claude-5-Stufen der nächsten Generation), um die beste Balance aus Geschwindigkeit, Leistung und Budget zu finden. Ohne Registrierung – die Berechnungen laufen lokal im Browser.

Claude Cost Calculator

Estimate standard and cached input/output token pricing, configure Batch discounts, and analyze overall API workloads and model comparisons locally.

Input/1M: $3.00Output/1M: $15.00Cache/1M: $0.30

Prompt Tokens

tokens
tokens

Cost Optimizations

Workload Call Volume

reqs

Projected Monthly Workload Cost

$900.00for 30,000 total requests

Cost per Single Call

$0.0300

Input Token Cost

$0.0150

Output Token Cost

$0.0150

Model Pricing Comparisons

Sorted by lowest cost
Model NameCost/CallMonthly ForecastOptimization Match
Claude 3 Haiku
In: $0.25/M • Out: $1.25/M • Cache: $0.03/M
$0.002500$75.00Caching Supported
Claude Haiku 4.5Cost-Effective
In: $1.00/M • Out: $5.00/M • Cache: $0.10/M
$0.0100$300.00Caching Supported
Claude 3.5 HaikuCost-Effective
In: $1.00/M • Out: $5.00/M • Cache: $0.10/M
$0.0100$300.00Caching Supported
Claude Sonnet 4.6Capable
In: $3.00/M • Out: $15.00/M • Cache: $0.30/M
$0.0300$900.00Caching Supported
Claude 3.5 SonnetCapable Selected
In: $3.00/M • Out: $15.00/M • Cache: $0.30/M
$0.0300$900.00Caching Supported
Claude 3 Sonnet
In: $3.00/M • Out: $15.00/M • Cache: $0.30/M
$0.0300$900.00Caching Supported
Claude Opus 4.8Capable
In: $5.00/M • Out: $25.00/M • Cache: $0.50/M
$0.0500$1,500.00Caching Supported
Claude Fable 5Capable
In: $10.00/M • Out: $50.00/M • Cache: $1.00/M
$0.1000$3,000.00Caching Supported
Claude 3 Opus
In: $15.00/M • Out: $75.00/M • Cache: $1.50/M
$0.1500$4,500.00Caching Supported
Calculations Disclaimer: Estimations are computed based on standard Anthropic Claude per-token pricing sheets. Real-world API expenses may deviate slightly due to tokenization rounding differences (Word count to Token conversion ratio varies by text content), regional tax schedules, or custom SLA pricing. Context caching read rates apply standardly at a 90% input read discount.

Die Kostenstruktur von Claude verstehen

Die Claude-Kosten hängen von drei Variablen ab: gewähltes Modell, Verhältnis von Ein- zu Ausgabe-Tokens und Anfragevolumen. Ausgabe-Tokens kosten meist das 3- bis 5-Fache von Eingabe-Tokens – die Antwortlänge bestimmt die Rechnung.

Geben Sie Ein- und Ausgabe-Tokens pro Anfrage, Monatsvolumen und Modell ein, um die Prognose zu sehen und Alternativen zu vergleichen.

  • Ausgabe-Tokens dominieren die Kosten pro Anfrage: die Antwortlänge ist der wirksamste Hebel.
  • Prompt-Caching kann die Kosten wiederverwendeter Eingabe-Tokens um bis zu 90 % senken.
  • Die Batch API gewährt 50 % Rabatt, wenn keine Echtzeitantwort nötig ist.

Wann sich welche Einsparung lohnt

Caching und Batch helfen nicht immer. Caching braucht lange, wiederkehrende Prompts, Batch erfordert Toleranz für 24 Stunden Latenz.

  • Caching: sinnvoll bei langen, stabilen System-Prompts, die sich bei jeder Anfrage wiederholen.
  • Batch: sinnvoll für Massenverarbeitung, Auswertungen und Aufgaben, die warten können.
  • Beides senkt nicht die Kosten eines kurzen Einmal-Prompts.

Mit Sicherheitsmarge budgetieren

Schätzungen sind nur so gut wie Ihre Token-Annahmen. Messen Sie eine echte Stichprobe, bevor Sie auf das Gesamtvolumen hochrechnen.

  1. Messen Sie tatsächliche Ein- und Ausgabe-Tokens an einer repräsentativen Stichprobe.
  2. Tragen Sie das erwartete Monatsvolumen ein und wählen Sie das Modell.
  3. Aktivieren Sie Caching oder Batch, wenn Ihr Nutzungsmuster passt, und vergleichen Sie das optimierte Szenario.
  4. Planen Sie 20-30 % Marge für Längenvariation und Nutzungswachstum ein.

Häufig gestellte Fragen

Es ist ein Tool zur Schätzung der Nutzungskosten der Anthropic-Claude-API. Mit Eingabe- und Ausgabe-Tokens, Anfragevolumen und Modellwahl können Entwickler und SaaS-Gründer Monats- und Jahresausgaben prognostizieren und Kosten zwischen Modellen vergleichen.

Prompt-Caching senkt die Kosten für mehrfach wiederverwendete Eingabe-Tokens drastisch (bis zu 90 %). Bei aktiviertem Caching werden nur die nicht gecachten Tokens zum Standardtarif berechnet; gecachte Tokens werden zu einem deutlich reduzierten Lesetarif abgerechnet. Bei Claude 3.5 Sonnet kosten Cache-Lesevorgänge z. B. 0,30 $/Mio. Tokens statt 3,00 $/Mio.

Prompt-Caching erfordert eine Mindest-Promptlänge von 10.000 Tokens bei Claude 3.5 Sonnet und Claude 3 Opus sowie 20.000 Tokens bei Claude 3.5 Haiku. Kürzere Prompts können nicht gecacht werden und werden immer zu Standard-Eingabetarifen berechnet.

Die Batch API erlaubt das Hochladen von Anfrage-Batches, die asynchron innerhalb von 24 Stunden statt in Echtzeit verarbeitet werden. Im Gegenzug gewährt Anthropic einen pauschalen Rabatt von 50 % auf Ein- und Ausgabe-Tokens über alle Modelle. Aktivieren Sie die Batch-API-Option in unserem Rechner, um diesen Rabatt anzuwenden.

Faustregel: 1 Token entspricht etwa 4 Zeichen englischem Text bzw. rund 0,75 Wörtern. 100 Wörter sind also etwa 133 Tokens, 1.000 Wörter rund 1.333 Tokens. Ausgabe-Tokens variieren mit Antwortkomplexität und Formatierung (z. B. Code oder JSON-Tags verbrauchen mehr Tokens).

Ja, die Basistarife für Claude-Modelle auf Amazon Bedrock oder Google Vertex AI entsprechen in der Regel den Direkttarifen von Anthropic. Es können jedoch regionale Aufschläge oder individuelle Enterprise-Rabatte Ihres Cloud-Anbieters anfallen. Nutzen Sie unseren Rechner als Basis-Schätzung.

Ja, absolut. Der Claude-Kostenrechner läuft vollständig im Browser mit JavaScript. Keine Tokenzahlen, Anfragevolumina oder Projektdaten werden an einen externen Server übertragen oder gespeichert. Ihre Berechnungen bleiben vollständig privat.