Grok-Kostenrechner
Schätzen Sie die Kosten der xAI Grok API anhand Ihres Token-Verbrauchs kostenlos online. Vergleichen Sie alle Grok-Modellstufen (Grok 4.3, Grok Build 0.1, Legacy Grok 4 und Grok 2), Prompt-Caching-Rabatte, Batch-API-Einsparungen, Priority-Processing-Multiplikatoren und Zusatzkosten für serverseitige Tools – sofort, sicher und komplett im Browser.
Estimate input/output token pricing across all current xAI Grok models. Configure prompt caching, Batch API discounts, Priority Processing, and server-side tool add-ons. All calculations run locally in your browser.
Flagship - agentic tool calling, reasoning-capable
Prompt & Response Tokens
Cost Optimizations
Server-side Tool Add-ons
Billed per invocation ($0.005/call). Toggle which tools fire on each request.
Workload Call Volume
Projected Monthly Workload Cost
Cost/Call
$0.008750
Input Cost
$0.006250
Output Cost
$0.002500
Tool Add-ons
$0.00
Model Pricing Comparisons
Sorted by lowest cost| Model | Input/1M | Output/1M | Cost/Call | Monthly Forecast |
|---|---|---|---|---|
Grok 2 Mini (Legacy)Legacy Cache: $0.05/M • 131.072k ctx | $0.05 | $0.20 | $0.000450 | $13.50 |
Grok 4.1 Fast (Legacy)Legacy Cache: $0.05/M • 2,000k ctx | $0.20 | $0.50 | $0.001500 | $45.00 |
Grok Build 0.1 Cache: $0.20/M • 262.144k ctx | $1.00 | $2.00 | $0.007000 | $210.00 |
Grok 4.3Best Value Selected Cache: $0.20/M • 1,000k ctx | $1.25 | $2.50 | $0.008750 | $262.50 |
Grok 4.20 Cache: $0.20/M • 1,000k ctx | $1.25 | $2.50 | $0.008750 | $262.50 |
Grok 2 (Legacy)Legacy Cache: $2.00/M • 131.072k ctx | $2.00 | $10.00 | $0.0200 | $600.00 |
Grok 4 (Legacy)PowerfulLegacy Cache: $0.75/M • 256k ctx | $3.00 | $15.00 | $0.0300 | $900.00 |
Wie die Grok-Rechnung entsteht
Die Gesamtkosten der Grok API setzen sich aus Eingabe- und Ausgabe-Tokenpreis, dem täglichen Anfragevolumen und den aktivierten Zusatzmodulen zusammen.
Ausgabe-Tokens kosten meist doppelt so viel wie Eingabe-Tokens – lange Antworten treiben die Rechnung also deutlich schneller als lange Prompts.
- Eingabe vs. Ausgabe: gleiches Volumen, unterschiedliche Preise.
- Prompt-Caching senkt wiederverwendete Inhalte auf ~0,20 $/M.
- Die Batch API gewährt 50 % Rabatt auf alle Token-Typen.
Rabatte und Aufschläge, die das Ergebnis verändern
Prüfen Sie vor der Modellwahl, welche Rabatte auf Ihren tatsächlichen Traffic zutreffen – nicht jede Nutzung profitiert gleich stark von Cache oder Batch.
- Aktivieren Sie Prompt-Caching, wenn Sie einen System-Prompt oder stabilen Kontext wiederverwenden.
- Aktivieren Sie die Batch API für asynchrone Jobs ohne Latenzanforderung.
- Reservieren Sie Priority Processing für kritische interaktive Routen.
- Rechnen Sie Servertools (Web Search, X Search, Code Execution) pro Aufruf hinzu.
Die passende Modellstufe wählen
Größere und neuere Modelle kosten mehr pro Token, brauchen für dieselbe Aufgabe aber oft weniger Tokens. Vergleichen Sie die Kosten pro gelöster Aufgabe, nicht nur den Preis pro Million.
Für Routineaufgaben wie Klassifikation oder Extraktion genügt oft ein Legacy-Modell – deutlich günstiger.
- Komplexe Reasoning-Lasten: Top-Modelle, auch wenn teurer pro Token.
- Einfache, repetitive Lasten: Legacy- oder kleinere Stufen.
- Kombinieren Sie verschiedene Modelle pro Route, um die Gesamtrechnung zu optimieren.
Häufig gestellte Fragen
Ein Grok-Kostenrechner schätzt die Preise der xAI Grok API anhand Ihrer Ein- und Ausgabe-Token, Anfragevolumina und Modellkonfiguration. Er hilft Entwicklern und Teams, Budgets zu planen, Modellstufen zu vergleichen und das wirtschaftlichste Grok-Modell für ihre Workloads zu wählen. Er läuft vollständig im Browser, ohne Registrierung.
Unser Rechner nutzt standardmäßige Pay-as-you-go-Tarife direkt aus der offiziellen xAI-Preisdokumentation (zuletzt geprüft am 12. Juni 2026). Tatsächliche Kosten können leicht abweichen durch Rundungsunterschiede bei der Tokenisierung, regionale Steuern, individuelle Unternehmensverträge oder Preisaktualisierungen von xAI. Prüfen Sie für verbindliche Tarife stets die offizielle xAI-Preisseite docs.x.ai/developers/pricing.
Eingabe-Tokens sind der Text, den Sie im Prompt senden – Systemanweisungen, Gesprächsverlauf und Nutzernachrichten. Ausgabe-Tokens sind der vom Grok-Modell erzeugte Antworttext. Bei Grok 4.3 kosten Eingabe-Tokens 1,25 $/M und Ausgabe-Tokens 2,50 $/M. Beim alten Grok 4 war die Lücke größer: 3,00 $/15,00 $ pro Million.
Das xAI-Prompt-Caching speichert häufig wiederverwendete Inhalte in einem schnellen Cache. Wenn eine Anfrage aus dem Cache liest, statt den gesamten Prompt neu zu berechnen, wird sie mit 0,20 $/M Tokens statt der üblichen 1,25 $/M abgerechnet – eine Reduktion um 84 %. Diese Einsparung summiert sich erheblich bei Chatbots, Codebasen und jeder Anwendung mit dauerhaftem System-Prompt.
Die xAI Batch API gewährt 50 % Rabatt auf alle Token-Typen – Eingabe, Ausgabe, Cache und Reasoning. Batch-Anfragen werden asynchron innerhalb von 24 Stunden verarbeitet und zählen nicht gegen die Anfragelimits pro Minute. Ideal für Massendatenverarbeitung, Offline-Zusammenfassungen und nicht latenzkritische Workloads.
Priority Processing gibt API-Anfragen höhere Planungspriorität für geringere Antwortlatenz und wird mit 2× Aufschlag auf die Standardtarife berechnet. Cache-Rabatte werden vor dem Multiplikator angewendet. Nutzen Sie es für latenzkritische Produktionsanwendungen – nicht für Batch- oder Hintergrundaufgaben, bei denen die Batch API deutlich wirtschaftlicher ist.
xAI-Servertools werden pro Aufruf zu Festpreisen abgerechnet. Web Search und X Search kosten 5 $ pro 1.000 Aufrufe (je 0,005 $). Code Execution kostet ebenfalls 5 $ pro 1.000 Aufrufe. Dateianhänge kosten 10 $ pro 1.000 Aufrufe und Collections Search 2,50 $ pro 1.000 Aufrufe. Aktivieren Sie Zusatztools nur für Anfragen, die sie wirklich benötigen.
Nein. Der Grok-Kostenrechner läuft vollständig clientseitig im Browser. Ihre Token-Zahlen, Modellauswahlen, Kostenschätzungen und Vergleichsergebnisse werden lokal berechnet und nie an einen Server gesendet. Ihre Daten bleiben 100 % privat und sicher.