OpenAI-Kostenrechner
Schätzen und projizieren Sie Ihre OpenAI-API-Kosten präzise. Wählen Sie aktuelle Modelle wie GPT-5.5, o3 und GPT-4o, nutzen Sie den integrierten Token-Schätzer für eingefügten Prompt-Text, berücksichtigen Sie Prompt-Caching-Rabatte und vergleichen Sie Preisstrukturen verschiedener Modelle nebeneinander – 100 % privat und komplett im Browser.
Estimate standard and cached input/output token pricing, configure Batch discounts, and analyze overall API workloads and model comparisons locally.
Prompt Tokens
Cost Optimizations
Workload Call Volume
Projected Monthly Workload Cost
Cost per Single Call
$0.0550
Input Token Cost
$0.0250
Output Token Cost
$0.0300
Model Pricing Comparisons
Sorted by lowest cost| Model Name | Cost/Call | Monthly Forecast | Optimization Match |
|---|---|---|---|
GPT-4o MiniCost-Effective In: $0.15/M • Out: $0.60/M • Cache: $0.07/M | $0.001350 | $40.50 | Caching Supported |
GPT-5.4 NanoCost-Effective In: $0.20/M • Out: $1.25/M • Cache: $0.02/M | $0.002250 | $67.50 | Caching Supported |
GPT-3.5 Turbo In: $0.50/M • Out: $1.50/M • Cache: $0.50/M | $0.004000 | $120.00 | Caching Supported |
GPT-5.4 MiniCost-Effective In: $0.75/M • Out: $4.50/M • Cache: $0.07/M | $0.008250 | $247.50 | Caching Supported |
o4-miniCost-Effective In: $1.10/M • Out: $4.40/M • Cache: $0.55/M | $0.009900 | $297.00 | Caching Supported |
o3 (Reasoning)Capable In: $2.00/M • Out: $8.00/M • Cache: $1.00/M | $0.0180 | $540.00 | Caching Supported |
GPT-4oCapable In: $2.50/M • Out: $10.00/M • Cache: $1.25/M | $0.0225 | $675.00 | Caching Supported |
GPT-5.4Capable In: $2.50/M • Out: $15.00/M • Cache: $0.25/M | $0.0275 | $825.00 | Caching Supported |
GPT-5.5 (New Flagship)Capable Selected In: $5.00/M • Out: $30.00/M • Cache: $0.50/M | $0.0550 | $1,650.00 | Caching Supported |
GPT-4 Turbo In: $10.00/M • Out: $30.00/M • Cache: $5.00/M | $0.0800 | $2,400.00 | Caching Supported |
GPT-4 (Legacy) In: $30.00/M • Out: $60.00/M • Cache: $30.00/M | $0.2100 | $6,300.00 | Caching Supported |
GPT-5.5 ProCapable In: $30.00/M • Out: $180.00/M • Cache: $15.00/M | $0.3300 | $9,900.00 | Caching Supported |
Was die OpenAI-API-Kosten bestimmt
Die Kosten hängen von der Anzahl der Anfragen, der Ein- und Ausgabegröße jeder Anfrage und dem gewählten Modell ab. Ausgabe-Tokens sind teurer als Eingabe-Tokens.
Reasoning-Modelle erzeugen interne Tokens, die in der Antwort nicht sichtbar, aber dennoch abgerechnet werden.
- Eingabe-, gecachte Eingabe- und Ausgabe-Tokens werden getrennt abgerechnet.
- Der Batch-API-Rabatt beträgt 50 % auf all diese Typen.
- Reasoning-Tokens zählen als Ausgabe-Tokens.
Prompt-Caching nutzen
Enthält Ihr Prompt ein stabiles Präfix über 1.024 Tokens (Systemanweisungen, feste Beispiele, Dokumentkontext), senkt Caching den Preis deutlich.
- Identifizieren Sie den festen, wiederholten Teil Ihres Prompts.
- Messen Sie die Eingabe-Tokens dieses stabilen Präfixes.
- Tragen Sie sie im Feld für gecachte Tokens ein, um die Einsparung zu sehen.
- Ist Latenz unkritisch, aktivieren Sie zusätzlich die Batch API.
Modelle vergleichen und Budget planen
Das teuerste Modell ist nicht immer das wirtschaftlichste: Oft löst es die Aufgabe mit weniger Tokens. Vergleichen Sie Kosten pro gelöster Aufgabe, nicht nur den Preis pro Million.
- Nutzen Sie den direkten Vergleich für den exakten Monatsunterschied.
- Reservieren Sie Reasoning-Modelle für wirklich komplexe Aufgaben.
- Klassifikatoren und Extraktoren kommen oft mit kleineren Modellen aus.
Häufig gestellte Fragen
Ein OpenAI-Kostenrechner ist ein Online-Tool, das die API-Kosten für die Nutzung von OpenAI-Modellen wie GPT-5.5, o3 und GPT-4o schätzt. Durch Eingabe von Ein-, gecachten und Ausgabe-Tokens berechnet er Kosten pro Anfrage und projiziert Tages-, Monats- und Jahresausgaben.
OpenAI speichert Prompt-Präfixe ab 1.024 Tokens automatisch im Cache. Folgeanfragen, die genau dieses Präfix wiederverwenden (Systemanweisungen, Few-Shot-Beispiele), erhalten 50-90 % Rabatt auf Eingabe-Tokens. Der Rechner erlaubt die separate Eingabe gecachter Tokens, um diese Einsparung genau zu schätzen.
Reasoning-Modelle (wie o3 und o4-mini) erzeugen intern Denk-Tokens. Sie erscheinen nicht in der API-Ausgabe, werden aber zum gleichen Preis wie Standard-Ausgabe-Tokens abgerechnet. Schätzen Sie Denk-Tokens im Ausgabe-Token-Feld dieses Rechners, um korrekt zu budgetieren.
Ja! Die Batch API ist ein OpenAI-Endpunkt für nicht zeitkritische Workloads (Bearbeitung binnen 24 Stunden). Anfragen über die Batch API erhalten pauschal 50 % Rabatt auf Standard-, gecachte Eingabe- und Ausgabe-Tokens. Aktivieren Sie den Batch-API-Schalter im Kostenschätzer, um den Rabatt automatisch anzuwenden.
Er liefert eine gute Näherung auf Basis üblicher Token-zu-Wort- und Zeichen-zu-Token-Verhältnisse (ca. 1,3× für einfaches Englisch, ca. 1,8× für Code/JSON). Für 100 % Genauigkeit empfehlen wir die offizielle tiktoken-Bibliothek in Ihrem Code; für schnelle Preisprognosen ist unser Browser-Schätzer ideal.
Nein. Unsere Tools laufen zu 100 % lokal im Browser. Jeder in den Token-Schätzer eingefügte Prompt-Text und jede eingegebene Zahl werden lokal auf Ihrem Gerät verarbeitet und nie an einen Server gesendet oder protokolliert.
Aktivieren Sie das Kontrollkästchen „Mit anderem Modell vergleichen“ im Bedienfeld. Daraufhin erscheint ein Vergleichsbereich, in dem Sie ein Zweitmodell wählen können (z. B. GPT-5.5 gegen GPT-5.4) und exakte Monatskostendifferenzen und prozentuale Einsparungen sehen.