Cohere-Kostenrechner
Schätzen Sie kostenlos online Ihre Cohere-API-Kosten. Vergleichen Sie die Preise von Command A, Command R+, Command R und Command R7B, modellieren Sie den Token-Aufschlag von RAG-Connectoren und prognostizieren Sie Ihr Monatsbudget – vollständig privat, ohne Registrierung.
Estimate Cohere API costs across Command A, Command R+, Command R, and Command R7B. Configure token volumes, RAG connector overhead, and Batch API discounts to forecast monthly budgets accurately.
Prompt Tokens
Cost Optimizations
Applies to offline, latency-tolerant workloads processed asynchronously.
Workload Call Volume
Projected Monthly Workload Cost
Cost per Single Call
$0.000338
Input Token Cost
$0.000188
Output Token Cost
$0.000150
Token Breakdown per Request
Base Input
5,000
Connector
0
Total Input
5,000
Output
1,000
Model Pricing Comparisons
Sorted by lowest monthly cost| Model | Cost/Call | Monthly Forecast | Context |
|---|---|---|---|
Command R7BBest Value Selected In: $0.0375/M · Out: $0.1500/M | $0.000338 | $10.13 | 128K |
Command R In: $0.1500/M · Out: $0.6000/M | $0.001350 | $40.50 | 128K |
Command R+ In: $2.5000/M · Out: $10.0000/M | $0.0225 | $675.00 | 128K |
Command AMost Capable In: $2.5000/M · Out: $10.0000/M | $0.0225 | $675.00 | 256K |
Die drei Faktoren Ihrer Cohere-Rechnung
Die Cohere-Kosten setzen sich aus dem Modellpreis, dem Verhältnis von Ein- zu Ausgabe-Tokens und zusätzlichem Kontextinhalt zusammen. RAG-Connectoren sind der überraschendste Posten, weil sie Tokens unsichtbar für Nutzer hinzufügen.
Geben Sie Ein- und Ausgabe-Tokens pro Anfrage, Volumen und Modell ein, um Basiskosten zu sehen, und ergänzen Sie dann den Connector-Aufschlag.
- Ausgabe-Tokens kosten in der Command-Familie rund viermal mehr als Eingabe-Tokens.
- Jedes per Connector abgerufene Dokument wird als normale Eingabe-Tokens berechnet.
- Die Batch API gewährt 50 % Rabatt, wenn sofortige Antworten nicht nötig sind.
Ein Modell aus der Command-Familie wählen
Die Familie reicht von günstigem Hochdurchsatz bis zu komplexen Enterprise-Agenten. Standardmäßig das größte Modell zu wählen, ist der häufigste Kostenfehler.
- Command R7B für hohes Volumen und einfache Aufgaben: die günstigste Option.
- Command R balanciert Kosten und Leistung bei Standard-RAG.
- Command A und Command R+ kosten gleich, aber Command A liefert mehr Kontext und Durchsatz.
Connectoren im Budget berücksichtigen
Bei Connectoren hängen die echten Kosten sowohl von der Anzahl abgerufener Dokumente als auch von deren Größe ab. Sie zu ignorieren führt zu Budgets weit unter der Rechnung.
- Berechnen Sie die Basiskosten von Prompt und Antwort pro Anfrage.
- Addieren Sie die Tokens der abgerufenen und in den Kontext eingefügten Dokumente.
- Wenden Sie den Monatsvolumen-Multiplikator und ggf. den Batch-API-Rabatt an.
- Vergleichen Sie zwei bis drei Modelle für das beste Verhältnis von Kosten und Leistung.
Häufig gestellte Fragen
Er schätzt Ihre API-Ausgaben für Coheres Command-Modelle anhand von Ein- und Ausgabe-Tokens, Anfragevolumen und optionalen Funktionen wie RAG-Connectoren oder Batch-API-Rabatten. Er läuft vollständig im Browser – keine Daten werden hochgeladen, kein Konto nötig.
Der Rechner nutzt die Standard-Pay-As-You-Go-Preise aus der offiziellen Cohere-Dokumentation. Die tatsächliche Abrechnung kann durch Enterprise-Verträge, Werbeguthaben, regionale Steuern oder künftige Preisupdates abweichen. Prüfen Sie vor Budgetzusagen stets die aktuellen Tarife auf cohere.com/pricing.
Command R7B (7B Parameter) ist Coheres schnellstes und günstigstes Modell für hohen Durchsatz. Command R (35B) balanciert Kosten und Leistung für Standard-RAG und einstufige Tool-Nutzung. Command R+ bietet stärkeres Reasoning für komplexe mehrstufige Aufgaben. Command A (111B) ist das Flaggschiff: 256K-Kontextfenster, höherer Durchsatz und für anspruchsvollste Enterprise-Agent-Lasten ausgelegt.
Die Cohere Batch API verarbeitet Anfragen asynchron statt in Echtzeit. Sie eignet sich für Lasten ohne sofortige Antwort – Offline-Dokumentenverarbeitung, großskalige Anreicherung oder nächtliche Zusammenfassungen. Die Nutzung bringt automatisch 50 % Rabatt auf alle Ein- und Ausgabe-Tokenkosten.
Coheres Connector-Funktion ruft Dokumente aus Websuche, Datenbank oder Vektorspeicher ab und fügt sie vor der Generierung direkt in den Prompt-Kontext ein. Jedes abgerufene Dokument wird als Standard-Eingabe-Tokens berechnet. Eine Anfrage mit 10 Dokumenten à 300 Tokens fügt 3.000 zusätzliche Eingabe-Tokens pro Anfrage hinzu – bei Skalierung deutlich teurer.
Command A und Command R+ kosten identisch: 2,50 $ pro Million Eingabe-Tokens und 10,00 $ pro Million Ausgabe-Tokens. Command A bietet jedoch ein größeres 256K-Kontextfenster (gegenüber 128K bei Command R+) und deutlich höheren Durchsatz. Beim gleichen Preis ist Command A die bessere Wahl für lange Dokumente oder volumenstarke Agent-Pipelines.
Nein. Der Rechner läuft vollständig clientseitig im Browser. Eingabe-Tokens, Ausgabegrößen, Anfragevolumen und Kostenprognosen werden nie an einen Server gesendet. Alle Berechnungen erfolgen lokal auf Ihrem Gerät, Ihre Daten bleiben vollständig privat und sicher.