Aller au contenu
Aback Tools Logo

Calculateur de coûts OpenAI

Estimez et projetez précisément vos coûts d'API OpenAI. Sélectionnez les derniers modèles comme GPT-5.5, o3 et GPT-4o, utilisez l'estimateur de tokens intégré pour coller du texte de prompt, intégrez les remises de cache de prompts et comparez côte à côte les grilles tarifaires des modèles - 100 % privé et entièrement dans votre navigateur.

OpenAI Cost Calculator

Estimate standard and cached input/output token pricing, configure Batch discounts, and analyze overall API workloads and model comparisons locally.

Input/1M: $5.00Output/1M: $30.00Cache/1M: $0.50

Prompt Tokens

tokens
tokens

Cost Optimizations

Workload Call Volume

reqs

Projected Monthly Workload Cost

$1,650.00for 30,000 total requests

Cost per Single Call

$0.0550

Input Token Cost

$0.0250

Output Token Cost

$0.0300

Model Pricing Comparisons

Sorted by lowest cost
Model NameCost/CallMonthly ForecastOptimization Match
GPT-4o MiniCost-Effective
In: $0.15/M • Out: $0.60/M • Cache: $0.07/M
$0.001350$40.50Caching Supported
GPT-5.4 NanoCost-Effective
In: $0.20/M • Out: $1.25/M • Cache: $0.02/M
$0.002250$67.50Caching Supported
GPT-3.5 Turbo
In: $0.50/M • Out: $1.50/M • Cache: $0.50/M
$0.004000$120.00Caching Supported
GPT-5.4 MiniCost-Effective
In: $0.75/M • Out: $4.50/M • Cache: $0.07/M
$0.008250$247.50Caching Supported
o4-miniCost-Effective
In: $1.10/M • Out: $4.40/M • Cache: $0.55/M
$0.009900$297.00Caching Supported
o3 (Reasoning)Capable
In: $2.00/M • Out: $8.00/M • Cache: $1.00/M
$0.0180$540.00Caching Supported
GPT-4oCapable
In: $2.50/M • Out: $10.00/M • Cache: $1.25/M
$0.0225$675.00Caching Supported
GPT-5.4Capable
In: $2.50/M • Out: $15.00/M • Cache: $0.25/M
$0.0275$825.00Caching Supported
GPT-5.5 (New Flagship)Capable Selected
In: $5.00/M • Out: $30.00/M • Cache: $0.50/M
$0.0550$1,650.00Caching Supported
GPT-4 Turbo
In: $10.00/M • Out: $30.00/M • Cache: $5.00/M
$0.0800$2,400.00Caching Supported
GPT-4 (Legacy)
In: $30.00/M • Out: $60.00/M • Cache: $30.00/M
$0.2100$6,300.00Caching Supported
GPT-5.5 ProCapable
In: $30.00/M • Out: $180.00/M • Cache: $15.00/M
$0.3300$9,900.00Caching Supported
Calculations Disclaimer: Estimations are computed based on standard OpenAI per-token pricing sheets. Real-world API expenses may deviate slightly due to tokenization rounding differences (Word count to Token conversion ratio varies by text content), regional tax schedules, or custom SLA pricing. Context Caching discounts apply standardly for prompts of 1,024 tokens or longer.

Ce qui détermine le coût de l'API OpenAI

Le coût dépend du nombre de requêtes, de la taille d'entrée et de sortie de chacune et du modèle choisi. Les tokens de sortie sont plus chers que les tokens d'entrée.

Les modèles de raisonnement ajoutent des tokens internes invisibles dans la réponse mais bien facturés.

  • Tokens d'entrée, d'entrée mis en cache et de sortie sont facturés séparément.
  • La remise Batch API applique 50 % à tous ces types.
  • Les tokens de raisonnement comptent comme des tokens de sortie.

Tirer parti du cache de prompts

Si votre prompt contient un préfixe stable de plus de 1 024 tokens (instructions système, exemples fixes, contexte documentaire), le cache réduit fortement son prix.

  1. Identifiez la partie fixe et répétée de votre prompt.
  2. Mesurez les tokens d'entrée correspondant à ce préfixe stable.
  3. Saisissez-les dans le champ des tokens mis en cache pour voir l'économie.
  4. Si la latence n'est pas critique, activez aussi la Batch API.

Comparer les modèles et planifier le budget

Le modèle le plus cher n'est pas toujours le plus rentable : il résout souvent la tâche avec moins de tokens. Comparez le coût par tâche résolue, pas seulement le prix au million.

  • Utilisez la comparaison côte à côte pour voir l'écart mensuel exact.
  • Réservez les modèles de raisonnement aux tâches vraiment complexes.
  • Classificateurs et extracteurs se contentent souvent de modèles plus petits.

Foire aux questions

C'est un outil en ligne qui estime les coûts d'API liés à l'utilisation des modèles OpenAI comme GPT-5.5, o3 et GPT-4o. En saisissant les tokens d'entrée, mis en cache et de sortie, il calcule le coût par requête et projette les dépenses journalières, mensuelles et annuelles.

OpenAI met automatiquement en cache les préfixes de prompt de 1 024 tokens ou plus. Les requêtes ultérieures qui réutilisent exactement ce préfixe (instructions système, exemples few-shot) bénéficient d'une remise de 50 à 90 % sur les tokens d'entrée. Le calculateur permet de saisir les tokens mis en cache séparément pour estimer précisément ces économies.

Les modèles de raisonnement (comme o3 et o4-mini) génèrent des tokens de réflexion internes pendant leur traitement. Bien que ces tokens ne soient pas renvoyés dans la sortie de l'API, ils sont facturés au même prix que les tokens de sortie standard. Il faut inclure les tokens de réflexion estimés dans le champ de tokens de sortie de ce calculateur.

Oui ! La Batch API est un endpoint OpenAI conçu pour les charges non sensibles au temps (traitement sous 24 heures). Les requêtes envoyées via la Batch API bénéficient d'une remise fixe de 50 % sur les tokens standard, d'entrée mis en cache et de sortie. Activez l'interrupteur Batch API dans l'estimateur pour appliquer automatiquement cette remise.

Il fournit une approximation proche basée sur les ratios standard token/mot et caractère/token (~1,3× en anglais simple, ~1,8× pour le code ou le JSON). Pour une précision de 100 %, utilisez la bibliothèque officielle tiktoken d'OpenAI, mais notre estimateur dans le navigateur convient parfaitement aux prévisions rapides.

Non. Nos outils fonctionnent 100 % localement dans votre navigateur. Tout texte de prompt collé dans l'estimateur de tokens et tout chiffre saisi dans le calculateur sont traités localement sur votre appareil et ne sont jamais envoyés à un serveur ni journalisés.

Activez la case « Comparer avec un autre modèle » dans le panneau du calculateur. Une section de comparaison s'affiche, où vous pouvez choisir un modèle secondaire (par exemple comparer GPT-5.5 à GPT-5.4) et voir les écarts de coût mensuel exacts et le pourcentage d'économies.