Calculateur de coûts OpenAI
Estimez et projetez précisément vos coûts d'API OpenAI. Sélectionnez les derniers modèles comme GPT-5.5, o3 et GPT-4o, utilisez l'estimateur de tokens intégré pour coller du texte de prompt, intégrez les remises de cache de prompts et comparez côte à côte les grilles tarifaires des modèles - 100 % privé et entièrement dans votre navigateur.
Estimate standard and cached input/output token pricing, configure Batch discounts, and analyze overall API workloads and model comparisons locally.
Prompt Tokens
Cost Optimizations
Workload Call Volume
Projected Monthly Workload Cost
Cost per Single Call
$0.0550
Input Token Cost
$0.0250
Output Token Cost
$0.0300
Model Pricing Comparisons
Sorted by lowest cost| Model Name | Cost/Call | Monthly Forecast | Optimization Match |
|---|---|---|---|
GPT-4o MiniCost-Effective In: $0.15/M • Out: $0.60/M • Cache: $0.07/M | $0.001350 | $40.50 | Caching Supported |
GPT-5.4 NanoCost-Effective In: $0.20/M • Out: $1.25/M • Cache: $0.02/M | $0.002250 | $67.50 | Caching Supported |
GPT-3.5 Turbo In: $0.50/M • Out: $1.50/M • Cache: $0.50/M | $0.004000 | $120.00 | Caching Supported |
GPT-5.4 MiniCost-Effective In: $0.75/M • Out: $4.50/M • Cache: $0.07/M | $0.008250 | $247.50 | Caching Supported |
o4-miniCost-Effective In: $1.10/M • Out: $4.40/M • Cache: $0.55/M | $0.009900 | $297.00 | Caching Supported |
o3 (Reasoning)Capable In: $2.00/M • Out: $8.00/M • Cache: $1.00/M | $0.0180 | $540.00 | Caching Supported |
GPT-4oCapable In: $2.50/M • Out: $10.00/M • Cache: $1.25/M | $0.0225 | $675.00 | Caching Supported |
GPT-5.4Capable In: $2.50/M • Out: $15.00/M • Cache: $0.25/M | $0.0275 | $825.00 | Caching Supported |
GPT-5.5 (New Flagship)Capable Selected In: $5.00/M • Out: $30.00/M • Cache: $0.50/M | $0.0550 | $1,650.00 | Caching Supported |
GPT-4 Turbo In: $10.00/M • Out: $30.00/M • Cache: $5.00/M | $0.0800 | $2,400.00 | Caching Supported |
GPT-4 (Legacy) In: $30.00/M • Out: $60.00/M • Cache: $30.00/M | $0.2100 | $6,300.00 | Caching Supported |
GPT-5.5 ProCapable In: $30.00/M • Out: $180.00/M • Cache: $15.00/M | $0.3300 | $9,900.00 | Caching Supported |
Ce qui détermine le coût de l'API OpenAI
Le coût dépend du nombre de requêtes, de la taille d'entrée et de sortie de chacune et du modèle choisi. Les tokens de sortie sont plus chers que les tokens d'entrée.
Les modèles de raisonnement ajoutent des tokens internes invisibles dans la réponse mais bien facturés.
- Tokens d'entrée, d'entrée mis en cache et de sortie sont facturés séparément.
- La remise Batch API applique 50 % à tous ces types.
- Les tokens de raisonnement comptent comme des tokens de sortie.
Tirer parti du cache de prompts
Si votre prompt contient un préfixe stable de plus de 1 024 tokens (instructions système, exemples fixes, contexte documentaire), le cache réduit fortement son prix.
- Identifiez la partie fixe et répétée de votre prompt.
- Mesurez les tokens d'entrée correspondant à ce préfixe stable.
- Saisissez-les dans le champ des tokens mis en cache pour voir l'économie.
- Si la latence n'est pas critique, activez aussi la Batch API.
Comparer les modèles et planifier le budget
Le modèle le plus cher n'est pas toujours le plus rentable : il résout souvent la tâche avec moins de tokens. Comparez le coût par tâche résolue, pas seulement le prix au million.
- Utilisez la comparaison côte à côte pour voir l'écart mensuel exact.
- Réservez les modèles de raisonnement aux tâches vraiment complexes.
- Classificateurs et extracteurs se contentent souvent de modèles plus petits.
Foire aux questions
C'est un outil en ligne qui estime les coûts d'API liés à l'utilisation des modèles OpenAI comme GPT-5.5, o3 et GPT-4o. En saisissant les tokens d'entrée, mis en cache et de sortie, il calcule le coût par requête et projette les dépenses journalières, mensuelles et annuelles.
OpenAI met automatiquement en cache les préfixes de prompt de 1 024 tokens ou plus. Les requêtes ultérieures qui réutilisent exactement ce préfixe (instructions système, exemples few-shot) bénéficient d'une remise de 50 à 90 % sur les tokens d'entrée. Le calculateur permet de saisir les tokens mis en cache séparément pour estimer précisément ces économies.
Les modèles de raisonnement (comme o3 et o4-mini) génèrent des tokens de réflexion internes pendant leur traitement. Bien que ces tokens ne soient pas renvoyés dans la sortie de l'API, ils sont facturés au même prix que les tokens de sortie standard. Il faut inclure les tokens de réflexion estimés dans le champ de tokens de sortie de ce calculateur.
Oui ! La Batch API est un endpoint OpenAI conçu pour les charges non sensibles au temps (traitement sous 24 heures). Les requêtes envoyées via la Batch API bénéficient d'une remise fixe de 50 % sur les tokens standard, d'entrée mis en cache et de sortie. Activez l'interrupteur Batch API dans l'estimateur pour appliquer automatiquement cette remise.
Il fournit une approximation proche basée sur les ratios standard token/mot et caractère/token (~1,3× en anglais simple, ~1,8× pour le code ou le JSON). Pour une précision de 100 %, utilisez la bibliothèque officielle tiktoken d'OpenAI, mais notre estimateur dans le navigateur convient parfaitement aux prévisions rapides.
Non. Nos outils fonctionnent 100 % localement dans votre navigateur. Tout texte de prompt collé dans l'estimateur de tokens et tout chiffre saisi dans le calculateur sont traités localement sur votre appareil et ne sont jamais envoyés à un serveur ni journalisés.
Activez la case « Comparer avec un autre modèle » dans le panneau du calculateur. Une section de comparaison s'affiche, où vous pouvez choisir un modèle secondaire (par exemple comparer GPT-5.5 à GPT-5.4) et voir les écarts de coût mensuel exacts et le pourcentage d'économies.