Calculadora de costes de OpenAI
Estima y proyecta con precisión tus costes de la API de OpenAI. Selecciona los modelos más recientes como GPT-5.5, o3 y GPT-4o, usa el estimador de tokens integrado para pegar texto de prompt, aplica descuentos de caché de prompts y compara distintas estructuras de precios de modelos en paralelo. 100 % privado y funciona íntegramente en tu navegador.
Estimate standard and cached input/output token pricing, configure Batch discounts, and analyze overall API workloads and model comparisons locally.
Prompt Tokens
Cost Optimizations
Workload Call Volume
Projected Monthly Workload Cost
Cost per Single Call
$0.0550
Input Token Cost
$0.0250
Output Token Cost
$0.0300
Model Pricing Comparisons
Sorted by lowest cost| Model Name | Cost/Call | Monthly Forecast | Optimization Match |
|---|---|---|---|
GPT-4o MiniCost-Effective In: $0.15/M • Out: $0.60/M • Cache: $0.07/M | $0.001350 | $40.50 | Caching Supported |
GPT-5.4 NanoCost-Effective In: $0.20/M • Out: $1.25/M • Cache: $0.02/M | $0.002250 | $67.50 | Caching Supported |
GPT-3.5 Turbo In: $0.50/M • Out: $1.50/M • Cache: $0.50/M | $0.004000 | $120.00 | Caching Supported |
GPT-5.4 MiniCost-Effective In: $0.75/M • Out: $4.50/M • Cache: $0.07/M | $0.008250 | $247.50 | Caching Supported |
o4-miniCost-Effective In: $1.10/M • Out: $4.40/M • Cache: $0.55/M | $0.009900 | $297.00 | Caching Supported |
o3 (Reasoning)Capable In: $2.00/M • Out: $8.00/M • Cache: $1.00/M | $0.0180 | $540.00 | Caching Supported |
GPT-4oCapable In: $2.50/M • Out: $10.00/M • Cache: $1.25/M | $0.0225 | $675.00 | Caching Supported |
GPT-5.4Capable In: $2.50/M • Out: $15.00/M • Cache: $0.25/M | $0.0275 | $825.00 | Caching Supported |
GPT-5.5 (New Flagship)Capable Selected In: $5.00/M • Out: $30.00/M • Cache: $0.50/M | $0.0550 | $1,650.00 | Caching Supported |
GPT-4 Turbo In: $10.00/M • Out: $30.00/M • Cache: $5.00/M | $0.0800 | $2,400.00 | Caching Supported |
GPT-4 (Legacy) In: $30.00/M • Out: $60.00/M • Cache: $30.00/M | $0.2100 | $6,300.00 | Caching Supported |
GPT-5.5 ProCapable In: $30.00/M • Out: $180.00/M • Cache: $15.00/M | $0.3300 | $9,900.00 | Caching Supported |
Qué determina el coste en la API de OpenAI
El coste depende del número de consultas, del tamaño de entrada y salida de cada una y del modelo elegido. Los tokens de salida se cobran más caros que los de entrada.
Los modelos de razonamiento añaden tokens internos que no ves en la respuesta pero sí se facturan.
- Tokens de entrada, de entrada en caché y de salida se facturan por separado.
- El descuento de la Batch API aplica un 50 % a todos esos tipos.
- Los tokens de razonamiento cuentan como tokens de salida.
Aprovechar la caché de prompts
Si tu prompt incluye un prefijo estable de más de 1024 tokens (instrucciones de sistema, ejemplos fijos, contexto de documento), la caché reduce su precio drásticamente.
- Identifica la parte fija y repetida de tu prompt.
- Mide cuántos tokens de entrada corresponden a ese prefijo estable.
- Introdúcelos en el campo de tokens en caché para ver el ahorro.
- Si el trabajo no exige latencia, activa además la Batch API.
Comparar modelos y planificar el presupuesto
El modelo más caro no siempre es el más rentable: a menudo resuelve la tarea con menos tokens. Compara el coste por tarea resuelta, no solo el precio por millón.
- Usa la comparación en paralelo para ver la diferencia mensual exacta.
- Reserva los modelos de razonamiento para tareas realmente complejas.
- Los clasificadores y extractores suelen bastar con modelos más pequeños.
Preguntas frecuentes
Es una herramienta online que estima el coste de API de usar modelos de OpenAI como GPT-5.5, o3 y GPT-4o. Introduciendo los tokens de entrada, en caché y de salida, la calculadora calcula el coste por consulta y proyecta los gastos diarios, mensuales y anuales.
OpenAI cachea automáticamente los prefijos de prompt de 1024 tokens o más. Las peticiones posteriores que reutilizan ese prefijo exacto (por ejemplo, instrucciones de sistema o ejemplos few-shot) obtienen un descuento del 50 al 90 % en tokens de entrada. La calculadora de precios de OpenAI permite introducir los tokens en caché por separado para estimar con precisión ese ahorro.
Los modelos de razonamiento (como o3 y o4-mini) generan tokens de pensamiento internos durante su fase de procesamiento. Aunque esos tokens no se devuelven en la cadena de salida de la API, se facturan al mismo precio que los tokens de salida estándar. Conviene incluir los tokens de pensamiento estimados en el campo de tokens de salida de esta calculadora para presupuestar con precisión.
¡Sí! La Batch API es un endpoint de OpenAI diseñado para cargas que no dependen del tiempo (procesamiento en 24 horas). Las peticiones enviadas por la Batch API reciben un 50 % de descuento fijo en tokens estándar, de entrada en caché y de salida. Puedes activar el interruptor de la Batch API en el estimador de costes para aplicar el descuento automáticamente.
El estimador de tokens ofrece una aproximación cercana basada en ratios estándar de token a palabra y de carácter a token (unas 1,3× en inglés sencillo, 1,8× en código o JSON). Para una precisión del 100 % recomendamos usar la librería oficial tiktoken de OpenAI en tu código, pero nuestro estimador en el navegador es ideal para previsiones de precio rápidas.
No. Nuestras herramientas funcionan 100 % localmente en tu navegador. Cualquier texto de prompt pegado en el estimador de tokens y cualquier cifra introducida en la calculadora se procesan localmente en tu dispositivo y nunca se envían a ningún servidor ni se registran.
Puedes activar la casilla «Comparar con otro modelo» en el panel de la calculadora. Se mostrará una sección de comparación donde podrás elegir un modelo secundario (por ejemplo, comparar GPT-5.5 con GPT-5.4) y ver las diferencias exactas de coste mensual y el ahorro porcentual.