Saltar al contenido
Aback Tools Logo

Calculadora de costes de OpenAI

Estima y proyecta con precisión tus costes de la API de OpenAI. Selecciona los modelos más recientes como GPT-5.5, o3 y GPT-4o, usa el estimador de tokens integrado para pegar texto de prompt, aplica descuentos de caché de prompts y compara distintas estructuras de precios de modelos en paralelo. 100 % privado y funciona íntegramente en tu navegador.

OpenAI Cost Calculator

Estimate standard and cached input/output token pricing, configure Batch discounts, and analyze overall API workloads and model comparisons locally.

Input/1M: $5.00Output/1M: $30.00Cache/1M: $0.50

Prompt Tokens

tokens
tokens

Cost Optimizations

Workload Call Volume

reqs

Projected Monthly Workload Cost

$1,650.00for 30,000 total requests

Cost per Single Call

$0.0550

Input Token Cost

$0.0250

Output Token Cost

$0.0300

Model Pricing Comparisons

Sorted by lowest cost
Model NameCost/CallMonthly ForecastOptimization Match
GPT-4o MiniCost-Effective
In: $0.15/M • Out: $0.60/M • Cache: $0.07/M
$0.001350$40.50Caching Supported
GPT-5.4 NanoCost-Effective
In: $0.20/M • Out: $1.25/M • Cache: $0.02/M
$0.002250$67.50Caching Supported
GPT-3.5 Turbo
In: $0.50/M • Out: $1.50/M • Cache: $0.50/M
$0.004000$120.00Caching Supported
GPT-5.4 MiniCost-Effective
In: $0.75/M • Out: $4.50/M • Cache: $0.07/M
$0.008250$247.50Caching Supported
o4-miniCost-Effective
In: $1.10/M • Out: $4.40/M • Cache: $0.55/M
$0.009900$297.00Caching Supported
o3 (Reasoning)Capable
In: $2.00/M • Out: $8.00/M • Cache: $1.00/M
$0.0180$540.00Caching Supported
GPT-4oCapable
In: $2.50/M • Out: $10.00/M • Cache: $1.25/M
$0.0225$675.00Caching Supported
GPT-5.4Capable
In: $2.50/M • Out: $15.00/M • Cache: $0.25/M
$0.0275$825.00Caching Supported
GPT-5.5 (New Flagship)Capable Selected
In: $5.00/M • Out: $30.00/M • Cache: $0.50/M
$0.0550$1,650.00Caching Supported
GPT-4 Turbo
In: $10.00/M • Out: $30.00/M • Cache: $5.00/M
$0.0800$2,400.00Caching Supported
GPT-4 (Legacy)
In: $30.00/M • Out: $60.00/M • Cache: $30.00/M
$0.2100$6,300.00Caching Supported
GPT-5.5 ProCapable
In: $30.00/M • Out: $180.00/M • Cache: $15.00/M
$0.3300$9,900.00Caching Supported
Calculations Disclaimer: Estimations are computed based on standard OpenAI per-token pricing sheets. Real-world API expenses may deviate slightly due to tokenization rounding differences (Word count to Token conversion ratio varies by text content), regional tax schedules, or custom SLA pricing. Context Caching discounts apply standardly for prompts of 1,024 tokens or longer.

Qué determina el coste en la API de OpenAI

El coste depende del número de consultas, del tamaño de entrada y salida de cada una y del modelo elegido. Los tokens de salida se cobran más caros que los de entrada.

Los modelos de razonamiento añaden tokens internos que no ves en la respuesta pero sí se facturan.

  • Tokens de entrada, de entrada en caché y de salida se facturan por separado.
  • El descuento de la Batch API aplica un 50 % a todos esos tipos.
  • Los tokens de razonamiento cuentan como tokens de salida.

Aprovechar la caché de prompts

Si tu prompt incluye un prefijo estable de más de 1024 tokens (instrucciones de sistema, ejemplos fijos, contexto de documento), la caché reduce su precio drásticamente.

  1. Identifica la parte fija y repetida de tu prompt.
  2. Mide cuántos tokens de entrada corresponden a ese prefijo estable.
  3. Introdúcelos en el campo de tokens en caché para ver el ahorro.
  4. Si el trabajo no exige latencia, activa además la Batch API.

Comparar modelos y planificar el presupuesto

El modelo más caro no siempre es el más rentable: a menudo resuelve la tarea con menos tokens. Compara el coste por tarea resuelta, no solo el precio por millón.

  • Usa la comparación en paralelo para ver la diferencia mensual exacta.
  • Reserva los modelos de razonamiento para tareas realmente complejas.
  • Los clasificadores y extractores suelen bastar con modelos más pequeños.

Preguntas frecuentes

Es una herramienta online que estima el coste de API de usar modelos de OpenAI como GPT-5.5, o3 y GPT-4o. Introduciendo los tokens de entrada, en caché y de salida, la calculadora calcula el coste por consulta y proyecta los gastos diarios, mensuales y anuales.

OpenAI cachea automáticamente los prefijos de prompt de 1024 tokens o más. Las peticiones posteriores que reutilizan ese prefijo exacto (por ejemplo, instrucciones de sistema o ejemplos few-shot) obtienen un descuento del 50 al 90 % en tokens de entrada. La calculadora de precios de OpenAI permite introducir los tokens en caché por separado para estimar con precisión ese ahorro.

Los modelos de razonamiento (como o3 y o4-mini) generan tokens de pensamiento internos durante su fase de procesamiento. Aunque esos tokens no se devuelven en la cadena de salida de la API, se facturan al mismo precio que los tokens de salida estándar. Conviene incluir los tokens de pensamiento estimados en el campo de tokens de salida de esta calculadora para presupuestar con precisión.

¡Sí! La Batch API es un endpoint de OpenAI diseñado para cargas que no dependen del tiempo (procesamiento en 24 horas). Las peticiones enviadas por la Batch API reciben un 50 % de descuento fijo en tokens estándar, de entrada en caché y de salida. Puedes activar el interruptor de la Batch API en el estimador de costes para aplicar el descuento automáticamente.

El estimador de tokens ofrece una aproximación cercana basada en ratios estándar de token a palabra y de carácter a token (unas 1,3× en inglés sencillo, 1,8× en código o JSON). Para una precisión del 100 % recomendamos usar la librería oficial tiktoken de OpenAI en tu código, pero nuestro estimador en el navegador es ideal para previsiones de precio rápidas.

No. Nuestras herramientas funcionan 100 % localmente en tu navegador. Cualquier texto de prompt pegado en el estimador de tokens y cualquier cifra introducida en la calculadora se procesan localmente en tu dispositivo y nunca se envían a ningún servidor ni se registran.

Puedes activar la casilla «Comparar con otro modelo» en el panel de la calculadora. Se mostrará una sección de comparación donde podrás elegir un modelo secundario (por ejemplo, comparar GPT-5.5 con GPT-5.4) y ver las diferencias exactas de coste mensual y el ahorro porcentual.