Saltar al contenido
Aback Tools Logo

Calculadora de coste de tokens

Convierte gratis y online recuentos de tokens en costes de API estimados en más de 20 modelos. Compara OpenAI, Anthropic, Google, xAI, DeepSeek, Mistral y más en paralelo. Modela el ahorro de caché de prompts, añade precios personalizados y prevé el gasto mensual, todo en tu navegador y sin registro.

Token Cost Calculator

Enter your input and output token counts to instantly calculate API costs across 20+ models from OpenAI, Anthropic, Google, xAI, DeepSeek, Mistral, Cohere, and Meta. Compare providers side-by-side, add custom pricing, and forecast monthly or annual spending.

Token Counts

tokens
tokens

Workload Volume

reqs

Primary Model

Monthly Cost - GPT-4o

$675.00for 30,000 calls

Cost / Call

$0.0225

Input Cost

$0.0125

Output Cost

$0.0100

Cache Savings

-

In rate: $2.5000/M tokensOut rate: $10.0000/M tokensCache rate: $1.2500/M tokens

Daily

$22.50

1,000 calls

Monthly

$675.00

30,000 calls

Yearly

$8,212.50

365,000 calls

Full Provider Comparison

ModelCost / CallInput CostOutput CostMonthly TotalFeatures
Mistral SmallMistralCost-Effective
$0.1000/M in · $0.3000/M out
$0.000800$0.000500$0.000300$24.00-
GPT-4o miniOpenAICost-Effective
$0.1500/M in · $0.6000/M out
$0.001350$0.000750$0.000600$40.50Caching
Command RCohereCost-Effective
$0.1500/M in · $0.6000/M out
$0.001350$0.000750$0.000600$40.50-
Grok 3 MinixAICost-Effective
$0.3000/M in · $0.5000/M out
$0.002000$0.001500$0.000500$60.00-
DeepSeek-V3DeepSeekCost-Effective
$0.2700/M in · $1.1000/M out
$0.002450$0.001350$0.001100$73.50Caching
Gemini 2.5 FlashGoogleCost-Effective
$0.3000/M in · $2.5000/M out
$0.004000$0.001500$0.002500$120.00Caching
Llama 3.1 70BMetaCost-Effective
$0.7200/M in · $0.7200/M out
$0.004320$0.003600$0.000720$129.60-
DeepSeek-R1DeepSeek
$0.5500/M in · $2.1900/M out
$0.004940$0.002750$0.002190$148.20Caching
Claude 3.5 HaikuAnthropicCost-Effective
$0.8000/M in · $4.0000/M out
$0.008000$0.004000$0.004000$240.00Caching
o4-miniOpenAICost-Effective
$1.1000/M in · $4.4000/M out
$0.009900$0.005500$0.004400$297.00Caching
Gemini 1.5 ProGoogle
$1.2500/M in · $5.0000/M out
$0.0112$0.006250$0.005000$337.50Caching
Mistral LargeMistral
$2.0000/M in · $6.0000/M out
$0.0160$0.0100$0.006000$480.00-
Gemini 2.5 ProGoogle
$1.2500/M in · $10.0000/M out
$0.0163$0.006250$0.0100$487.50Caching
o3OpenAI
$2.0000/M in · $8.0000/M out
$0.0180$0.0100$0.008000$540.00Caching
GPT-4oOpenAI Primary
$2.5000/M in · $10.0000/M out
$0.0225$0.0125$0.0100$675.00Caching
Command R+Cohere
$2.5000/M in · $10.0000/M out
$0.0225$0.0125$0.0100$675.00-
Claude 3.7 SonnetAnthropicCapable
$3.0000/M in · $15.0000/M out
$0.0300$0.0150$0.0150$900.00Caching
Grok 3xAI
$3.0000/M in · $15.0000/M out
$0.0300$0.0150$0.0150$900.00-
Llama 3.1 405BMeta
$5.0000/M in · $16.0000/M out
$0.0410$0.0250$0.0160$1,230.00-
GPT-5.5OpenAICapable
$5.0000/M in · $30.0000/M out
$0.0550$0.0250$0.0300$1,650.00Caching
Claude 3 OpusAnthropicCapable
$15.0000/M in · $75.0000/M out
$0.1500$0.0750$0.0750$4,500.00Caching

Click any row to set it as the primary model. 21 models shown.

Pricing Disclaimer: Rates reflect standard Pay-As-You-Go pricing from each provider's published documentation. Actual costs may vary due to regional taxes, volume discounts, promotional credits, or custom enterprise agreements. Cached token rates apply to supported models only. All calculations run locally in your browser - no data is sent to any server.

Cómo convertir tokens en coste

El cálculo es directo: multiplica los tokens de entrada por su tarifa y los de salida por la suya, y suma. La complejidad está en elegir bien el modelo y en saber cuántos tokens genera realmente tu carga.

Los tokens de salida cuestan entre 3 y 8 veces más, así que controlar la longitud de las respuestas suele dar el mayor ahorro.

  • Coste = tokens de entrada × tarifa de entrada + tokens de salida × tarifa de salida.
  • Las tarifas se expresan por millón de tokens.
  • Elige la unidad del periodo para ver el total que te interesa.

Caché de prompts y modelos personalizados

Si reutilizas un prefijo grande y estable, la caché reduce drásticamente su coste. Introduce los tokens en caché para medir el ahorro real.

  • Caché: normalmente un 10-25 % de la tarifa de entrada estándar.
  • Ventajosa con system prompts, instrucciones fijas o contexto compartido.
  • Añade precios personalizados para comparar modelos privados o ajustados.

Comparar proveedores y prever el gasto

El objetivo es encontrar el modelo más barato que cumpla tu nivel de calidad, no el más barato en abstracto.

  1. Obtén tu recuento real de tokens de entrada y salida por llamada.
  2. Introduce el volumen de peticiones y el periodo.
  3. Compara los modelos candidatos en la tabla.
  4. Revisa la previsión mensual y anual antes de comprometer presupuesto.

Preguntas frecuentes

Convierte recuentos de tokens en costes de API estimados entre proveedores de modelos de lenguaje. Introduces tus cantidades de tokens de entrada y salida (obtenidas de tu tokenizador, plantilla de prompt o metadatos de la API) y la herramienta calcula al instante el coste por llamada y el gasto mensual o anual proyectado. Se diferencia de un contador de tokens, que estima tokens a partir de texto sin procesar.

Los tokens de entrada representan el prompt que envías al modelo, y los de salida, la respuesta generada. Los de salida son computacionalmente más caros y se facturan a una tarifa mucho mayor, normalmente 3 a 8 veces la de entrada. En la mayoría de cargas, recortar tokens de salida innecesarios impacta más en el coste que reducir los de entrada.

La caché de prompts guarda contenido repetitivo en una caché temporal. Las peticiones posteriores que reutilizan ese prefijo exacto se facturan a una tarifa notablemente reducida (normalmente un 10-25 % de la tarifa estándar de entrada, lo que supone un ahorro del 75-90 %). La calculadora permite introducir tu número de tokens en caché para modelar ese ahorro con precisión.

Incluye más de 20 modelos de OpenAI (GPT-5.5, GPT-4o, o3, o4-mini), Anthropic (Claude 3.7 Sonnet, Claude 3.5 Haiku, Claude 3 Opus), Google (Gemini 2.5 Pro/Flash, Gemini 1.5 Pro), xAI (Grok 3, Grok 3 Mini), DeepSeek (V3, R1), Mistral (Large, Small), Cohere (Command R+/R) y Meta (Llama 3.1 70B/405B).

Sí. Despliega la sección «Precios de modelos personalizados» para añadir modelos con tus propias tarifas por millón de tokens. Los modelos personalizados aparecen en la tabla comparativa junto a los predefinidos, lo que te permite comparar modelos ajustados o privados con proveedores de API alojados.

Todas las tarifas reflejan precios estándar de pago por uso de la documentación publicada de cada proveedor. Los costes reales pueden variar por impuestos regionales, descuentos por volumen o acuerdos empresariales personalizados. Verifica siempre en la página oficial de precios del proveedor antes de tomar decisiones de facturación en producción.

Sí. La calculadora funciona 100 % en el lado del cliente, en tu navegador. Los recuentos de tokens, volúmenes de peticiones y estimaciones de coste se calculan localmente en tu dispositivo y nunca se transmiten a ningún servidor. Ningún dato sale de tu navegador y no se requiere registro.