Saltar al contenido
Aback Tools Logo

Calculadora de costes de Claude

Estima gratis online los costes de la API de Anthropic Claude. Admite selección de modelo, estimación de tokens, caché de prompts, descuentos de la Batch API y proyecciones mensuales y anuales. Compara costes en paralelo entre todos los modelos Claude (incluidos Claude 3.5, Opus, Sonnet, Haiku y los niveles de nueva generación Claude 5) para encontrar el mejor equilibrio entre velocidad, capacidad y presupuesto. Sin registro: los cálculos se ejecutan localmente en tu navegador.

Claude Cost Calculator

Estimate standard and cached input/output token pricing, configure Batch discounts, and analyze overall API workloads and model comparisons locally.

Input/1M: $3.00Output/1M: $15.00Cache/1M: $0.30

Prompt Tokens

tokens
tokens

Cost Optimizations

Workload Call Volume

reqs

Projected Monthly Workload Cost

$900.00for 30,000 total requests

Cost per Single Call

$0.0300

Input Token Cost

$0.0150

Output Token Cost

$0.0150

Model Pricing Comparisons

Sorted by lowest cost
Model NameCost/CallMonthly ForecastOptimization Match
Claude 3 Haiku
In: $0.25/M • Out: $1.25/M • Cache: $0.03/M
$0.002500$75.00Caching Supported
Claude Haiku 4.5Cost-Effective
In: $1.00/M • Out: $5.00/M • Cache: $0.10/M
$0.0100$300.00Caching Supported
Claude 3.5 HaikuCost-Effective
In: $1.00/M • Out: $5.00/M • Cache: $0.10/M
$0.0100$300.00Caching Supported
Claude Sonnet 4.6Capable
In: $3.00/M • Out: $15.00/M • Cache: $0.30/M
$0.0300$900.00Caching Supported
Claude 3.5 SonnetCapable Selected
In: $3.00/M • Out: $15.00/M • Cache: $0.30/M
$0.0300$900.00Caching Supported
Claude 3 Sonnet
In: $3.00/M • Out: $15.00/M • Cache: $0.30/M
$0.0300$900.00Caching Supported
Claude Opus 4.8Capable
In: $5.00/M • Out: $25.00/M • Cache: $0.50/M
$0.0500$1,500.00Caching Supported
Claude Fable 5Capable
In: $10.00/M • Out: $50.00/M • Cache: $1.00/M
$0.1000$3,000.00Caching Supported
Claude 3 Opus
In: $15.00/M • Out: $75.00/M • Cache: $1.50/M
$0.1500$4,500.00Caching Supported
Calculations Disclaimer: Estimations are computed based on standard Anthropic Claude per-token pricing sheets. Real-world API expenses may deviate slightly due to tokenization rounding differences (Word count to Token conversion ratio varies by text content), regional tax schedules, or custom SLA pricing. Context caching read rates apply standardly at a 90% input read discount.

Entender la estructura de costes de Claude

El coste de Claude depende de tres variables: el modelo elegido, la proporción de tokens de entrada y salida y el volumen de consultas. Los tokens de salida suelen costar entre 3 y 5 veces más que los de entrada, así que la longitud de las respuestas manda en la factura.

Introduce los tokens de entrada y salida por consulta, el volumen mensual y el modelo para ver la proyección y comparar alternativas.

  • Los tokens de salida dominan el coste por consulta: controlar la longitud de respuesta es la palanca más eficaz.
  • La caché de prompts puede recortar hasta un 90 % del coste de los tokens de entrada reutilizados.
  • La Batch API aplica un 50 % de descuento fijo cuando no necesitas respuesta en tiempo real.

Cuándo merece la pena cada ahorro

Caché y Batch no siempre ayudan. La caché exige prompts largos y repetidos; el Batch exige tolerar 24 horas de latencia.

  • Caché: útil con prompts de sistema largos y estables que se repiten en cada consulta.
  • Batch: útil en procesamiento masivo, evaluaciones y tareas que pueden esperar.
  • Ninguna de las dos reduce el coste de un prompt corto y único.

Presupuestar con margen de seguridad

Las estimaciones son tan buenas como tus supuestos de tokens. Mide una muestra real antes de extrapolar a todo el volumen.

  1. Mide los tokens de entrada y salida reales en una muestra representativa de consultas.
  2. Introduce el volumen mensual previsto y selecciona el modelo.
  3. Activa caché o Batch si tu patrón de uso encaja y compara el escenario optimizado.
  4. Añade un margen del 20-30 % para variaciones de longitud y crecimiento del uso.

Preguntas frecuentes

Es una herramienta diseñada para estimar los costes de uso de la API de Anthropic Claude. Introduciendo tokens de entrada/prompt, tokens de salida/completado, volumen de consultas y eligiendo un modelo concreto, los desarrolladores y fundadores de SaaS pueden proyectar el gasto mensual y anual y comparar costes entre modelos.

La caché de prompts reduce drásticamente los costes (hasta un 90 %) de los tokens de entrada que reutilizas en varias consultas. Al activarla, solo los tokens no cacheados se facturan a la tarifa estándar; los tokens cacheados se facturan a una tarifa de lectura muy reducida. Por ejemplo, en Claude 3.5 Sonnet las lecturas cacheadas cuestan 0,30 $/M tokens frente a los 3,00 $/M tokens estándar.

La caché de prompts requiere una longitud mínima de prompt de 10.000 tokens en Claude 3.5 Sonnet y Claude 3 Opus, y de 20.000 tokens en Claude 3.5 Haiku. Los prompts más cortos que ese límite no se pueden cachear y siempre se facturan a las tarifas estándar de entrada.

La Batch API permite subir lotes de peticiones que se procesan de forma asíncrona en un plazo de 24 horas en lugar de en tiempo real. A cambio de ese margen de procesamiento, Anthropic ofrece un descuento fijo del 50 % en tokens de entrada y salida en todos los modelos. Activa la opción de Batch API en nuestra calculadora para aplicar ese descuento.

Como regla general, 1 token equivale aproximadamente a 4 caracteres de texto en inglés, o unas 0,75 palabras. Por tanto, 100 palabras son unos 133 tokens y 1.000 palabras rondan los 1.333 tokens. Los tokens de salida pueden variar según la complejidad de la respuesta y el formato (por ejemplo, código o etiquetas JSON, que consumen más tokens).

Sí. El precio base de los modelos Claude alojados en Amazon Bedrock o Google Vertex AI suele ser idéntico a las tarifas directas de Anthropic. No obstante, pueden aplicarse recargos regionales o descuentos empresariales personalizados de tu proveedor de nube. Usa nuestra calculadora como estimación de referencia.

Sí, totalmente. La calculadora de costes de Claude funciona íntegramente en tu navegador con JavaScript. Ningún número de tokens, volumen de peticiones ni dato de proyecto se envía a ningún servidor externo ni se guarda. Tus cálculos son completamente privados.