Calculadora de costes de Claude
Estima gratis online los costes de la API de Anthropic Claude. Admite selección de modelo, estimación de tokens, caché de prompts, descuentos de la Batch API y proyecciones mensuales y anuales. Compara costes en paralelo entre todos los modelos Claude (incluidos Claude 3.5, Opus, Sonnet, Haiku y los niveles de nueva generación Claude 5) para encontrar el mejor equilibrio entre velocidad, capacidad y presupuesto. Sin registro: los cálculos se ejecutan localmente en tu navegador.
Estimate standard and cached input/output token pricing, configure Batch discounts, and analyze overall API workloads and model comparisons locally.
Prompt Tokens
Cost Optimizations
Workload Call Volume
Projected Monthly Workload Cost
Cost per Single Call
$0.0300
Input Token Cost
$0.0150
Output Token Cost
$0.0150
Model Pricing Comparisons
Sorted by lowest cost| Model Name | Cost/Call | Monthly Forecast | Optimization Match |
|---|---|---|---|
Claude 3 Haiku In: $0.25/M • Out: $1.25/M • Cache: $0.03/M | $0.002500 | $75.00 | Caching Supported |
Claude Haiku 4.5Cost-Effective In: $1.00/M • Out: $5.00/M • Cache: $0.10/M | $0.0100 | $300.00 | Caching Supported |
Claude 3.5 HaikuCost-Effective In: $1.00/M • Out: $5.00/M • Cache: $0.10/M | $0.0100 | $300.00 | Caching Supported |
Claude Sonnet 4.6Capable In: $3.00/M • Out: $15.00/M • Cache: $0.30/M | $0.0300 | $900.00 | Caching Supported |
Claude 3.5 SonnetCapable Selected In: $3.00/M • Out: $15.00/M • Cache: $0.30/M | $0.0300 | $900.00 | Caching Supported |
Claude 3 Sonnet In: $3.00/M • Out: $15.00/M • Cache: $0.30/M | $0.0300 | $900.00 | Caching Supported |
Claude Opus 4.8Capable In: $5.00/M • Out: $25.00/M • Cache: $0.50/M | $0.0500 | $1,500.00 | Caching Supported |
Claude Fable 5Capable In: $10.00/M • Out: $50.00/M • Cache: $1.00/M | $0.1000 | $3,000.00 | Caching Supported |
Claude 3 Opus In: $15.00/M • Out: $75.00/M • Cache: $1.50/M | $0.1500 | $4,500.00 | Caching Supported |
Entender la estructura de costes de Claude
El coste de Claude depende de tres variables: el modelo elegido, la proporción de tokens de entrada y salida y el volumen de consultas. Los tokens de salida suelen costar entre 3 y 5 veces más que los de entrada, así que la longitud de las respuestas manda en la factura.
Introduce los tokens de entrada y salida por consulta, el volumen mensual y el modelo para ver la proyección y comparar alternativas.
- Los tokens de salida dominan el coste por consulta: controlar la longitud de respuesta es la palanca más eficaz.
- La caché de prompts puede recortar hasta un 90 % del coste de los tokens de entrada reutilizados.
- La Batch API aplica un 50 % de descuento fijo cuando no necesitas respuesta en tiempo real.
Cuándo merece la pena cada ahorro
Caché y Batch no siempre ayudan. La caché exige prompts largos y repetidos; el Batch exige tolerar 24 horas de latencia.
- Caché: útil con prompts de sistema largos y estables que se repiten en cada consulta.
- Batch: útil en procesamiento masivo, evaluaciones y tareas que pueden esperar.
- Ninguna de las dos reduce el coste de un prompt corto y único.
Presupuestar con margen de seguridad
Las estimaciones son tan buenas como tus supuestos de tokens. Mide una muestra real antes de extrapolar a todo el volumen.
- Mide los tokens de entrada y salida reales en una muestra representativa de consultas.
- Introduce el volumen mensual previsto y selecciona el modelo.
- Activa caché o Batch si tu patrón de uso encaja y compara el escenario optimizado.
- Añade un margen del 20-30 % para variaciones de longitud y crecimiento del uso.
Preguntas frecuentes
Es una herramienta diseñada para estimar los costes de uso de la API de Anthropic Claude. Introduciendo tokens de entrada/prompt, tokens de salida/completado, volumen de consultas y eligiendo un modelo concreto, los desarrolladores y fundadores de SaaS pueden proyectar el gasto mensual y anual y comparar costes entre modelos.
La caché de prompts reduce drásticamente los costes (hasta un 90 %) de los tokens de entrada que reutilizas en varias consultas. Al activarla, solo los tokens no cacheados se facturan a la tarifa estándar; los tokens cacheados se facturan a una tarifa de lectura muy reducida. Por ejemplo, en Claude 3.5 Sonnet las lecturas cacheadas cuestan 0,30 $/M tokens frente a los 3,00 $/M tokens estándar.
La caché de prompts requiere una longitud mínima de prompt de 10.000 tokens en Claude 3.5 Sonnet y Claude 3 Opus, y de 20.000 tokens en Claude 3.5 Haiku. Los prompts más cortos que ese límite no se pueden cachear y siempre se facturan a las tarifas estándar de entrada.
La Batch API permite subir lotes de peticiones que se procesan de forma asíncrona en un plazo de 24 horas en lugar de en tiempo real. A cambio de ese margen de procesamiento, Anthropic ofrece un descuento fijo del 50 % en tokens de entrada y salida en todos los modelos. Activa la opción de Batch API en nuestra calculadora para aplicar ese descuento.
Como regla general, 1 token equivale aproximadamente a 4 caracteres de texto en inglés, o unas 0,75 palabras. Por tanto, 100 palabras son unos 133 tokens y 1.000 palabras rondan los 1.333 tokens. Los tokens de salida pueden variar según la complejidad de la respuesta y el formato (por ejemplo, código o etiquetas JSON, que consumen más tokens).
Sí. El precio base de los modelos Claude alojados en Amazon Bedrock o Google Vertex AI suele ser idéntico a las tarifas directas de Anthropic. No obstante, pueden aplicarse recargos regionales o descuentos empresariales personalizados de tu proveedor de nube. Usa nuestra calculadora como estimación de referencia.
Sí, totalmente. La calculadora de costes de Claude funciona íntegramente en tu navegador con JavaScript. Ningún número de tokens, volumen de peticiones ni dato de proyecto se envía a ningún servidor externo ni se guarda. Tus cálculos son completamente privados.