Calculadora de costes de DeepSeek
Estima gratis los gastos de la API de DeepSeek según tu uso de tokens. Admite comparación de modelos (DeepSeek-V4-Flash, DeepSeek-V4-Pro, V3, R1), descuentos por tasa de acierto de caché de prompts, modelado de tokens de razonamiento y previsiones mensuales. Rápido, seguro y totalmente privado.
Estimate input/output token pricing, compare legacy and active model tiers, configure context caching hit rates, and analyze overall API forecasts locally.
Prompt & Response Tokens
Cost Optimizations
Workload Call Volume
Projected Monthly Workload Cost
Cost/Call
$0.001120
Input Cost
$0.000700
Output Cost
$0.000280
Reasoning Cost
$0.000140
Model Pricing Comparisons
Sorted by lowest cost| Model Name | Cost/Call | Monthly Forecast | Caching / Reasoning |
|---|---|---|---|
| DeepSeek-V3 (Legacy) | $0.000980 | $29.40 | Cache Supported |
| DeepSeek-V4-FlashCost-Effective Selected | $0.001120 | $33.60 | Cache Supported Reasoning |
| DeepSeek-V4-ProCapable | $0.003480 | $104.40 | Cache Supported Reasoning |
| DeepSeek-R1 (Legacy) | $0.006035 | $181.05 | Cache Supported Reasoning |
Las cuatro partidas de una factura de DeepSeek
En DeepSeek el coste no se reparte solo entre entrada y salida. La caché puede abaratar drásticamente los tokens repetidos, y los tokens de razonamiento suman coste sin aparecer en la respuesta.
Introduce tokens de entrada, tokens cacheados, tokens de salida y tokens de razonamiento con tu volumen de consultas para ver el coste real por consulta y la previsión mensual.
- Los tokens de salida cuestan entre 2 y 4 veces más que los de entrada.
- Los tokens cacheados pueden ser hasta un 98 % más baratos que los de entrada estándar.
- Los tokens de razonamiento se facturan como salida aunque no aparezcan en la respuesta.
Cuándo usar caché y cuándo procesamiento por lotes
La caché y la Batch API no compiten: resuelven problemas distintos y pueden combinarse.
- Caché: útil cuando el mismo prefijo largo se repite en muchas consultas.
- Batch: útil cuando puedes tolerar 24 horas de espera y no necesitas respuesta inmediata.
- Ninguna de las dos ayuda si cada consulta usa un prompt corto y diferente.
Elegir modelo con criterio
La familia DeepSeek cubre desde tareas de alto volumen y bajo coste hasta razonamiento complejo. Elegir la variante equivocada multiplica la factura sin mejorar el resultado.
- Mide los tokens reales de una consulta representativa, incluidos los de razonamiento.
- Calcula el coste por consulta con tu modelo actual y tu volumen mensual.
- Compara con otras variantes de la familia DeepSeek usando la misma carga de trabajo.
- Aplica caché o Batch si tu patrón de uso lo permite y revisa el ahorro resultante.
Preguntas frecuentes
Es una herramienta que estima el precio de la API de DeepSeek a partir de tus tokens de entrada, cacheados y salida, los volúmenes de consultas y la configuración de modelo. Ayuda a los desarrolladores a planificar presupuestos y elegir el modelo DeepSeek más rentable para su carga de trabajo. Funciona íntegramente en tu navegador y no requiere registro.
Usa las tarifas estándar de pago por uso de la documentación oficial de la API de DeepSeek. Aun así, los costes reales pueden variar según planes de precios personalizados, proveedores de hosting externos (como OpenRouter, Together AI o Novita) o actualizaciones que DeepSeek haga en los precios de la API. Consulta siempre la página oficial de precios para las tarifas definitivas.
Los tokens de entrada representan el texto o contenido multimedia que envías en tu prompt al modelo. Los tokens de salida representan el texto de respuesta generado por el modelo. Generarlos es computacionalmente más costoso, por lo que se facturan bastante más caros (normalmente entre 2 y 4 veces) que los tokens de entrada en todos los modelos DeepSeek.
La caché de contexto permite almacenar grandes bloques repetitivos de contenido (como un repositorio de código extenso, un libro o instrucciones de sistema largas) en caché. Cuando consultas el modelo, este lee de la caché en lugar de reprocesar todo el prompt. Los tokens de entrada cacheados se cobran con un descuento enorme (habitualmente hasta un 98 % más baratos que los de entrada estándar).
Los modelos de razonamiento generan tokens internos de cadena de pensamiento durante su fase de procesamiento. Aunque esos tokens no se devuelven en la salida de la API, se facturan al mismo precio que los tokens de salida estándar. Incluye los tokens de pensamiento estimados en el campo de tokens de razonamiento de esta calculadora para presupuestar con precisión.
Sí. La Batch API está pensada para cargas que no son sensibles a la latencia (como el procesamiento de datos offline). Las peticiones por lotes reciben automáticamente un 50 % de descuento tanto en las tarifas de entrada como de salida.
No. La calculadora funciona íntegramente en el lado del cliente, en tu navegador. Tus datos de entrada, tamaños de tokens, costes estimados y resultados de comparación se procesan localmente en tu dispositivo y nunca se envían a un servidor. Tus datos permanecen 100 % privados y seguros.