Saltar al contenido
Aback Tools Logo

Calculadora de costes de DeepSeek

Estima gratis los gastos de la API de DeepSeek según tu uso de tokens. Admite comparación de modelos (DeepSeek-V4-Flash, DeepSeek-V4-Pro, V3, R1), descuentos por tasa de acierto de caché de prompts, modelado de tokens de razonamiento y previsiones mensuales. Rápido, seguro y totalmente privado.

DeepSeek Cost Calculator

Estimate input/output token pricing, compare legacy and active model tiers, configure context caching hit rates, and analyze overall API forecasts locally.

Input/1M (miss): $0.1400Input/1M (hit): $0.0028Output/1M: $0.2800

Prompt & Response Tokens

tokens
tokens
tokens

Cost Optimizations

Workload Call Volume

reqs

Projected Monthly Workload Cost

$33.60for 30,000 total requests

Cost/Call

$0.001120

Input Cost

$0.000700

Output Cost

$0.000280

Reasoning Cost

$0.000140

Model Pricing Comparisons

Sorted by lowest cost
Model NameCost/CallMonthly ForecastCaching / Reasoning
DeepSeek-V3 (Legacy)$0.000980$29.40Cache Supported
DeepSeek-V4-FlashCost-Effective Selected$0.001120$33.60Cache Supported Reasoning
DeepSeek-V4-ProCapable$0.003480$104.40Cache Supported Reasoning
DeepSeek-R1 (Legacy)$0.006035$181.05Cache Supported Reasoning
Calculations Disclaimer: Estimations are computed based on standard DeepSeek API pricing sheets. Real-world API expenses may deviate slightly due to tokenization rounding differences (Word count to Token conversion ratio varies by content text), regional taxes, or custom enterprise SLAs. Cache hit rates represent the percentage of input tokens served by cache hits (billed at a massive discount). Reasoning tokens are generated internally by reasoning-capable models and are billed standardly per output token.

Las cuatro partidas de una factura de DeepSeek

En DeepSeek el coste no se reparte solo entre entrada y salida. La caché puede abaratar drásticamente los tokens repetidos, y los tokens de razonamiento suman coste sin aparecer en la respuesta.

Introduce tokens de entrada, tokens cacheados, tokens de salida y tokens de razonamiento con tu volumen de consultas para ver el coste real por consulta y la previsión mensual.

  • Los tokens de salida cuestan entre 2 y 4 veces más que los de entrada.
  • Los tokens cacheados pueden ser hasta un 98 % más baratos que los de entrada estándar.
  • Los tokens de razonamiento se facturan como salida aunque no aparezcan en la respuesta.

Cuándo usar caché y cuándo procesamiento por lotes

La caché y la Batch API no compiten: resuelven problemas distintos y pueden combinarse.

  • Caché: útil cuando el mismo prefijo largo se repite en muchas consultas.
  • Batch: útil cuando puedes tolerar 24 horas de espera y no necesitas respuesta inmediata.
  • Ninguna de las dos ayuda si cada consulta usa un prompt corto y diferente.

Elegir modelo con criterio

La familia DeepSeek cubre desde tareas de alto volumen y bajo coste hasta razonamiento complejo. Elegir la variante equivocada multiplica la factura sin mejorar el resultado.

  1. Mide los tokens reales de una consulta representativa, incluidos los de razonamiento.
  2. Calcula el coste por consulta con tu modelo actual y tu volumen mensual.
  3. Compara con otras variantes de la familia DeepSeek usando la misma carga de trabajo.
  4. Aplica caché o Batch si tu patrón de uso lo permite y revisa el ahorro resultante.

Preguntas frecuentes

Es una herramienta que estima el precio de la API de DeepSeek a partir de tus tokens de entrada, cacheados y salida, los volúmenes de consultas y la configuración de modelo. Ayuda a los desarrolladores a planificar presupuestos y elegir el modelo DeepSeek más rentable para su carga de trabajo. Funciona íntegramente en tu navegador y no requiere registro.

Usa las tarifas estándar de pago por uso de la documentación oficial de la API de DeepSeek. Aun así, los costes reales pueden variar según planes de precios personalizados, proveedores de hosting externos (como OpenRouter, Together AI o Novita) o actualizaciones que DeepSeek haga en los precios de la API. Consulta siempre la página oficial de precios para las tarifas definitivas.

Los tokens de entrada representan el texto o contenido multimedia que envías en tu prompt al modelo. Los tokens de salida representan el texto de respuesta generado por el modelo. Generarlos es computacionalmente más costoso, por lo que se facturan bastante más caros (normalmente entre 2 y 4 veces) que los tokens de entrada en todos los modelos DeepSeek.

La caché de contexto permite almacenar grandes bloques repetitivos de contenido (como un repositorio de código extenso, un libro o instrucciones de sistema largas) en caché. Cuando consultas el modelo, este lee de la caché en lugar de reprocesar todo el prompt. Los tokens de entrada cacheados se cobran con un descuento enorme (habitualmente hasta un 98 % más baratos que los de entrada estándar).

Los modelos de razonamiento generan tokens internos de cadena de pensamiento durante su fase de procesamiento. Aunque esos tokens no se devuelven en la salida de la API, se facturan al mismo precio que los tokens de salida estándar. Incluye los tokens de pensamiento estimados en el campo de tokens de razonamiento de esta calculadora para presupuestar con precisión.

Sí. La Batch API está pensada para cargas que no son sensibles a la latencia (como el procesamiento de datos offline). Las peticiones por lotes reciben automáticamente un 50 % de descuento tanto en las tarifas de entrada como de salida.

No. La calculadora funciona íntegramente en el lado del cliente, en tu navegador. Tus datos de entrada, tamaños de tokens, costes estimados y resultados de comparación se procesan localmente en tu dispositivo y nunca se envían a un servidor. Tus datos permanecen 100 % privados y seguros.