Перейти к содержимому
Aback Tools Logo

Калькулятор стоимости DeepSeek

Бесплатно оцените расходы на API DeepSeek по вашему использованию токенов. Поддерживается сравнение моделей (DeepSeek-V4-Flash, DeepSeek-V4-Pro, V3, R1), скидки за попадание в кеш промптов, моделирование токенов рассуждений и прогнозы на месяц. Быстро, безопасно и полностью приватно.

DeepSeek Cost Calculator

Estimate input/output token pricing, compare legacy and active model tiers, configure context caching hit rates, and analyze overall API forecasts locally.

Input/1M (miss): $0.1400Input/1M (hit): $0.0028Output/1M: $0.2800

Prompt & Response Tokens

tokens
tokens
tokens

Cost Optimizations

Workload Call Volume

reqs

Projected Monthly Workload Cost

$33.60for 30,000 total requests

Cost/Call

$0.001120

Input Cost

$0.000700

Output Cost

$0.000280

Reasoning Cost

$0.000140

Model Pricing Comparisons

Sorted by lowest cost
Model NameCost/CallMonthly ForecastCaching / Reasoning
DeepSeek-V3 (Legacy)$0.000980$29.40Cache Supported
DeepSeek-V4-FlashCost-Effective Selected$0.001120$33.60Cache Supported Reasoning
DeepSeek-V4-ProCapable$0.003480$104.40Cache Supported Reasoning
DeepSeek-R1 (Legacy)$0.006035$181.05Cache Supported Reasoning
Calculations Disclaimer: Estimations are computed based on standard DeepSeek API pricing sheets. Real-world API expenses may deviate slightly due to tokenization rounding differences (Word count to Token conversion ratio varies by content text), regional taxes, or custom enterprise SLAs. Cache hit rates represent the percentage of input tokens served by cache hits (billed at a massive discount). Reasoning tokens are generated internally by reasoning-capable models and are billed standardly per output token.

Четыре статьи счёта DeepSeek

В DeepSeek стоимость не сводится к входу и выходу. Кеш может резко удешевить повторяющиеся токены, а токены рассуждений добавляют расход, не появляясь в ответе.

Укажите входные, кэшированные, выходные токены и токены рассуждений с объёмом запросов, чтобы увидеть реальную стоимость запроса и месячный прогноз.

  • Выходные токены в 2–4 раза дороже входных.
  • Кэшированные токены до 98 % дешевле стандартных входных.
  • Токены рассуждений тарифицируются как выходные, хотя в ответе их нет.

Когда использовать кеш, а когда пакеты

Кеш и Batch API не конкурируют: они решают разные задачи и могут сочетаться.

  • Кеш: полезен, когда один и тот же длинный префикс повторяется во многих запросах.
  • Batch: полезен, когда допустимо ждать до 24 часов и не нужен немедленный ответ.
  • Ни то, ни другое не поможет, если каждый запрос использует короткий и разный промпт.

Осознанный выбор модели

Семейство DeepSeek покрывает от недорогих массовых задач до сложных рассуждений. Неверный вариант умножает счёт, не улучшая результат.

  1. Измерьте реальные токены типичного запроса, включая токены рассуждений.
  2. Рассчитайте стоимость запроса на текущей модели и месячном объёме.
  3. Сравните с другими вариантами DeepSeek на той же нагрузке.
  4. Включите кеш или Batch, если профиль использования позволяет, и проверьте экономию.

Часто задаваемые вопросы

Это инструмент, который оценивает цену API DeepSeek по вашим входным, кэшированным и выходным токенам, объёму запросов и конфигурации моделей. Он помогает разработчикам планировать бюджет и выбирать самую выгодную модель DeepSeek для своей нагрузки. Работает полностью в браузере без регистрации.

Калькулятор использует стандартные тарифы Pay-As-You-Go из официальной документации API DeepSeek. Однако реальные расходы могут отличаться из-за индивидуальных тарифных планов, сторонних хостингов (OpenRouter, Together AI, Novita) или обновлений цен DeepSeek. Для точных ставок обращайтесь к официальной странице цен.

Входные токены — это текст или медиа, которые вы отправляете в промпте. Выходные — сгенерированный моделью ответ. Их создание вычислительно дороже, поэтому на всех моделях DeepSeek они тарифицируются заметно выше (обычно в 2–4 раза), чем входные.

Контекстное кеширование позволяет хранить в кэше большие повторяющиеся блоки контента (объёмный код, книгу, длинные системные инструкции). При запросе модель читает кэш вместо повторной обработки всего промпта. Кэшированные входные токены тарифицируются с огромной скидкой — обычно до 98 % дешевле стандартных входных.

Модели рассуждений создают внутренние токены цепочки размышлений в процессе обработки. В выводе API они не возвращаются, но тарифицируются по цене стандартных выходных токенов. Указывайте оценку таких токенов в поле токенов рассуждений, чтобы бюджет был точным.

Да. Batch API предназначена для нагрузок, нечувствительных к задержке (например, офлайн-обработка данных). Пакетные запросы автоматически получают скидку 50 % и на входные, и на выходные токены.

Нет. Калькулятор работает полностью на стороне клиента, в браузере. Введённые данные, размеры токенов, оценки затрат и результаты сравнения обрабатываются локально на вашем устройстве и никогда не отправляются на сервер. Данные остаются на 100 % приватными.