Калькулятор стоимости DeepSeek
Бесплатно оцените расходы на API DeepSeek по вашему использованию токенов. Поддерживается сравнение моделей (DeepSeek-V4-Flash, DeepSeek-V4-Pro, V3, R1), скидки за попадание в кеш промптов, моделирование токенов рассуждений и прогнозы на месяц. Быстро, безопасно и полностью приватно.
Estimate input/output token pricing, compare legacy and active model tiers, configure context caching hit rates, and analyze overall API forecasts locally.
Prompt & Response Tokens
Cost Optimizations
Workload Call Volume
Projected Monthly Workload Cost
Cost/Call
$0.001120
Input Cost
$0.000700
Output Cost
$0.000280
Reasoning Cost
$0.000140
Model Pricing Comparisons
Sorted by lowest cost| Model Name | Cost/Call | Monthly Forecast | Caching / Reasoning |
|---|---|---|---|
| DeepSeek-V3 (Legacy) | $0.000980 | $29.40 | Cache Supported |
| DeepSeek-V4-FlashCost-Effective Selected | $0.001120 | $33.60 | Cache Supported Reasoning |
| DeepSeek-V4-ProCapable | $0.003480 | $104.40 | Cache Supported Reasoning |
| DeepSeek-R1 (Legacy) | $0.006035 | $181.05 | Cache Supported Reasoning |
Четыре статьи счёта DeepSeek
В DeepSeek стоимость не сводится к входу и выходу. Кеш может резко удешевить повторяющиеся токены, а токены рассуждений добавляют расход, не появляясь в ответе.
Укажите входные, кэшированные, выходные токены и токены рассуждений с объёмом запросов, чтобы увидеть реальную стоимость запроса и месячный прогноз.
- Выходные токены в 2–4 раза дороже входных.
- Кэшированные токены до 98 % дешевле стандартных входных.
- Токены рассуждений тарифицируются как выходные, хотя в ответе их нет.
Когда использовать кеш, а когда пакеты
Кеш и Batch API не конкурируют: они решают разные задачи и могут сочетаться.
- Кеш: полезен, когда один и тот же длинный префикс повторяется во многих запросах.
- Batch: полезен, когда допустимо ждать до 24 часов и не нужен немедленный ответ.
- Ни то, ни другое не поможет, если каждый запрос использует короткий и разный промпт.
Осознанный выбор модели
Семейство DeepSeek покрывает от недорогих массовых задач до сложных рассуждений. Неверный вариант умножает счёт, не улучшая результат.
- Измерьте реальные токены типичного запроса, включая токены рассуждений.
- Рассчитайте стоимость запроса на текущей модели и месячном объёме.
- Сравните с другими вариантами DeepSeek на той же нагрузке.
- Включите кеш или Batch, если профиль использования позволяет, и проверьте экономию.
Часто задаваемые вопросы
Это инструмент, который оценивает цену API DeepSeek по вашим входным, кэшированным и выходным токенам, объёму запросов и конфигурации моделей. Он помогает разработчикам планировать бюджет и выбирать самую выгодную модель DeepSeek для своей нагрузки. Работает полностью в браузере без регистрации.
Калькулятор использует стандартные тарифы Pay-As-You-Go из официальной документации API DeepSeek. Однако реальные расходы могут отличаться из-за индивидуальных тарифных планов, сторонних хостингов (OpenRouter, Together AI, Novita) или обновлений цен DeepSeek. Для точных ставок обращайтесь к официальной странице цен.
Входные токены — это текст или медиа, которые вы отправляете в промпте. Выходные — сгенерированный моделью ответ. Их создание вычислительно дороже, поэтому на всех моделях DeepSeek они тарифицируются заметно выше (обычно в 2–4 раза), чем входные.
Контекстное кеширование позволяет хранить в кэше большие повторяющиеся блоки контента (объёмный код, книгу, длинные системные инструкции). При запросе модель читает кэш вместо повторной обработки всего промпта. Кэшированные входные токены тарифицируются с огромной скидкой — обычно до 98 % дешевле стандартных входных.
Модели рассуждений создают внутренние токены цепочки размышлений в процессе обработки. В выводе API они не возвращаются, но тарифицируются по цене стандартных выходных токенов. Указывайте оценку таких токенов в поле токенов рассуждений, чтобы бюджет был точным.
Да. Batch API предназначена для нагрузок, нечувствительных к задержке (например, офлайн-обработка данных). Пакетные запросы автоматически получают скидку 50 % и на входные, и на выходные токены.
Нет. Калькулятор работает полностью на стороне клиента, в браузере. Введённые данные, размеры токенов, оценки затрат и результаты сравнения обрабатываются локально на вашем устройстве и никогда не отправляются на сервер. Данные остаются на 100 % приватными.