Калькулятор стоимости промпта
Бесплатно оцените онлайн стоимость запуска промптов в масштабе. Задайте системный промпт, сообщение пользователя и размеры выходных токенов, укажите суточный объём запросов — и увидите прогнозируемые затраты API за день, месяц и год. Мгновенно сравните затраты по 13 крупным провайдерам LLM. Быстро, приватно и на 100 % в браузере.
Estimate the cost of running prompts at scale. Define your system prompt, user message, and output size - then set your request volume to see daily, monthly, and yearly API cost projections across all major models.
Support chatbot with system prompt + short user messages
Prompt Composition (per request)
Token Breakdown per Request
Scale & Model
Projected Monthly Cost - GPT-4o mini
Cost / Request
$0.000322
Cost / Day
$1.61
Input Token Cost
$21.38
Output Token Cost
$27.00
Cost at Scale - All Periods
| Period | Total Requests | Input Cost | Output Cost | Total Cost |
|---|---|---|---|---|
| Daily | 5,000 | $0.7125 | $0.9000 | $1.61 |
| MonthlySelected | 150,000 | $21.38 | $27.00 | $48.38 |
| Yearly | 1,825,000 | $260.06 | $328.50 | $588.56 |
Cross-Model Price Comparison
Sorted by lowest monthly cost| Model | In/1M | Out/1M | Cost/Req | Monthly Total |
|---|---|---|---|---|
Mistral Small(Mistral)Budget | $0.10 | $0.30 | $0.000185 | $27.75 |
GPT-4o mini(OpenAI)Budget Active | $0.15 | $0.60 | $0.000322 | $48.37 |
DeepSeek-V3(DeepSeek)Budget | $0.27 | $1.10 | $0.000586 | $87.98 |
Gemini 2.5 Flash(Google)Budget | $0.30 | $2.50 | $0.001035 | $155.25 |
Grok 4.3(xAI) | $1.25 | $2.50 | $0.001937 | $290.63 |
Claude 3.5 Haiku(Anthropic)Budget | $0.80 | $4.00 | $0.001960 | $294.00 |
o4-mini(OpenAI)Budget | $1.10 | $4.40 | $0.002365 | $354.75 |
Mistral Large(Mistral) | $2.00 | $6.00 | $0.003700 | $555.00 |
Gemini 2.5 Pro(Google) | $1.25 | $10.00 | $0.004187 | $628.12 |
o3(OpenAI) | $2.00 | $8.00 | $0.004300 | $645.00 |
GPT-4o(OpenAI) | $2.50 | $10.00 | $0.005375 | $806.25 |
Claude Sonnet 4.6(Anthropic)Powerful | $3.00 | $15.00 | $0.007350 | $1,102.50 |
Claude 3 Opus(Anthropic)Powerful | $15.00 | $75.00 | $0.0367 | $5,512.50 |
Click any row to select that model.
Почему системный промпт определяет счёт
Системный промпт отправляется целиком в каждом запросе. Его стоимость зависит не от полезности, а от числа запросов.
При больших объёмах сокращение нескольких сотен токенов в системном промпте даёт заметную месячную экономию.
- Стоимость системного промпта = токены × запросы в день × дни.
- Выходные токены стоят в 3–6 раз дороже входных.
- Кеш промптов снижает эту стоимость на 75–90 %, когда применим.
Разделение сообщения пользователя и контекста
Отделите фиксированный контекст от того, что меняется в каждом запросе. Только фиксированная часть подходит для кеша.
- Измерьте токены системного промпта и сообщения пользователя отдельно.
- Сложите ожидаемые входные токены на запрос.
- Добавьте ожидаемые выходные токены на ответ.
- Умножьте на объём запросов, чтобы получить итог за период.
Выбор модели и прогноз роста
Сравните полную стоимость вашей конфигурации по моделям до принятия решения. Самая дешёвая модель, удовлетворяющая требованиям по качеству, почти всегда лучший выбор.
- Начните с самой экономичной модели и повышайте только при нехватке качества.
- Моделируйте месячный рост, чтобы не занизить бюджет.
- Оставляйте фронтирные модели для сложных рассуждений.
Часто задаваемые вопросы
Он оценивает затраты API на запуск конкретной конфигурации промпта — системного промпта, сообщения пользователя и ожидаемого вывода — при заданном объёме запросов и периоде. Он помогает разработчикам и продуктовым командам знать свои затраты на API LLM до запуска, планировать тарифные уровни ИИ-SaaS и сравнивать, какая модель даёт лучшее соотношение цены и качества.
Приблизительное правило: 1 токен ≈ 4 символа, или около 0,75 слова английского текста. Системный промпт на 500 слов — это примерно 650–700 токенов. Короткое сообщение на 50 слов — около 65–70 токенов. Для точных подсчётов используйте токенизатор: Tiktoken от OpenAI и токенизатор Claude от Anthropic доступны как открытые инструменты. Наш Token Counter тоже оценивает токены по вставленному тексту.
Системный промпт тарифицируется полностью при каждом запросе к API. Если он занимает 1000 токенов, а вы делаете 10 000 запросов в день, это 10 миллионов входных токенов только из системного промпта — каждый день. Поэтому длинные и многословные системные промпты сильно раздувают затраты. Сокращение системного промпта и включение кеша промптов — две оптимизации с лучшей окупаемостью для большинства продакшн-приложений LLM.
Нет — калькулятор использует стандартные тарифы «оплата по мере использования» без кеша. Это намеренно даёт базовую стоимость по худшему сценарию. На практике провайдеры вроде OpenAI, Anthropic, Google и xAI предлагают кеш промптов, снижающий стоимость входных токенов на 75–90 % для повторяющегося статического контента. Возьмите эту базу, а экономию от кеша моделируйте отдельно.
Используйте таблицу сравнения моделей: она показывает полную стоимость вашей конфигурации по всем поддерживаемым моделям. Начните с самой дешёвой модели, которая соответствует вашему требованию по качеству. Задачи классификации, извлечения и структурированного вывода часто отлично работают на меньших моделях (GPT-4o mini, Claude 3.5 Haiku, Gemini Flash, Mistral Small). Дорогие фронтирные модели оставьте для глубоких рассуждений.
Оно моделирует рост объёма запросов за период прогноза. Если указать 20 %, калькулятор считает, что суточное число запросов растёт на 20 % каждый месяц. Для годового прогноза используется линейная интерполяция между начальным и конечным объёмом. Поставьте 0 для постоянных проекций.
Генерация токенов требует полного авторегрессионного прямого прохода на каждый токен — намного больше вычислений, чем чтение входных токенов. Поэтому генерация вывода дороже и тарифицируется с наценкой 3–6× к входным токенам у большинства провайдеров. Именно поэтому приложения с длинными ответами имеют иной профиль затрат, чем классификаторы с коротким выводом.
Да. Калькулятор работает полностью на стороне клиента, в браузере. Никакие подсчёты токенов, конфигурации промптов, оценки затрат или выбор моделей не отправляются на сервер. Всё вычисляется локально на вашем устройстве и не сохраняется. Данные вашего планирования на 100 % приватны и защищены.