Перейти к содержимому
Aback Tools Logo

Калькулятор стоимости промпта

Бесплатно оцените онлайн стоимость запуска промптов в масштабе. Задайте системный промпт, сообщение пользователя и размеры выходных токенов, укажите суточный объём запросов — и увидите прогнозируемые затраты API за день, месяц и год. Мгновенно сравните затраты по 13 крупным провайдерам LLM. Быстро, приватно и на 100 % в браузере.

Prompt Cost Calculator

Estimate the cost of running prompts at scale. Define your system prompt, user message, and output size - then set your request volume to see daily, monthly, and yearly API cost projections across all major models.

Support chatbot with system prompt + short user messages

Prompt Composition (per request)

tokens
tokens
tokens

Token Breakdown per Request

System: 800User: 150Output: 300Total: 1,250

Scale & Model

Input/1M: $0.15Output/1M: $0.60
req/day
% / mo

Projected Monthly Cost - GPT-4o mini

$48.38for 150,000 requests

Cost / Request

$0.000322

Cost / Day

$1.61

Input Token Cost

$21.38

Output Token Cost

$27.00

Cheapest option: Mistral Small (Mistral) would cost $27.75 monthly - saving $20.63 vs your selection.

Cost at Scale - All Periods

PeriodTotal RequestsInput CostOutput CostTotal Cost
Daily5,000$0.7125$0.9000$1.61
MonthlySelected150,000$21.38$27.00$48.38
Yearly1,825,000$260.06$328.50$588.56

Cross-Model Price Comparison

Sorted by lowest monthly cost
ModelIn/1MOut/1MCost/ReqMonthly Total
Mistral Small(Mistral)Budget
$0.10$0.30$0.000185$27.75
GPT-4o mini(OpenAI)Budget Active
$0.15$0.60$0.000322$48.37
DeepSeek-V3(DeepSeek)Budget
$0.27$1.10$0.000586$87.98
Gemini 2.5 Flash(Google)Budget
$0.30$2.50$0.001035$155.25
Grok 4.3(xAI)
$1.25$2.50$0.001937$290.63
Claude 3.5 Haiku(Anthropic)Budget
$0.80$4.00$0.001960$294.00
o4-mini(OpenAI)Budget
$1.10$4.40$0.002365$354.75
Mistral Large(Mistral)
$2.00$6.00$0.003700$555.00
Gemini 2.5 Pro(Google)
$1.25$10.00$0.004187$628.12
o3(OpenAI)
$2.00$8.00$0.004300$645.00
GPT-4o(OpenAI)
$2.50$10.00$0.005375$806.25
Claude Sonnet 4.6(Anthropic)Powerful
$3.00$15.00$0.007350$1,102.50
Claude 3 Opus(Anthropic)Powerful
$15.00$75.00$0.0367$5,512.50

Click any row to select that model.

Disclaimer: Estimates use standard Pay-As-You-Go rates. Token counts are approximations - actual tokenization varies by model and content. Prompt caching, batch discounts, and volume pricing are not included unless your provider plan applies them automatically. Always verify current rates with each provider before budgeting.

Почему системный промпт определяет счёт

Системный промпт отправляется целиком в каждом запросе. Его стоимость зависит не от полезности, а от числа запросов.

При больших объёмах сокращение нескольких сотен токенов в системном промпте даёт заметную месячную экономию.

  • Стоимость системного промпта = токены × запросы в день × дни.
  • Выходные токены стоят в 3–6 раз дороже входных.
  • Кеш промптов снижает эту стоимость на 75–90 %, когда применим.

Разделение сообщения пользователя и контекста

Отделите фиксированный контекст от того, что меняется в каждом запросе. Только фиксированная часть подходит для кеша.

  1. Измерьте токены системного промпта и сообщения пользователя отдельно.
  2. Сложите ожидаемые входные токены на запрос.
  3. Добавьте ожидаемые выходные токены на ответ.
  4. Умножьте на объём запросов, чтобы получить итог за период.

Выбор модели и прогноз роста

Сравните полную стоимость вашей конфигурации по моделям до принятия решения. Самая дешёвая модель, удовлетворяющая требованиям по качеству, почти всегда лучший выбор.

  • Начните с самой экономичной модели и повышайте только при нехватке качества.
  • Моделируйте месячный рост, чтобы не занизить бюджет.
  • Оставляйте фронтирные модели для сложных рассуждений.

Часто задаваемые вопросы

Он оценивает затраты API на запуск конкретной конфигурации промпта — системного промпта, сообщения пользователя и ожидаемого вывода — при заданном объёме запросов и периоде. Он помогает разработчикам и продуктовым командам знать свои затраты на API LLM до запуска, планировать тарифные уровни ИИ-SaaS и сравнивать, какая модель даёт лучшее соотношение цены и качества.

Приблизительное правило: 1 токен ≈ 4 символа, или около 0,75 слова английского текста. Системный промпт на 500 слов — это примерно 650–700 токенов. Короткое сообщение на 50 слов — около 65–70 токенов. Для точных подсчётов используйте токенизатор: Tiktoken от OpenAI и токенизатор Claude от Anthropic доступны как открытые инструменты. Наш Token Counter тоже оценивает токены по вставленному тексту.

Системный промпт тарифицируется полностью при каждом запросе к API. Если он занимает 1000 токенов, а вы делаете 10 000 запросов в день, это 10 миллионов входных токенов только из системного промпта — каждый день. Поэтому длинные и многословные системные промпты сильно раздувают затраты. Сокращение системного промпта и включение кеша промптов — две оптимизации с лучшей окупаемостью для большинства продакшн-приложений LLM.

Нет — калькулятор использует стандартные тарифы «оплата по мере использования» без кеша. Это намеренно даёт базовую стоимость по худшему сценарию. На практике провайдеры вроде OpenAI, Anthropic, Google и xAI предлагают кеш промптов, снижающий стоимость входных токенов на 75–90 % для повторяющегося статического контента. Возьмите эту базу, а экономию от кеша моделируйте отдельно.

Используйте таблицу сравнения моделей: она показывает полную стоимость вашей конфигурации по всем поддерживаемым моделям. Начните с самой дешёвой модели, которая соответствует вашему требованию по качеству. Задачи классификации, извлечения и структурированного вывода часто отлично работают на меньших моделях (GPT-4o mini, Claude 3.5 Haiku, Gemini Flash, Mistral Small). Дорогие фронтирные модели оставьте для глубоких рассуждений.

Оно моделирует рост объёма запросов за период прогноза. Если указать 20 %, калькулятор считает, что суточное число запросов растёт на 20 % каждый месяц. Для годового прогноза используется линейная интерполяция между начальным и конечным объёмом. Поставьте 0 для постоянных проекций.

Генерация токенов требует полного авторегрессионного прямого прохода на каждый токен — намного больше вычислений, чем чтение входных токенов. Поэтому генерация вывода дороже и тарифицируется с наценкой 3–6× к входным токенам у большинства провайдеров. Именно поэтому приложения с длинными ответами имеют иной профиль затрат, чем классификаторы с коротким выводом.

Да. Калькулятор работает полностью на стороне клиента, в браузере. Никакие подсчёты токенов, конфигурации промптов, оценки затрат или выбор моделей не отправляются на сервер. Всё вычисляется локально на вашем устройстве и не сохраняется. Данные вашего планирования на 100 % приватны и защищены.