Калькулятор стоимости токенов
Бесплатно переведите онлайн количество токенов в оценку затрат API по более чем 20 моделям. Сравните OpenAI, Anthropic, Google, xAI, DeepSeek, Mistral и других рядом. Смоделируйте экономию кеша промптов, добавьте свои цены и спрогнозируйте месячные расходы — всё в браузере, без регистрации.
Enter your input and output token counts to instantly calculate API costs across 20+ models from OpenAI, Anthropic, Google, xAI, DeepSeek, Mistral, Cohere, and Meta. Compare providers side-by-side, add custom pricing, and forecast monthly or annual spending.
Token Counts
Workload Volume
Primary Model
Monthly Cost - GPT-4o
Cost / Call
$0.0225
Input Cost
$0.0125
Output Cost
$0.0100
Cache Savings
-
Daily
$22.50
1,000 calls
Monthly
$675.00
30,000 calls
Yearly
$8,212.50
365,000 calls
Full Provider Comparison
| Model | Cost / Call | Input Cost | Output Cost | Monthly Total | Features |
|---|---|---|---|---|---|
Mistral SmallMistralCost-Effective $0.1000/M in · $0.3000/M out | $0.000800 | $0.000500 | $0.000300 | $24.00 | - |
GPT-4o miniOpenAICost-Effective $0.1500/M in · $0.6000/M out | $0.001350 | $0.000750 | $0.000600 | $40.50 | Caching |
Command RCohereCost-Effective $0.1500/M in · $0.6000/M out | $0.001350 | $0.000750 | $0.000600 | $40.50 | - |
Grok 3 MinixAICost-Effective $0.3000/M in · $0.5000/M out | $0.002000 | $0.001500 | $0.000500 | $60.00 | - |
DeepSeek-V3DeepSeekCost-Effective $0.2700/M in · $1.1000/M out | $0.002450 | $0.001350 | $0.001100 | $73.50 | Caching |
Gemini 2.5 FlashGoogleCost-Effective $0.3000/M in · $2.5000/M out | $0.004000 | $0.001500 | $0.002500 | $120.00 | Caching |
Llama 3.1 70BMetaCost-Effective $0.7200/M in · $0.7200/M out | $0.004320 | $0.003600 | $0.000720 | $129.60 | - |
DeepSeek-R1DeepSeek $0.5500/M in · $2.1900/M out | $0.004940 | $0.002750 | $0.002190 | $148.20 | Caching |
Claude 3.5 HaikuAnthropicCost-Effective $0.8000/M in · $4.0000/M out | $0.008000 | $0.004000 | $0.004000 | $240.00 | Caching |
o4-miniOpenAICost-Effective $1.1000/M in · $4.4000/M out | $0.009900 | $0.005500 | $0.004400 | $297.00 | Caching |
Gemini 1.5 ProGoogle $1.2500/M in · $5.0000/M out | $0.0112 | $0.006250 | $0.005000 | $337.50 | Caching |
Mistral LargeMistral $2.0000/M in · $6.0000/M out | $0.0160 | $0.0100 | $0.006000 | $480.00 | - |
Gemini 2.5 ProGoogle $1.2500/M in · $10.0000/M out | $0.0163 | $0.006250 | $0.0100 | $487.50 | Caching |
o3OpenAI $2.0000/M in · $8.0000/M out | $0.0180 | $0.0100 | $0.008000 | $540.00 | Caching |
GPT-4oOpenAI Primary $2.5000/M in · $10.0000/M out | $0.0225 | $0.0125 | $0.0100 | $675.00 | Caching |
Command R+Cohere $2.5000/M in · $10.0000/M out | $0.0225 | $0.0125 | $0.0100 | $675.00 | - |
Claude 3.7 SonnetAnthropicCapable $3.0000/M in · $15.0000/M out | $0.0300 | $0.0150 | $0.0150 | $900.00 | Caching |
Grok 3xAI $3.0000/M in · $15.0000/M out | $0.0300 | $0.0150 | $0.0150 | $900.00 | - |
Llama 3.1 405BMeta $5.0000/M in · $16.0000/M out | $0.0410 | $0.0250 | $0.0160 | $1,230.00 | - |
GPT-5.5OpenAICapable $5.0000/M in · $30.0000/M out | $0.0550 | $0.0250 | $0.0300 | $1,650.00 | Caching |
Claude 3 OpusAnthropicCapable $15.0000/M in · $75.0000/M out | $0.1500 | $0.0750 | $0.0750 | $4,500.00 | Caching |
Click any row to set it as the primary model. 21 models shown.
Как перевести токены в стоимость
Расчёт прост: входные токены умножить на ставку входа, выходные — на ставку выхода, и сложить. Сложность в выборе модели и в том, сколько токенов реально генерирует ваша нагрузка.
Выходные токены в 3–8 раз дороже, поэтому ограничение длины ответов обычно даёт наибольшую экономию.
- Стоимость = входные токены × ставка входа + выходные токены × ставка выхода.
- Ставки указываются за миллион токенов.
- Выберите единицу периода, чтобы увидеть нужный итог.
Кеш промптов и свои модели
Если вы переиспользуете большой стабильный префикс, кеш существенно снижает его стоимость. Укажите кешированные токены, чтобы измерить реальную экономию.
- Кеш: обычно 10–25 % стандартной ставки входа.
- Выгоден при системных промптах, фиксированных инструкциях или общем контексте.
- Добавьте свои цены, чтобы сравнивать приватные или дообученные модели.
Сравнение провайдеров и планирование расходов
Цель — найти самую дешёвую модель, отвечающую вашим требованиям по качеству, а не просто самую дешёвую.
- Получите фактическое число входных и выходных токенов на вызов.
- Укажите объём запросов и период.
- Сравните модели-кандидаты в таблице.
- Проверьте месячный и годовой прогноз до фиксации бюджета.
Часто задаваемые вопросы
Он переводит количество токенов в оценку затрат API у провайдеров языковых моделей. Вы вводите объёмы входных и выходных токенов — из своего токенизатора, шаблона промпта или метаданных API — и инструмент мгновенно считает стоимость вызова и прогноз расходов за месяц или год. В отличие от счётчика токенов, который оценивает токены по сырому тексту.
Входные токены — это промпт, отправляемый модели; выходные — сгенерированный ответ. Выходные вычислительно дороже и тарифицируются заметно выше, обычно в 3–8 раз. Для большинства нагрузок сокращение лишних выходных токенов влияет на затраты сильнее, чем экономия входных.
Кеш промптов хранит повторяющийся контент во временном кеше. Последующие запросы с тем же префиксом тарифицируются заметно ниже (обычно 10–25 % стандартной ставки за вход, то есть экономия 75–90 %). Калькулятор позволяет указать число кешированных токенов, чтобы точно смоделировать экономию.
Калькулятор включает более 20 моделей от OpenAI (GPT-5.5, GPT-4o, o3, o4-mini), Anthropic (Claude 3.7 Sonnet, Claude 3.5 Haiku, Claude 3 Opus), Google (Gemini 2.5 Pro/Flash, Gemini 1.5 Pro), xAI (Grok 3, Grok 3 Mini), DeepSeek (V3, R1), Mistral (Large, Small), Cohere (Command R+/R) и Meta (Llama 3.1 70B/405B).
Да. Разверните раздел «Свои цены моделей», чтобы добавить модели со своими ставками за миллион токенов. Они появятся в таблице сравнения рядом с пресетами, позволяя сопоставлять дообученные или приватные модели с хостинговыми API.
Все тарифы отражают стандартные цены «оплата по мере использования» из опубликованной документации провайдеров. Реальные затраты могут отличаться из-за региональных налогов, скидок за объём или корпоративных соглашений. Всегда сверяйтесь с официальной страницей цен провайдера перед решениями о биллинге.
Да. Калькулятор работает на 100 % на стороне клиента, в браузере. Количество токенов, объёмы запросов и оценки затрат рассчитываются локально на вашем устройстве и никогда не передаются на сервер. Данные не покидают браузер, регистрация не нужна.