Перейти к содержимому
Aback Tools Logo

Калькулятор стоимости токенов

Бесплатно переведите онлайн количество токенов в оценку затрат API по более чем 20 моделям. Сравните OpenAI, Anthropic, Google, xAI, DeepSeek, Mistral и других рядом. Смоделируйте экономию кеша промптов, добавьте свои цены и спрогнозируйте месячные расходы — всё в браузере, без регистрации.

Token Cost Calculator

Enter your input and output token counts to instantly calculate API costs across 20+ models from OpenAI, Anthropic, Google, xAI, DeepSeek, Mistral, Cohere, and Meta. Compare providers side-by-side, add custom pricing, and forecast monthly or annual spending.

Token Counts

tokens
tokens

Workload Volume

reqs

Primary Model

Monthly Cost - GPT-4o

$675.00for 30,000 calls

Cost / Call

$0.0225

Input Cost

$0.0125

Output Cost

$0.0100

Cache Savings

-

In rate: $2.5000/M tokensOut rate: $10.0000/M tokensCache rate: $1.2500/M tokens

Daily

$22.50

1,000 calls

Monthly

$675.00

30,000 calls

Yearly

$8,212.50

365,000 calls

Full Provider Comparison

ModelCost / CallInput CostOutput CostMonthly TotalFeatures
Mistral SmallMistralCost-Effective
$0.1000/M in · $0.3000/M out
$0.000800$0.000500$0.000300$24.00-
GPT-4o miniOpenAICost-Effective
$0.1500/M in · $0.6000/M out
$0.001350$0.000750$0.000600$40.50Caching
Command RCohereCost-Effective
$0.1500/M in · $0.6000/M out
$0.001350$0.000750$0.000600$40.50-
Grok 3 MinixAICost-Effective
$0.3000/M in · $0.5000/M out
$0.002000$0.001500$0.000500$60.00-
DeepSeek-V3DeepSeekCost-Effective
$0.2700/M in · $1.1000/M out
$0.002450$0.001350$0.001100$73.50Caching
Gemini 2.5 FlashGoogleCost-Effective
$0.3000/M in · $2.5000/M out
$0.004000$0.001500$0.002500$120.00Caching
Llama 3.1 70BMetaCost-Effective
$0.7200/M in · $0.7200/M out
$0.004320$0.003600$0.000720$129.60-
DeepSeek-R1DeepSeek
$0.5500/M in · $2.1900/M out
$0.004940$0.002750$0.002190$148.20Caching
Claude 3.5 HaikuAnthropicCost-Effective
$0.8000/M in · $4.0000/M out
$0.008000$0.004000$0.004000$240.00Caching
o4-miniOpenAICost-Effective
$1.1000/M in · $4.4000/M out
$0.009900$0.005500$0.004400$297.00Caching
Gemini 1.5 ProGoogle
$1.2500/M in · $5.0000/M out
$0.0112$0.006250$0.005000$337.50Caching
Mistral LargeMistral
$2.0000/M in · $6.0000/M out
$0.0160$0.0100$0.006000$480.00-
Gemini 2.5 ProGoogle
$1.2500/M in · $10.0000/M out
$0.0163$0.006250$0.0100$487.50Caching
o3OpenAI
$2.0000/M in · $8.0000/M out
$0.0180$0.0100$0.008000$540.00Caching
GPT-4oOpenAI Primary
$2.5000/M in · $10.0000/M out
$0.0225$0.0125$0.0100$675.00Caching
Command R+Cohere
$2.5000/M in · $10.0000/M out
$0.0225$0.0125$0.0100$675.00-
Claude 3.7 SonnetAnthropicCapable
$3.0000/M in · $15.0000/M out
$0.0300$0.0150$0.0150$900.00Caching
Grok 3xAI
$3.0000/M in · $15.0000/M out
$0.0300$0.0150$0.0150$900.00-
Llama 3.1 405BMeta
$5.0000/M in · $16.0000/M out
$0.0410$0.0250$0.0160$1,230.00-
GPT-5.5OpenAICapable
$5.0000/M in · $30.0000/M out
$0.0550$0.0250$0.0300$1,650.00Caching
Claude 3 OpusAnthropicCapable
$15.0000/M in · $75.0000/M out
$0.1500$0.0750$0.0750$4,500.00Caching

Click any row to set it as the primary model. 21 models shown.

Pricing Disclaimer: Rates reflect standard Pay-As-You-Go pricing from each provider's published documentation. Actual costs may vary due to regional taxes, volume discounts, promotional credits, or custom enterprise agreements. Cached token rates apply to supported models only. All calculations run locally in your browser - no data is sent to any server.

Как перевести токены в стоимость

Расчёт прост: входные токены умножить на ставку входа, выходные — на ставку выхода, и сложить. Сложность в выборе модели и в том, сколько токенов реально генерирует ваша нагрузка.

Выходные токены в 3–8 раз дороже, поэтому ограничение длины ответов обычно даёт наибольшую экономию.

  • Стоимость = входные токены × ставка входа + выходные токены × ставка выхода.
  • Ставки указываются за миллион токенов.
  • Выберите единицу периода, чтобы увидеть нужный итог.

Кеш промптов и свои модели

Если вы переиспользуете большой стабильный префикс, кеш существенно снижает его стоимость. Укажите кешированные токены, чтобы измерить реальную экономию.

  • Кеш: обычно 10–25 % стандартной ставки входа.
  • Выгоден при системных промптах, фиксированных инструкциях или общем контексте.
  • Добавьте свои цены, чтобы сравнивать приватные или дообученные модели.

Сравнение провайдеров и планирование расходов

Цель — найти самую дешёвую модель, отвечающую вашим требованиям по качеству, а не просто самую дешёвую.

  1. Получите фактическое число входных и выходных токенов на вызов.
  2. Укажите объём запросов и период.
  3. Сравните модели-кандидаты в таблице.
  4. Проверьте месячный и годовой прогноз до фиксации бюджета.

Часто задаваемые вопросы

Он переводит количество токенов в оценку затрат API у провайдеров языковых моделей. Вы вводите объёмы входных и выходных токенов — из своего токенизатора, шаблона промпта или метаданных API — и инструмент мгновенно считает стоимость вызова и прогноз расходов за месяц или год. В отличие от счётчика токенов, который оценивает токены по сырому тексту.

Входные токены — это промпт, отправляемый модели; выходные — сгенерированный ответ. Выходные вычислительно дороже и тарифицируются заметно выше, обычно в 3–8 раз. Для большинства нагрузок сокращение лишних выходных токенов влияет на затраты сильнее, чем экономия входных.

Кеш промптов хранит повторяющийся контент во временном кеше. Последующие запросы с тем же префиксом тарифицируются заметно ниже (обычно 10–25 % стандартной ставки за вход, то есть экономия 75–90 %). Калькулятор позволяет указать число кешированных токенов, чтобы точно смоделировать экономию.

Калькулятор включает более 20 моделей от OpenAI (GPT-5.5, GPT-4o, o3, o4-mini), Anthropic (Claude 3.7 Sonnet, Claude 3.5 Haiku, Claude 3 Opus), Google (Gemini 2.5 Pro/Flash, Gemini 1.5 Pro), xAI (Grok 3, Grok 3 Mini), DeepSeek (V3, R1), Mistral (Large, Small), Cohere (Command R+/R) и Meta (Llama 3.1 70B/405B).

Да. Разверните раздел «Свои цены моделей», чтобы добавить модели со своими ставками за миллион токенов. Они появятся в таблице сравнения рядом с пресетами, позволяя сопоставлять дообученные или приватные модели с хостинговыми API.

Все тарифы отражают стандартные цены «оплата по мере использования» из опубликованной документации провайдеров. Реальные затраты могут отличаться из-за региональных налогов, скидок за объём или корпоративных соглашений. Всегда сверяйтесь с официальной страницей цен провайдера перед решениями о биллинге.

Да. Калькулятор работает на 100 % на стороне клиента, в браузере. Количество токенов, объёмы запросов и оценки затрат рассчитываются локально на вашем устройстве и никогда не передаются на сервер. Данные не покидают браузер, регистрация не нужна.