Калькулятор стоимости OpenAI
Точно оцените и спрогнозируйте затраты на API OpenAI. Выберите актуальные модели вроде GPT-5.5, o3 и GPT-4o, используйте встроенный оценщик токенов для вставленного текста промпта, учтите скидки кеша промптов и сравните структуры цен разных моделей рядом. На 100 % приватно и полностью в браузере.
Estimate standard and cached input/output token pricing, configure Batch discounts, and analyze overall API workloads and model comparisons locally.
Prompt Tokens
Cost Optimizations
Workload Call Volume
Projected Monthly Workload Cost
Cost per Single Call
$0.0550
Input Token Cost
$0.0250
Output Token Cost
$0.0300
Model Pricing Comparisons
Sorted by lowest cost| Model Name | Cost/Call | Monthly Forecast | Optimization Match |
|---|---|---|---|
GPT-4o MiniCost-Effective In: $0.15/M • Out: $0.60/M • Cache: $0.07/M | $0.001350 | $40.50 | Caching Supported |
GPT-5.4 NanoCost-Effective In: $0.20/M • Out: $1.25/M • Cache: $0.02/M | $0.002250 | $67.50 | Caching Supported |
GPT-3.5 Turbo In: $0.50/M • Out: $1.50/M • Cache: $0.50/M | $0.004000 | $120.00 | Caching Supported |
GPT-5.4 MiniCost-Effective In: $0.75/M • Out: $4.50/M • Cache: $0.07/M | $0.008250 | $247.50 | Caching Supported |
o4-miniCost-Effective In: $1.10/M • Out: $4.40/M • Cache: $0.55/M | $0.009900 | $297.00 | Caching Supported |
o3 (Reasoning)Capable In: $2.00/M • Out: $8.00/M • Cache: $1.00/M | $0.0180 | $540.00 | Caching Supported |
GPT-4oCapable In: $2.50/M • Out: $10.00/M • Cache: $1.25/M | $0.0225 | $675.00 | Caching Supported |
GPT-5.4Capable In: $2.50/M • Out: $15.00/M • Cache: $0.25/M | $0.0275 | $825.00 | Caching Supported |
GPT-5.5 (New Flagship)Capable Selected In: $5.00/M • Out: $30.00/M • Cache: $0.50/M | $0.0550 | $1,650.00 | Caching Supported |
GPT-4 Turbo In: $10.00/M • Out: $30.00/M • Cache: $5.00/M | $0.0800 | $2,400.00 | Caching Supported |
GPT-4 (Legacy) In: $30.00/M • Out: $60.00/M • Cache: $30.00/M | $0.2100 | $6,300.00 | Caching Supported |
GPT-5.5 ProCapable In: $30.00/M • Out: $180.00/M • Cache: $15.00/M | $0.3300 | $9,900.00 | Caching Supported |
Что определяет стоимость в API OpenAI
Стоимость зависит от числа запросов, размера входа и выхода каждого из них и выбранной модели. Выходные токены дороже входных.
Модели рассуждений добавляют внутренние токены, которых нет в ответе, но которые тарифицируются.
- Входные, кешированные входные и выходные токены тарифицируются отдельно.
- Скидка Batch API — 50 % на все эти типы.
- Reasoning-токены считаются выходными.
Использование кеша промптов
Если в промпте есть стабильный префикс длиннее 1024 токенов (системные инструкции, фиксированные примеры, контекст документа), кеш существенно снижает его цену.
- Определите фиксированную повторяющуюся часть промпта.
- Измерьте, сколько входных токенов приходится на этот префикс.
- Введите их в поле кешированных токенов, чтобы увидеть экономию.
- Если задержка не критична, дополнительно включите Batch API.
Сравнение моделей и планирование бюджета
Самая дорогая модель не всегда выгоднее: часто она решает задачу меньшим числом токенов. Сравнивайте стоимость за решённую задачу, а не только цену за миллион.
- Используйте сравнение рядом, чтобы увидеть точную месячную разницу.
- Оставляйте reasoning-модели для действительно сложных задач.
- Классификаторам и извлекателям часто хватает меньших моделей.
Часто задаваемые вопросы
Это онлайн-инструмент, который оценивает затраты API при использовании моделей OpenAI вроде GPT-5.5, o3 и GPT-4o. Вводя количество входных, кешированных и выходных токенов, он считает стоимость запроса и прогнозирует расходы за день, месяц и год.
OpenAI автоматически кеширует префиксы промптов длиной от 1024 токенов. Последующие запросы с тем же префиксом (системные инструкции, few-shot примеры) получают скидку 50–90 % на входные токены. Калькулятор позволяет вводить кешированные токены отдельно, чтобы точно оценить эту экономию.
Модели рассуждений (например, o3 и o4-mini) генерируют внутренние токены размышления. Они не возвращаются в выводе API, но тарифицируются по той же цене, что и стандартные выходные токены. Оценку токенов размышления стоит включать в поле выходных токенов этого калькулятора.
Да! Batch API — это эндпоинт OpenAI для нагрузок, не чувствительных ко времени (обработка в течение 24 часов). Запросы через Batch API получают фиксированную скидку 50 % на стандартные, кешированные входные и выходные токены. Включите переключатель Batch API в оценщике, чтобы применить скидку автоматически.
Он даёт близкое приближение на основе стандартных соотношений токенов к словам и символов к токенам (~1,3× для простого английского, ~1,8× для кода/JSON). Для 100 % точности используйте официальную библиотеку tiktoken, но для быстрых прогнозов наш браузерный оценщик вполне подходит.
Нет. Наши инструменты работают на 100 % локально в браузере. Любой текст промпта, вставленный в оценщик, и любые введённые числа обрабатываются локально на вашем устройстве и никогда не отправляются на сервер и не логируются.
Включите флажок «Сравнить с другой моделью» в панели калькулятора. Появится раздел сравнения, где можно выбрать вторую модель (например, GPT-5.5 и GPT-5.4) и увидеть точную разницу месячных затрат и процент экономии.