Калькулятор стоимости Gemini
Бесплатно оцените расходы на API Gemini по вашему использованию токенов. Поддерживается сравнение моделей (Gemini 1.5, 2.5, 3.x), скидки за кеширование контекста и прогнозы на месяц. Быстро, безопасно и полностью приватно.
Estimate input/output token pricing, compare legacy and active model tiers, configure context caching discounts, and analyze overall monthly API forecasts locally.
Prompt Tokens
Cost Optimizations
Workload Call Volume
Projected Monthly Workload Cost
Cost per Single Call
$0.0165
Input Token Cost
$0.007500
Output Token Cost
$0.009000
Model Pricing Comparisons
Sorted by lowest cost| Model Name | Cost/Call | Monthly Forecast | Optimization Match |
|---|---|---|---|
Gemini 1.5 Flash-8B (Legacy) In: $0.04/M • Out: $0.15/M • Cache: $0.01/M | $0.000338 | $10.13 | Caching Supported |
Gemini 1.5 Flash (Legacy) In: $0.07/M • Out: $0.30/M • Cache: $0.02/M | $0.000675 | $20.25 | Caching Supported |
Gemini 3.1 Flash-Lite In: $0.25/M • Out: $1.50/M • Cache: $0.06/M | $0.002750 | $82.50 | Std. Caching |
Gemini 2.5 Flash In: $0.30/M • Out: $2.50/M • Cache: $0.07/M | $0.004000 | $120.00 | Std. Caching |
Gemini 1.0 Pro (Legacy) In: $0.50/M • Out: $1.50/M • Cache: $0.13/M | $0.004000 | $120.00 | Std. Caching |
Gemini 3 Flash (Preview) In: $0.50/M • Out: $3.00/M • Cache: $0.13/M | $0.005500 | $165.00 | Std. Caching |
Gemini 1.5 Pro (Legacy) In: $1.25/M • Out: $5.00/M • Cache: $0.31/M | $0.0112 | $337.50 | Caching Supported |
Gemini 2.5 Pro In: $1.25/M • Out: $10.00/M • Cache: $0.31/M | $0.0163 | $487.50 | Std. Caching |
Gemini 3.5 FlashCost-Effective Selected In: $1.50/M • Out: $9.00/M • Cache: $0.38/M | $0.0165 | $495.00 | Std. Caching |
Gemini 3.1 Pro (Preview)Capable In: $2.00/M • Out: $12.00/M • Cache: $0.50/M | $0.0220 | $660.00 | Std. Caching |
Из чего складывается счёт Gemini
В Gemini цена зависит от модели, соотношения входных и выходных токенов и — в мультимодальном режиме — от объёма медиа, пересчитанного в эквивалентные токены.
Укажите текстовые токены, число изображений, секунды аудио и видео и объём запросов, чтобы увидеть стоимость запроса и месячный прогноз.
- Выходные токены в 3–8 раз дороже входных.
- Изображения тарифицируются примерно по 258 токенов каждое.
- Каждая секунда видео — около 258 токенов, поэтому длинные клипы быстро дорожают.
Кеширование контекста и Batch API
Оба снижают цену, но требуют разных условий. Кеш нуждается в повторяющемся контенте, Batch — в готовности ждать до 24 часов.
- Кеширование контекста: до 75 % дешевле для повторно используемых входных токенов.
- Batch API: скидка 50 %, когда ответ в реальном времени не нужен.
- Их можно сочетать, если один и тот же длинный контекст используется в пакетных процессах.
Сравнение моделей семейства Gemini
Семейство покрывает от недорогих массовых задач до рассуждений с очень длинным контекстом. Выбор модели сильнее всего влияет на счёт.
- Измерьте реальные токены типичного запроса, включая медиа.
- Рассчитайте стоимость запроса на текущей модели.
- Сравните с другими вариантами Gemini при той же нагрузке.
- Включите кеш или Batch, если это подходит, и проверьте итоговый прогноз.
Часто задаваемые вопросы
Это инструмент, который оценивает цену API Google Gemini по вашим входным и выходным токенам, объёму запросов и конфигурации моделей. Он помогает разработчикам планировать бюджет и выбирать самую выгодную модель Gemini. Работает полностью в браузере без регистрации.
Калькулятор использует стандартные тарифы Pay-As-You-Go из официальной документации Google AI Studio и Vertex AI. Реальные расходы могут отличаться из-за региональных налоговых правил, промокредитов, индивидуальных тарифов или обновлений цен Google. Всегда проверяйте официальную страницу цен для точных ставок.
Входные токены — текст или медиа в вашем промпте. Выходные — сгенерированный моделью ответ. Их создание вычислительно дороже, поэтому на всех моделях Gemini они тарифицируются заметно выше (обычно в 3–8 раз), чем входные.
Кеширование контекста хранит большие повторяющиеся блоки (длинную кодовую базу, книгу, длинные системные инструкции) в кеше Google. При запросе модель читает кеш вместо повторной обработки всего промпта. Кэшированные входные токены тарифицируются со скидкой — обычно на 75 % дешевле стандартных входных.
Batch API от Google предназначена для нагрузок, нечувствительных к задержке (массовый перевод, офлайн-индексация, суммаризация). Пакетные запросы обрабатываются в фоне в течение 24 часов вместо реального времени. Использование даёт автоматическую скидку 50 % на все входные и выходные токены.
Gemini — нативная мультимодальная модель, она тарифицирует медиа, переводя их в эквивалентное число токенов. Текст токенизируется стандартно. Изображения обычно стоят 258 токенов каждое. Аудио — 32 токена в секунду, видео — 258 токенов в секунду. Калькулятор позволяет указать количество и длительность, чтобы оценить эти расходы автоматически.
Нет. Калькулятор работает полностью на стороне клиента, в браузере. Введённые данные, размеры токенов, оценки затрат и результаты сравнения обрабатываются локально на вашем устройстве и никогда не отправляются на сервер. Данные остаются на 100 % приватными.