Calculadora de custos do Gemini
Estime gratuitamente os gastos da API Gemini com base no seu uso de tokens. Suporta comparação de modelos (Gemini 1.5, 2.5, 3.x), descontos de cache de contexto e previsões mensais. Rápido, seguro e totalmente privado.
Estimate input/output token pricing, compare legacy and active model tiers, configure context caching discounts, and analyze overall monthly API forecasts locally.
Prompt Tokens
Cost Optimizations
Workload Call Volume
Projected Monthly Workload Cost
Cost per Single Call
$0.0165
Input Token Cost
$0.007500
Output Token Cost
$0.009000
Model Pricing Comparisons
Sorted by lowest cost| Model Name | Cost/Call | Monthly Forecast | Optimization Match |
|---|---|---|---|
Gemini 1.5 Flash-8B (Legacy) In: $0.04/M • Out: $0.15/M • Cache: $0.01/M | $0.000338 | $10.13 | Caching Supported |
Gemini 1.5 Flash (Legacy) In: $0.07/M • Out: $0.30/M • Cache: $0.02/M | $0.000675 | $20.25 | Caching Supported |
Gemini 3.1 Flash-Lite In: $0.25/M • Out: $1.50/M • Cache: $0.06/M | $0.002750 | $82.50 | Std. Caching |
Gemini 2.5 Flash In: $0.30/M • Out: $2.50/M • Cache: $0.07/M | $0.004000 | $120.00 | Std. Caching |
Gemini 1.0 Pro (Legacy) In: $0.50/M • Out: $1.50/M • Cache: $0.13/M | $0.004000 | $120.00 | Std. Caching |
Gemini 3 Flash (Preview) In: $0.50/M • Out: $3.00/M • Cache: $0.13/M | $0.005500 | $165.00 | Std. Caching |
Gemini 1.5 Pro (Legacy) In: $1.25/M • Out: $5.00/M • Cache: $0.31/M | $0.0112 | $337.50 | Caching Supported |
Gemini 2.5 Pro In: $1.25/M • Out: $10.00/M • Cache: $0.31/M | $0.0163 | $487.50 | Std. Caching |
Gemini 3.5 FlashCost-Effective Selected In: $1.50/M • Out: $9.00/M • Cache: $0.38/M | $0.0165 | $495.00 | Std. Caching |
Gemini 3.1 Pro (Preview)Capable In: $2.00/M • Out: $12.00/M • Cache: $0.50/M | $0.0220 | $660.00 | Std. Caching |
O que compõe a fatura do Gemini
No Gemini o custo depende do modelo, da proporção entre tokens de entrada e saída e, no multimodal, de quanto mídia você envia convertida em tokens equivalentes.
Informe tokens de texto, número de imagens, segundos de áudio e vídeo e o volume de consultas para ver o custo por consulta e a previsão mensal.
- Tokens de saída custam de 3 a 8 vezes mais que os de entrada.
- Imagens são cobradas em torno de 258 tokens cada.
- Cada segundo de vídeo equivale a cerca de 258 tokens, então clipes longos encarecem rápido.
Cache de contexto e Batch API
Ambos reduzem o preço, mas exigem condições diferentes. O cache requer conteúdo repetido; o Batch exige tolerar 24 horas de latência.
- Cache de contexto: até 75 % mais barato nos tokens de entrada reutilizados.
- Batch API: 50 % de desconto quando resposta em tempo real não é necessária.
- Combine os dois quando o mesmo contexto longo é reutilizado em processos em lote.
Comparar modelos da família Gemini
A família cobre de alto volume e baixo custo até raciocínio com contextos muito longos. A escolha do modelo é a alavanca que mais move a fatura.
- Meça os tokens reais de uma consulta representativa, incluindo mídia.
- Calcule o custo por consulta com o modelo que você usa hoje.
- Compare com outras variantes Gemini mantendo a mesma carga de trabalho.
- Ative cache ou Batch se encaixar no seu padrão de uso e revise a previsão final.
Perguntas frequentes
É uma ferramenta que estima o preço da API Google Gemini com base nos seus tokens de entrada e saída, volumes de consultas e configurações de modelo. Ajuda desenvolvedores a planejar orçamentos e escolher o modelo Gemini mais econômico para sua carga. Roda totalmente no seu navegador, sem cadastro.
A calculadora usa as tarifas padrão de Pay-As-You-Go da documentação oficial do Google AI Studio e do Vertex AI. Ainda assim, custos reais podem variar conforme políticas tributárias regionais, créditos promocionais, planos de preço personalizados ou atualizações de preço do Google. Consulte sempre a página oficial de preços para tarifas definitivas.
Tokens de entrada representam o texto ou mídia que você envia no prompt. Tokens de saída representam o texto da resposta gerada pelo modelo. Gerá-los custa mais computacionalmente, então são cobrados bem mais caro (normalmente de 3 a 8 vezes) que os tokens de entrada em todos os modelos Gemini.
O cache de contexto permite armazenar grandes blocos repetitivos (como um código-fonte extenso, um livro ou instruções de sistema longas) no cache do Google. Ao consultar o modelo, ele lê do cache em vez de reprocessar todo o prompt. Tokens de entrada em cache recebem desconto enorme (em geral 75 % mais baratos que os tokens de entrada padrão).
A Batch API do Google é feita para cargas não sensíveis a latência (tradução em massa, indexação offline, resumo). Em vez de rodar em tempo real, as requisições em lote são processadas em segundo plano em até 24 horas. Usá-la garante 50 % de desconto automático em todos os custos de tokens de entrada e saída.
O Gemini é um modelo multimodal nativo e cobra mídia convertendo-a em contagens equivalentes de tokens. Texto é tokenizado normalmente. Imagens geralmente são cobradas a 258 tokens cada. Áudio é cobrado a 32 tokens por segundo e vídeo a 258 tokens por segundo. A calculadora permite informar quantidades e durações para estimar esses custos automaticamente.
Não. A calculadora roda inteiramente no lado do cliente, no seu navegador. Entradas, tamanhos de tokens, custos estimados e resultados de comparação são processados localmente no seu dispositivo e nunca enviados a servidor algum. Seus dados permanecem 100 % privados e seguros.