Pular para o conteúdo
Aback Tools Logo

Calculadora de custos do Gemini

Estime gratuitamente os gastos da API Gemini com base no seu uso de tokens. Suporta comparação de modelos (Gemini 1.5, 2.5, 3.x), descontos de cache de contexto e previsões mensais. Rápido, seguro e totalmente privado.

Gemini Cost Calculator

Estimate input/output token pricing, compare legacy and active model tiers, configure context caching discounts, and analyze overall monthly API forecasts locally.

Input/1M: $1.50Output/1M: $9.00Cache/1M: $0.38

Prompt Tokens

tokens
tokens

Cost Optimizations

Workload Call Volume

reqs

Projected Monthly Workload Cost

$495.00for 30,000 total requests

Cost per Single Call

$0.0165

Input Token Cost

$0.007500

Output Token Cost

$0.009000

Model Pricing Comparisons

Sorted by lowest cost
Model NameCost/CallMonthly ForecastOptimization Match
Gemini 1.5 Flash-8B (Legacy)
In: $0.04/M • Out: $0.15/M • Cache: $0.01/M
$0.000338$10.13Caching Supported
Gemini 1.5 Flash (Legacy)
In: $0.07/M • Out: $0.30/M • Cache: $0.02/M
$0.000675$20.25Caching Supported
Gemini 3.1 Flash-Lite
In: $0.25/M • Out: $1.50/M • Cache: $0.06/M
$0.002750$82.50Std. Caching
Gemini 2.5 Flash
In: $0.30/M • Out: $2.50/M • Cache: $0.07/M
$0.004000$120.00Std. Caching
Gemini 1.0 Pro (Legacy)
In: $0.50/M • Out: $1.50/M • Cache: $0.13/M
$0.004000$120.00Std. Caching
Gemini 3 Flash (Preview)
In: $0.50/M • Out: $3.00/M • Cache: $0.13/M
$0.005500$165.00Std. Caching
Gemini 1.5 Pro (Legacy)
In: $1.25/M • Out: $5.00/M • Cache: $0.31/M
$0.0112$337.50Caching Supported
Gemini 2.5 Pro
In: $1.25/M • Out: $10.00/M • Cache: $0.31/M
$0.0163$487.50Std. Caching
Gemini 3.5 FlashCost-Effective Selected
In: $1.50/M • Out: $9.00/M • Cache: $0.38/M
$0.0165$495.00Std. Caching
Gemini 3.1 Pro (Preview)Capable
In: $2.00/M • Out: $12.00/M • Cache: $0.50/M
$0.0220$660.00Std. Caching
Calculations Disclaimer: Estimations are computed based on standard per-token pricing sheets. Real-world API expenses may deviate slightly due to tokenization rounding differences (Word count to Token conversion ratio varies by content text), Google Cloud tax schedules, or custom SLA pricing. Context Caching rates apply standardly at a 75% input tokens discount.

O que compõe a fatura do Gemini

No Gemini o custo depende do modelo, da proporção entre tokens de entrada e saída e, no multimodal, de quanto mídia você envia convertida em tokens equivalentes.

Informe tokens de texto, número de imagens, segundos de áudio e vídeo e o volume de consultas para ver o custo por consulta e a previsão mensal.

  • Tokens de saída custam de 3 a 8 vezes mais que os de entrada.
  • Imagens são cobradas em torno de 258 tokens cada.
  • Cada segundo de vídeo equivale a cerca de 258 tokens, então clipes longos encarecem rápido.

Cache de contexto e Batch API

Ambos reduzem o preço, mas exigem condições diferentes. O cache requer conteúdo repetido; o Batch exige tolerar 24 horas de latência.

  • Cache de contexto: até 75 % mais barato nos tokens de entrada reutilizados.
  • Batch API: 50 % de desconto quando resposta em tempo real não é necessária.
  • Combine os dois quando o mesmo contexto longo é reutilizado em processos em lote.

Comparar modelos da família Gemini

A família cobre de alto volume e baixo custo até raciocínio com contextos muito longos. A escolha do modelo é a alavanca que mais move a fatura.

  1. Meça os tokens reais de uma consulta representativa, incluindo mídia.
  2. Calcule o custo por consulta com o modelo que você usa hoje.
  3. Compare com outras variantes Gemini mantendo a mesma carga de trabalho.
  4. Ative cache ou Batch se encaixar no seu padrão de uso e revise a previsão final.

Perguntas frequentes

É uma ferramenta que estima o preço da API Google Gemini com base nos seus tokens de entrada e saída, volumes de consultas e configurações de modelo. Ajuda desenvolvedores a planejar orçamentos e escolher o modelo Gemini mais econômico para sua carga. Roda totalmente no seu navegador, sem cadastro.

A calculadora usa as tarifas padrão de Pay-As-You-Go da documentação oficial do Google AI Studio e do Vertex AI. Ainda assim, custos reais podem variar conforme políticas tributárias regionais, créditos promocionais, planos de preço personalizados ou atualizações de preço do Google. Consulte sempre a página oficial de preços para tarifas definitivas.

Tokens de entrada representam o texto ou mídia que você envia no prompt. Tokens de saída representam o texto da resposta gerada pelo modelo. Gerá-los custa mais computacionalmente, então são cobrados bem mais caro (normalmente de 3 a 8 vezes) que os tokens de entrada em todos os modelos Gemini.

O cache de contexto permite armazenar grandes blocos repetitivos (como um código-fonte extenso, um livro ou instruções de sistema longas) no cache do Google. Ao consultar o modelo, ele lê do cache em vez de reprocessar todo o prompt. Tokens de entrada em cache recebem desconto enorme (em geral 75 % mais baratos que os tokens de entrada padrão).

A Batch API do Google é feita para cargas não sensíveis a latência (tradução em massa, indexação offline, resumo). Em vez de rodar em tempo real, as requisições em lote são processadas em segundo plano em até 24 horas. Usá-la garante 50 % de desconto automático em todos os custos de tokens de entrada e saída.

O Gemini é um modelo multimodal nativo e cobra mídia convertendo-a em contagens equivalentes de tokens. Texto é tokenizado normalmente. Imagens geralmente são cobradas a 258 tokens cada. Áudio é cobrado a 32 tokens por segundo e vídeo a 258 tokens por segundo. A calculadora permite informar quantidades e durações para estimar esses custos automaticamente.

Não. A calculadora roda inteiramente no lado do cliente, no seu navegador. Entradas, tamanhos de tokens, custos estimados e resultados de comparação são processados localmente no seu dispositivo e nunca enviados a servidor algum. Seus dados permanecem 100 % privados e seguros.