Pular para o conteúdo
Aback Tools Logo

Calculadora de custo de tokens

Converta grátis e online contagens de tokens em custos de API estimados em mais de 20 modelos. Compare OpenAI, Anthropic, Google, xAI, DeepSeek, Mistral e mais lado a lado. Modele economia de cache de prompts, adicione preços personalizados e projete o gasto mensal — tudo no seu navegador, sem cadastro.

Token Cost Calculator

Enter your input and output token counts to instantly calculate API costs across 20+ models from OpenAI, Anthropic, Google, xAI, DeepSeek, Mistral, Cohere, and Meta. Compare providers side-by-side, add custom pricing, and forecast monthly or annual spending.

Token Counts

tokens
tokens

Workload Volume

reqs

Primary Model

Monthly Cost - GPT-4o

$675.00for 30,000 calls

Cost / Call

$0.0225

Input Cost

$0.0125

Output Cost

$0.0100

Cache Savings

-

In rate: $2.5000/M tokensOut rate: $10.0000/M tokensCache rate: $1.2500/M tokens

Daily

$22.50

1,000 calls

Monthly

$675.00

30,000 calls

Yearly

$8,212.50

365,000 calls

Full Provider Comparison

ModelCost / CallInput CostOutput CostMonthly TotalFeatures
Mistral SmallMistralCost-Effective
$0.1000/M in · $0.3000/M out
$0.000800$0.000500$0.000300$24.00-
GPT-4o miniOpenAICost-Effective
$0.1500/M in · $0.6000/M out
$0.001350$0.000750$0.000600$40.50Caching
Command RCohereCost-Effective
$0.1500/M in · $0.6000/M out
$0.001350$0.000750$0.000600$40.50-
Grok 3 MinixAICost-Effective
$0.3000/M in · $0.5000/M out
$0.002000$0.001500$0.000500$60.00-
DeepSeek-V3DeepSeekCost-Effective
$0.2700/M in · $1.1000/M out
$0.002450$0.001350$0.001100$73.50Caching
Gemini 2.5 FlashGoogleCost-Effective
$0.3000/M in · $2.5000/M out
$0.004000$0.001500$0.002500$120.00Caching
Llama 3.1 70BMetaCost-Effective
$0.7200/M in · $0.7200/M out
$0.004320$0.003600$0.000720$129.60-
DeepSeek-R1DeepSeek
$0.5500/M in · $2.1900/M out
$0.004940$0.002750$0.002190$148.20Caching
Claude 3.5 HaikuAnthropicCost-Effective
$0.8000/M in · $4.0000/M out
$0.008000$0.004000$0.004000$240.00Caching
o4-miniOpenAICost-Effective
$1.1000/M in · $4.4000/M out
$0.009900$0.005500$0.004400$297.00Caching
Gemini 1.5 ProGoogle
$1.2500/M in · $5.0000/M out
$0.0112$0.006250$0.005000$337.50Caching
Mistral LargeMistral
$2.0000/M in · $6.0000/M out
$0.0160$0.0100$0.006000$480.00-
Gemini 2.5 ProGoogle
$1.2500/M in · $10.0000/M out
$0.0163$0.006250$0.0100$487.50Caching
o3OpenAI
$2.0000/M in · $8.0000/M out
$0.0180$0.0100$0.008000$540.00Caching
GPT-4oOpenAI Primary
$2.5000/M in · $10.0000/M out
$0.0225$0.0125$0.0100$675.00Caching
Command R+Cohere
$2.5000/M in · $10.0000/M out
$0.0225$0.0125$0.0100$675.00-
Claude 3.7 SonnetAnthropicCapable
$3.0000/M in · $15.0000/M out
$0.0300$0.0150$0.0150$900.00Caching
Grok 3xAI
$3.0000/M in · $15.0000/M out
$0.0300$0.0150$0.0150$900.00-
Llama 3.1 405BMeta
$5.0000/M in · $16.0000/M out
$0.0410$0.0250$0.0160$1,230.00-
GPT-5.5OpenAICapable
$5.0000/M in · $30.0000/M out
$0.0550$0.0250$0.0300$1,650.00Caching
Claude 3 OpusAnthropicCapable
$15.0000/M in · $75.0000/M out
$0.1500$0.0750$0.0750$4,500.00Caching

Click any row to set it as the primary model. 21 models shown.

Pricing Disclaimer: Rates reflect standard Pay-As-You-Go pricing from each provider's published documentation. Actual costs may vary due to regional taxes, volume discounts, promotional credits, or custom enterprise agreements. Cached token rates apply to supported models only. All calculations run locally in your browser - no data is sent to any server.

Como converter tokens em custo

O cálculo é direto: multiplique os tokens de entrada pela tarifa deles, os de saída pela sua, e some. A dificuldade está em escolher o modelo e saber quantos tokens sua carga realmente gera.

Tokens de saída custam 3 a 8 vezes mais, então controlar o tamanho das respostas costuma dar a maior economia.

  • Custo = tokens de entrada × tarifa de entrada + tokens de saída × tarifa de saída.
  • As tarifas são expressas por milhão de tokens.
  • Escolha a unidade do período para ver o total relevante.

Cache de prompts e modelos personalizados

Se você reutiliza um prefixo grande e estável, o cache reduz muito seu custo. Informe os tokens em cache para medir a economia real.

  • Cache: normalmente 10-25 % da tarifa de entrada padrão.
  • Vantajoso com system prompts, instruções fixas ou contexto compartilhado.
  • Adicione preços personalizados para comparar modelos privados ou ajustados.

Comparar provedores e projetar o gasto

O objetivo é achar o modelo mais barato que atende seu padrão de qualidade, não o mais barato em abstrato.

  1. Obtenha sua contagem real de tokens de entrada e saída por chamada.
  2. Informe o volume de requisições e o período.
  3. Compare os modelos candidatos na tabela.
  4. Revise a previsão mensal e anual antes de comprometer orçamento.

Perguntas frequentes

Ela converte contagens de tokens em custos de API estimados entre provedores de modelos de linguagem. Você informa suas quantidades de tokens de entrada e saída — obtidas do seu tokenizador, template de prompt ou metadados da API — e a ferramenta calcula na hora o custo por chamada e o gasto mensal ou anual projetado. Difere de um contador de tokens, que estima tokens a partir de texto puro.

Tokens de entrada representam o prompt enviado ao modelo; tokens de saída, a resposta gerada. Os de saída são computacionalmente mais caros e cobrados a uma tarifa bem maior — normalmente 3 a 8× a de entrada. Na maioria das cargas, reduzir tokens de saída desnecessários impacta mais o custo do que reduzir os de entrada.

O cache de prompts armazena conteúdo repetitivo em um cache temporário. Requisições seguintes que reutilizam exatamente esse prefixo são cobradas a uma tarifa bem reduzida (normalmente 10-25 % da tarifa de entrada padrão, o que representa 75-90 % de economia). A calculadora permite informar seus tokens em cache para modelar essa economia com precisão.

A calculadora inclui mais de 20 modelos da OpenAI (GPT-5.5, GPT-4o, o3, o4-mini), Anthropic (Claude 3.7 Sonnet, Claude 3.5 Haiku, Claude 3 Opus), Google (Gemini 2.5 Pro/Flash, Gemini 1.5 Pro), xAI (Grok 3, Grok 3 Mini), DeepSeek (V3, R1), Mistral (Large, Small), Cohere (Command R+/R) e Meta (Llama 3.1 70B/405B).

Sim. Expanda a seção «Preços de modelos personalizados» para adicionar modelos com suas próprias tarifas por milhão de tokens. Modelos personalizados aparecem na tabela comparativa junto aos presets, permitindo comparar modelos ajustados ou privados com provedores de API hospedados.

Todas as tarifas refletem preços padrão de pague pelo uso da documentação publicada de cada provedor. Os custos reais podem variar por impostos regionais, descontos por volume ou acordos corporativos personalizados. Sempre verifique na página oficial de preços do provedor antes de decisões de cobrança em produção.

Sim. A calculadora roda 100 % no lado do cliente, no seu navegador. Contagens de tokens, volumes de requisições e estimativas de custo são calculados localmente no seu dispositivo e nunca transmitidos a servidor algum. Nenhum dado sai do navegador e não é preciso cadastro.