Calculadora de custo de tokens
Converta grátis e online contagens de tokens em custos de API estimados em mais de 20 modelos. Compare OpenAI, Anthropic, Google, xAI, DeepSeek, Mistral e mais lado a lado. Modele economia de cache de prompts, adicione preços personalizados e projete o gasto mensal — tudo no seu navegador, sem cadastro.
Enter your input and output token counts to instantly calculate API costs across 20+ models from OpenAI, Anthropic, Google, xAI, DeepSeek, Mistral, Cohere, and Meta. Compare providers side-by-side, add custom pricing, and forecast monthly or annual spending.
Token Counts
Workload Volume
Primary Model
Monthly Cost - GPT-4o
Cost / Call
$0.0225
Input Cost
$0.0125
Output Cost
$0.0100
Cache Savings
-
Daily
$22.50
1,000 calls
Monthly
$675.00
30,000 calls
Yearly
$8,212.50
365,000 calls
Full Provider Comparison
| Model | Cost / Call | Input Cost | Output Cost | Monthly Total | Features |
|---|---|---|---|---|---|
Mistral SmallMistralCost-Effective $0.1000/M in · $0.3000/M out | $0.000800 | $0.000500 | $0.000300 | $24.00 | - |
GPT-4o miniOpenAICost-Effective $0.1500/M in · $0.6000/M out | $0.001350 | $0.000750 | $0.000600 | $40.50 | Caching |
Command RCohereCost-Effective $0.1500/M in · $0.6000/M out | $0.001350 | $0.000750 | $0.000600 | $40.50 | - |
Grok 3 MinixAICost-Effective $0.3000/M in · $0.5000/M out | $0.002000 | $0.001500 | $0.000500 | $60.00 | - |
DeepSeek-V3DeepSeekCost-Effective $0.2700/M in · $1.1000/M out | $0.002450 | $0.001350 | $0.001100 | $73.50 | Caching |
Gemini 2.5 FlashGoogleCost-Effective $0.3000/M in · $2.5000/M out | $0.004000 | $0.001500 | $0.002500 | $120.00 | Caching |
Llama 3.1 70BMetaCost-Effective $0.7200/M in · $0.7200/M out | $0.004320 | $0.003600 | $0.000720 | $129.60 | - |
DeepSeek-R1DeepSeek $0.5500/M in · $2.1900/M out | $0.004940 | $0.002750 | $0.002190 | $148.20 | Caching |
Claude 3.5 HaikuAnthropicCost-Effective $0.8000/M in · $4.0000/M out | $0.008000 | $0.004000 | $0.004000 | $240.00 | Caching |
o4-miniOpenAICost-Effective $1.1000/M in · $4.4000/M out | $0.009900 | $0.005500 | $0.004400 | $297.00 | Caching |
Gemini 1.5 ProGoogle $1.2500/M in · $5.0000/M out | $0.0112 | $0.006250 | $0.005000 | $337.50 | Caching |
Mistral LargeMistral $2.0000/M in · $6.0000/M out | $0.0160 | $0.0100 | $0.006000 | $480.00 | - |
Gemini 2.5 ProGoogle $1.2500/M in · $10.0000/M out | $0.0163 | $0.006250 | $0.0100 | $487.50 | Caching |
o3OpenAI $2.0000/M in · $8.0000/M out | $0.0180 | $0.0100 | $0.008000 | $540.00 | Caching |
GPT-4oOpenAI Primary $2.5000/M in · $10.0000/M out | $0.0225 | $0.0125 | $0.0100 | $675.00 | Caching |
Command R+Cohere $2.5000/M in · $10.0000/M out | $0.0225 | $0.0125 | $0.0100 | $675.00 | - |
Claude 3.7 SonnetAnthropicCapable $3.0000/M in · $15.0000/M out | $0.0300 | $0.0150 | $0.0150 | $900.00 | Caching |
Grok 3xAI $3.0000/M in · $15.0000/M out | $0.0300 | $0.0150 | $0.0150 | $900.00 | - |
Llama 3.1 405BMeta $5.0000/M in · $16.0000/M out | $0.0410 | $0.0250 | $0.0160 | $1,230.00 | - |
GPT-5.5OpenAICapable $5.0000/M in · $30.0000/M out | $0.0550 | $0.0250 | $0.0300 | $1,650.00 | Caching |
Claude 3 OpusAnthropicCapable $15.0000/M in · $75.0000/M out | $0.1500 | $0.0750 | $0.0750 | $4,500.00 | Caching |
Click any row to set it as the primary model. 21 models shown.
Como converter tokens em custo
O cálculo é direto: multiplique os tokens de entrada pela tarifa deles, os de saída pela sua, e some. A dificuldade está em escolher o modelo e saber quantos tokens sua carga realmente gera.
Tokens de saída custam 3 a 8 vezes mais, então controlar o tamanho das respostas costuma dar a maior economia.
- Custo = tokens de entrada × tarifa de entrada + tokens de saída × tarifa de saída.
- As tarifas são expressas por milhão de tokens.
- Escolha a unidade do período para ver o total relevante.
Cache de prompts e modelos personalizados
Se você reutiliza um prefixo grande e estável, o cache reduz muito seu custo. Informe os tokens em cache para medir a economia real.
- Cache: normalmente 10-25 % da tarifa de entrada padrão.
- Vantajoso com system prompts, instruções fixas ou contexto compartilhado.
- Adicione preços personalizados para comparar modelos privados ou ajustados.
Comparar provedores e projetar o gasto
O objetivo é achar o modelo mais barato que atende seu padrão de qualidade, não o mais barato em abstrato.
- Obtenha sua contagem real de tokens de entrada e saída por chamada.
- Informe o volume de requisições e o período.
- Compare os modelos candidatos na tabela.
- Revise a previsão mensal e anual antes de comprometer orçamento.
Perguntas frequentes
Ela converte contagens de tokens em custos de API estimados entre provedores de modelos de linguagem. Você informa suas quantidades de tokens de entrada e saída — obtidas do seu tokenizador, template de prompt ou metadados da API — e a ferramenta calcula na hora o custo por chamada e o gasto mensal ou anual projetado. Difere de um contador de tokens, que estima tokens a partir de texto puro.
Tokens de entrada representam o prompt enviado ao modelo; tokens de saída, a resposta gerada. Os de saída são computacionalmente mais caros e cobrados a uma tarifa bem maior — normalmente 3 a 8× a de entrada. Na maioria das cargas, reduzir tokens de saída desnecessários impacta mais o custo do que reduzir os de entrada.
O cache de prompts armazena conteúdo repetitivo em um cache temporário. Requisições seguintes que reutilizam exatamente esse prefixo são cobradas a uma tarifa bem reduzida (normalmente 10-25 % da tarifa de entrada padrão, o que representa 75-90 % de economia). A calculadora permite informar seus tokens em cache para modelar essa economia com precisão.
A calculadora inclui mais de 20 modelos da OpenAI (GPT-5.5, GPT-4o, o3, o4-mini), Anthropic (Claude 3.7 Sonnet, Claude 3.5 Haiku, Claude 3 Opus), Google (Gemini 2.5 Pro/Flash, Gemini 1.5 Pro), xAI (Grok 3, Grok 3 Mini), DeepSeek (V3, R1), Mistral (Large, Small), Cohere (Command R+/R) e Meta (Llama 3.1 70B/405B).
Sim. Expanda a seção «Preços de modelos personalizados» para adicionar modelos com suas próprias tarifas por milhão de tokens. Modelos personalizados aparecem na tabela comparativa junto aos presets, permitindo comparar modelos ajustados ou privados com provedores de API hospedados.
Todas as tarifas refletem preços padrão de pague pelo uso da documentação publicada de cada provedor. Os custos reais podem variar por impostos regionais, descontos por volume ou acordos corporativos personalizados. Sempre verifique na página oficial de preços do provedor antes de decisões de cobrança em produção.
Sim. A calculadora roda 100 % no lado do cliente, no seu navegador. Contagens de tokens, volumes de requisições e estimativas de custo são calculados localmente no seu dispositivo e nunca transmitidos a servidor algum. Nenhum dado sai do navegador e não é preciso cadastro.