Calculadora de custos do Claude
Estime gratuitamente online os custos da API Anthropic Claude. Suporta escolha de modelo, estimativa de tokens, cache de prompts, descontos da Batch API e projeções mensais e anuais. Compare custos lado a lado entre todos os modelos Claude (incluindo Claude 3.5, Opus, Sonnet, Haiku e os níveis de nova geração Claude 5) para encontrar o melhor equilíbrio entre velocidade, capacidade e orçamento. Sem cadastro — os cálculos rodam localmente no seu navegador.
Estimate standard and cached input/output token pricing, configure Batch discounts, and analyze overall API workloads and model comparisons locally.
Prompt Tokens
Cost Optimizations
Workload Call Volume
Projected Monthly Workload Cost
Cost per Single Call
$0.0300
Input Token Cost
$0.0150
Output Token Cost
$0.0150
Model Pricing Comparisons
Sorted by lowest cost| Model Name | Cost/Call | Monthly Forecast | Optimization Match |
|---|---|---|---|
Claude 3 Haiku In: $0.25/M • Out: $1.25/M • Cache: $0.03/M | $0.002500 | $75.00 | Caching Supported |
Claude Haiku 4.5Cost-Effective In: $1.00/M • Out: $5.00/M • Cache: $0.10/M | $0.0100 | $300.00 | Caching Supported |
Claude 3.5 HaikuCost-Effective In: $1.00/M • Out: $5.00/M • Cache: $0.10/M | $0.0100 | $300.00 | Caching Supported |
Claude Sonnet 4.6Capable In: $3.00/M • Out: $15.00/M • Cache: $0.30/M | $0.0300 | $900.00 | Caching Supported |
Claude 3.5 SonnetCapable Selected In: $3.00/M • Out: $15.00/M • Cache: $0.30/M | $0.0300 | $900.00 | Caching Supported |
Claude 3 Sonnet In: $3.00/M • Out: $15.00/M • Cache: $0.30/M | $0.0300 | $900.00 | Caching Supported |
Claude Opus 4.8Capable In: $5.00/M • Out: $25.00/M • Cache: $0.50/M | $0.0500 | $1,500.00 | Caching Supported |
Claude Fable 5Capable In: $10.00/M • Out: $50.00/M • Cache: $1.00/M | $0.1000 | $3,000.00 | Caching Supported |
Claude 3 Opus In: $15.00/M • Out: $75.00/M • Cache: $1.50/M | $0.1500 | $4,500.00 | Caching Supported |
Entender a estrutura de custos do Claude
O custo do Claude depende de três variáveis: o modelo escolhido, a proporção entre tokens de entrada e saída e o volume de consultas. Tokens de saída costumam custar de 3 a 5 vezes mais que os de entrada, então o tamanho das respostas domina a fatura.
Informe tokens de entrada e saída por consulta, volume mensal e modelo para ver a projeção e comparar alternativas.
- Tokens de saída dominam o custo por consulta: controlar o tamanho das respostas é a alavanca mais eficaz.
- O cache de prompts pode reduzir até 90 % do custo dos tokens de entrada reutilizados.
- A Batch API aplica 50 % de desconto fixo quando resposta em tempo real não é necessária.
Quando cada economia compensa
Cache e Batch nem sempre ajudam. O cache exige prompts longos e repetidos; o Batch exige tolerar 24 horas de latência.
- Cache: útil com prompts de sistema longos e estáveis repetidos em cada consulta.
- Batch: útil em processamento em massa, avaliações e tarefas que podem esperar.
- Nenhum dos dois reduz o custo de um prompt curto e único.
Orçar com margem de segurança
As estimativas valem o que valem suas premissas de tokens. Meça uma amostra real antes de extrapolar para todo o volume.
- Meça os tokens de entrada e saída reais em uma amostra representativa de consultas.
- Informe o volume mensal previsto e selecione o modelo.
- Ative cache ou Batch se seu padrão de uso permitir e compare o cenário otimizado.
- Adicione margem de 20-30 % para variações de tamanho e crescimento do uso.
Perguntas frequentes
É uma ferramenta criada para estimar os custos de uso da API Anthropic Claude. Informando tokens de entrada/prompt, tokens de saída/completude, volume de consultas e escolhendo um modelo, desenvolvedores e fundadores de SaaS conseguem projetar o gasto mensal e anual e comparar custos entre modelos.
O cache de prompts reduz drasticamente os custos (em até 90 %) dos tokens de entrada reutilizados em várias consultas. Ao ativá-lo, apenas os tokens não cacheados são cobrados à tarifa padrão; os cacheados são cobrados a uma tarifa de leitura bem menor. Por exemplo, no Claude 3.5 Sonnet, leituras cacheadas custam US$ 0,30/M tokens contra US$ 3,00/M tokens na tarifa padrão.
O cache de prompts exige prompt com no mínimo 10.000 tokens no Claude 3.5 Sonnet e Claude 3 Opus, e 20.000 tokens no Claude 3.5 Haiku. Prompts mais curtos não podem ser cacheados e serão sempre cobrados às tarifas padrão de entrada.
A Batch API permite enviar lotes de requisições processadas de forma assíncrona em até 24 horas, em vez de em tempo real. Em troca desse prazo, a Anthropic oferece 50 % de desconto fixo em tokens de entrada e saída em todos os modelos. Ative a opção Batch API na nossa calculadora para aplicar o desconto.
Como regra geral, 1 token equivale a cerca de 4 caracteres de texto em inglês, ou aproximadamente 0,75 palavra. Assim, 100 palavras são cerca de 133 tokens e 1.000 palavras, cerca de 1.333 tokens. Tokens de saída variam conforme a complexidade da resposta e a formatação (como código ou tags JSON, que consomem mais tokens).
Sim, o preço base dos modelos Claude hospedados na Amazon Bedrock ou no Google Vertex AI costuma ser idêntico às tarifas diretas da Anthropic. No entanto, podem incidir sobretaxas regionais ou descontos corporativos personalizados do seu provedor de nuvem. Use a calculadora como estimativa de referência.
Sim, totalmente. A calculadora roda inteiramente no seu navegador com JavaScript. Nenhum número de tokens, volume de requisições ou dado de projeto é enviado a servidor externo nem salvo. Seus cálculos são completamente privados.