Pular para o conteúdo
Aback Tools Logo

Calculadora de custos do Claude

Estime gratuitamente online os custos da API Anthropic Claude. Suporta escolha de modelo, estimativa de tokens, cache de prompts, descontos da Batch API e projeções mensais e anuais. Compare custos lado a lado entre todos os modelos Claude (incluindo Claude 3.5, Opus, Sonnet, Haiku e os níveis de nova geração Claude 5) para encontrar o melhor equilíbrio entre velocidade, capacidade e orçamento. Sem cadastro — os cálculos rodam localmente no seu navegador.

Claude Cost Calculator

Estimate standard and cached input/output token pricing, configure Batch discounts, and analyze overall API workloads and model comparisons locally.

Input/1M: $3.00Output/1M: $15.00Cache/1M: $0.30

Prompt Tokens

tokens
tokens

Cost Optimizations

Workload Call Volume

reqs

Projected Monthly Workload Cost

$900.00for 30,000 total requests

Cost per Single Call

$0.0300

Input Token Cost

$0.0150

Output Token Cost

$0.0150

Model Pricing Comparisons

Sorted by lowest cost
Model NameCost/CallMonthly ForecastOptimization Match
Claude 3 Haiku
In: $0.25/M • Out: $1.25/M • Cache: $0.03/M
$0.002500$75.00Caching Supported
Claude Haiku 4.5Cost-Effective
In: $1.00/M • Out: $5.00/M • Cache: $0.10/M
$0.0100$300.00Caching Supported
Claude 3.5 HaikuCost-Effective
In: $1.00/M • Out: $5.00/M • Cache: $0.10/M
$0.0100$300.00Caching Supported
Claude Sonnet 4.6Capable
In: $3.00/M • Out: $15.00/M • Cache: $0.30/M
$0.0300$900.00Caching Supported
Claude 3.5 SonnetCapable Selected
In: $3.00/M • Out: $15.00/M • Cache: $0.30/M
$0.0300$900.00Caching Supported
Claude 3 Sonnet
In: $3.00/M • Out: $15.00/M • Cache: $0.30/M
$0.0300$900.00Caching Supported
Claude Opus 4.8Capable
In: $5.00/M • Out: $25.00/M • Cache: $0.50/M
$0.0500$1,500.00Caching Supported
Claude Fable 5Capable
In: $10.00/M • Out: $50.00/M • Cache: $1.00/M
$0.1000$3,000.00Caching Supported
Claude 3 Opus
In: $15.00/M • Out: $75.00/M • Cache: $1.50/M
$0.1500$4,500.00Caching Supported
Calculations Disclaimer: Estimations are computed based on standard Anthropic Claude per-token pricing sheets. Real-world API expenses may deviate slightly due to tokenization rounding differences (Word count to Token conversion ratio varies by text content), regional tax schedules, or custom SLA pricing. Context caching read rates apply standardly at a 90% input read discount.

Entender a estrutura de custos do Claude

O custo do Claude depende de três variáveis: o modelo escolhido, a proporção entre tokens de entrada e saída e o volume de consultas. Tokens de saída costumam custar de 3 a 5 vezes mais que os de entrada, então o tamanho das respostas domina a fatura.

Informe tokens de entrada e saída por consulta, volume mensal e modelo para ver a projeção e comparar alternativas.

  • Tokens de saída dominam o custo por consulta: controlar o tamanho das respostas é a alavanca mais eficaz.
  • O cache de prompts pode reduzir até 90 % do custo dos tokens de entrada reutilizados.
  • A Batch API aplica 50 % de desconto fixo quando resposta em tempo real não é necessária.

Quando cada economia compensa

Cache e Batch nem sempre ajudam. O cache exige prompts longos e repetidos; o Batch exige tolerar 24 horas de latência.

  • Cache: útil com prompts de sistema longos e estáveis repetidos em cada consulta.
  • Batch: útil em processamento em massa, avaliações e tarefas que podem esperar.
  • Nenhum dos dois reduz o custo de um prompt curto e único.

Orçar com margem de segurança

As estimativas valem o que valem suas premissas de tokens. Meça uma amostra real antes de extrapolar para todo o volume.

  1. Meça os tokens de entrada e saída reais em uma amostra representativa de consultas.
  2. Informe o volume mensal previsto e selecione o modelo.
  3. Ative cache ou Batch se seu padrão de uso permitir e compare o cenário otimizado.
  4. Adicione margem de 20-30 % para variações de tamanho e crescimento do uso.

Perguntas frequentes

É uma ferramenta criada para estimar os custos de uso da API Anthropic Claude. Informando tokens de entrada/prompt, tokens de saída/completude, volume de consultas e escolhendo um modelo, desenvolvedores e fundadores de SaaS conseguem projetar o gasto mensal e anual e comparar custos entre modelos.

O cache de prompts reduz drasticamente os custos (em até 90 %) dos tokens de entrada reutilizados em várias consultas. Ao ativá-lo, apenas os tokens não cacheados são cobrados à tarifa padrão; os cacheados são cobrados a uma tarifa de leitura bem menor. Por exemplo, no Claude 3.5 Sonnet, leituras cacheadas custam US$ 0,30/M tokens contra US$ 3,00/M tokens na tarifa padrão.

O cache de prompts exige prompt com no mínimo 10.000 tokens no Claude 3.5 Sonnet e Claude 3 Opus, e 20.000 tokens no Claude 3.5 Haiku. Prompts mais curtos não podem ser cacheados e serão sempre cobrados às tarifas padrão de entrada.

A Batch API permite enviar lotes de requisições processadas de forma assíncrona em até 24 horas, em vez de em tempo real. Em troca desse prazo, a Anthropic oferece 50 % de desconto fixo em tokens de entrada e saída em todos os modelos. Ative a opção Batch API na nossa calculadora para aplicar o desconto.

Como regra geral, 1 token equivale a cerca de 4 caracteres de texto em inglês, ou aproximadamente 0,75 palavra. Assim, 100 palavras são cerca de 133 tokens e 1.000 palavras, cerca de 1.333 tokens. Tokens de saída variam conforme a complexidade da resposta e a formatação (como código ou tags JSON, que consomem mais tokens).

Sim, o preço base dos modelos Claude hospedados na Amazon Bedrock ou no Google Vertex AI costuma ser idêntico às tarifas diretas da Anthropic. No entanto, podem incidir sobretaxas regionais ou descontos corporativos personalizados do seu provedor de nuvem. Use a calculadora como estimativa de referência.

Sim, totalmente. A calculadora roda inteiramente no seu navegador com JavaScript. Nenhum número de tokens, volume de requisições ou dado de projeto é enviado a servidor externo nem salvo. Seus cálculos são completamente privados.