Contador de tokens
Conte tokens, palavras, caracteres e frases de qualquer texto — na hora e grátis. Cole texto ou envie um arquivo para ver estimativas de tokens no GPT-4o, Claude, Gemini, DeepSeek, Grok e Mistral. Visualize o uso da janela de contexto e o custo estimado de entrada de API. Roda 100 % no seu navegador, sem cadastro.
Paste or type any text below to instantly count tokens, words, characters, and sentences. Select a model to see estimated token counts and API input costs. Runs 100% in your browser - no data is sent anywhere.
0 characters
Tokens
-
GPT-4o
Words
-
Characters
-
incl. spaces
No-Space Chars
-
Sentences
-
Lines
-
O que o contador mede
A contagem de tokens depende do modelo: cada família usa um tokenizador diferente. Um mesmo texto não dá o mesmo número no GPT-4o, no Claude ou no Gemini.
Além de tokens, a ferramenta informa palavras, caracteres, frases e a porcentagem da janela de contexto ocupada.
- Tokens estimados por modelo (GPT-4o, Claude, Gemini, DeepSeek, Grok, Mistral).
- Palavras, caracteres e frases para dimensionar seu prompt.
- Uso da janela de contexto e custo de entrada estimado.
Quando a estimativa basta e quando é preciso o tokenizador oficial
Para orçar e dimensionar prompts, a estimativa é suficiente. Para cobrança exata ou limites rígidos, o tokenizador do provedor é melhor.
- Prosa inglesa: desvio típico de ±5-10 %.
- Código com muitos símbolos e emoji: desvio maior.
- Para exatidão total: tiktoken, countTokens da Anthropic ou do Google.
Privacidade e uso
Todo o processamento ocorre no seu navegador, então você pode colar conteúdo confidencial sem risco.
- Cole seu prompt ou envie um arquivo de texto simples.
- Escolha o modelo alvo para ver sua contagem de tokens.
- Confira o uso da janela de contexto.
- Veja o custo estimado de entrada antes de enviar a requisição.
Perguntas frequentes
É uma ferramenta que estima quantos tokens um texto contém para um modelo de linguagem específico. Tokens são as unidades processadas pelos LLMs — cerca de 3,8 a 4,0 caracteres por token em inglês. O contador também mede palavras, caracteres e frases, e mostra o uso da janela de contexto do modelo selecionado.
As estimativas são precisas dentro de ±5-10 % para prosa inglesa típica e código. Cada modelo usa sua proporção média publicada de caracteres por token. Para contagens exatas, use o tokenizador oficial do provedor (tiktoken da OpenAI, endpoint countTokens da Anthropic ou API countTokens do Google). Texto em outros idiomas, código com muitos símbolos e emoji tokenizam diferente e podem ter desvios maiores.
Não. Ele roda 100 % no seu navegador. Seu texto nunca é enviado, armazenado ou transmitido. Todas as contagens (tokens, palavras, caracteres, frases) são calculadas localmente no seu dispositivo. Por isso é seguro para prompts confidenciais, código proprietário, documentos jurídicos e qualquer texto sensível.
Cada família de LLM usa um tokenizador com vocabulário diferente. O tiktoken da OpenAI (usado pelo GPT-4o) tem média de ~3,8 caracteres por token em inglês. O tokenizador do Claude ~3,9. Gemini e Mistral ~4,0. O mesmo texto gera contagens ligeiramente diferentes conforme o tokenizador.
É o número máximo de tokens que um LLM pode processar em uma requisição — incluindo prompt, histórico de conversa, documentos recuperados e resposta gerada. Se sua entrada exceder a janela, o modelo trunca ou rejeita a requisição. O contador mostra exatamente quanto da janela do modelo escolhido seu texto ocupa.
Sim. Clique em «Enviar arquivo» para carregar qualquer arquivo de texto simples diretamente no contador. Formatos suportados: .txt, .md, .json, .csv, .html, .xml, .yaml, .js, .ts, .py, .java, .go, .rs, .cpp e mais. O arquivo é lido localmente no navegador e nunca enviado a um servidor.
O custo de entrada é calculado multiplicando a contagem estimada de tokens pela tarifa padrão de entrada por milhão de tokens do modelo escolhido. Por exemplo, se seu texto tem 1.000 tokens e o modelo custa US$ 2,50 por milhão de tokens de entrada, o custo estimado é US$ 0,0025. Os custos reais podem variar levemente por diferenças de tokenização e descontos ativos.