Compteur de tokens
Comptez tokens, mots, caractères et phrases de n'importe quel texte, instantanément et gratuitement. Collez du texte ou importez un fichier pour voir les estimations de tokens sur GPT-4o, Claude, Gemini, DeepSeek, Grok et Mistral. Visualisez l'utilisation de la fenêtre de contexte et le coût d'entrée API estimé. Fonctionne 100 % dans votre navigateur, sans inscription.
Paste or type any text below to instantly count tokens, words, characters, and sentences. Select a model to see estimated token counts and API input costs. Runs 100% in your browser - no data is sent anywhere.
0 characters
Tokens
-
GPT-4o
Words
-
Characters
-
incl. spaces
No-Space Chars
-
Sentences
-
Lines
-
Ce que mesure le compteur
Le comptage de tokens dépend du modèle : chaque famille utilise un tokenizer différent. Un même texte ne donne pas le même nombre sur GPT-4o, Claude ou Gemini.
Outre les tokens, l'outil indique les mots, caractères, phrases et le pourcentage de la fenêtre de contexte occupé.
- Tokens estimés par modèle (GPT-4o, Claude, Gemini, DeepSeek, Grok, Mistral).
- Mots, caractères et phrases pour dimensionner votre prompt.
- Utilisation de la fenêtre de contexte et coût d'entrée estimé.
Quand une estimation suffit, quand il faut le tokenizer officiel
Pour budgéter et dimensionner des prompts, l'estimation suffit. Pour une facturation exacte ou des limites strictes, mieux vaut le tokenizer du fournisseur.
- Prose anglaise : écart type de ±5-10 %.
- Code à nombreux symboles et emoji : écart plus important.
- Pour l'exactitude totale : tiktoken, countTokens d'Anthropic ou de Google.
Confidentialité et usage
Tout le traitement se fait dans votre navigateur : vous pouvez donc coller du contenu confidentiel sans risque.
- Collez votre prompt ou importez un fichier texte brut.
- Choisissez le modèle cible pour voir son comptage de tokens.
- Vérifiez l'utilisation de la fenêtre de contexte.
- Consultez le coût d'entrée estimé avant d'envoyer la requête.
Foire aux questions
C'est un outil qui estime le nombre de tokens d'un texte pour un modèle de langage donné. Les tokens sont les unités traitées par les LLM - environ 3,8 à 4,0 caractères par token en anglais. Le compteur mesure aussi les mots, caractères et phrases, et affiche l'utilisation de la fenêtre de contexte du modèle choisi.
Les estimations sont précises à ±5-10 % pour de la prose anglaise typique et du code. Chaque modèle utilise son ratio moyen publié de caractères par token. Pour des comptages exacts, utilisez le tokenizer officiel du fournisseur (tiktoken d'OpenAI, l'endpoint countTokens d'Anthropic ou l'API countTokens de Google). Le texte non anglais, le code à nombreux symboles et les emoji se tokenisent différemment.
Non. Il fonctionne 100 % dans votre navigateur. Votre texte n'est jamais téléversé, stocké ni transmis. Tous les comptages sont calculés localement sur votre appareil. Il est donc sûr pour des prompts confidentiels, du code propriétaire, des documents juridiques et tout texte sensible.
Chaque famille de LLM utilise un tokenizer avec un vocabulaire différent. Le tiktoken d'OpenAI (utilisé par GPT-4o) fait en moyenne ~3,8 caractères par token en anglais. Le tokenizer de Claude ~3,9. Gemini et Mistral ~4,0. Un même texte produit donc des comptages légèrement différents selon le tokenizer.
C'est le nombre maximal de tokens qu'un LLM peut traiter en une requête - prompt, historique, documents récupérés et réponse générée inclus. Si votre entrée dépasse la fenêtre, le modèle tronque ou rejette la requête. Le compteur montre la part de la fenêtre du modèle choisi occupée par votre texte.
Oui. Cliquez sur « Importer un fichier » pour charger un fichier texte brut directement. Formats pris en charge : .txt, .md, .json, .csv, .html, .xml, .yaml, .js, .ts, .py, .java, .go, .rs, .cpp et plus. Le fichier est lu localement dans votre navigateur et jamais téléversé sur un serveur.
Le coût d'entrée est calculé en multipliant le nombre estimé de tokens par le tarif d'entrée standard par million de tokens du modèle choisi. Exemple : un texte estimé à 1 000 tokens et un modèle à 2,50 $/million de tokens d'entrée donnent 0,0025 $. Les coûts réels peuvent varier légèrement selon la tokenisation et les remises éventuelles.