Aller au contenu
Aback Tools Logo

Visualiseur de points de code Unicode

Consultez des informations Unicode détaillées pour chaque caractère de n'importe quel texte grâce à notre visualiseur de points de code Unicode en ligne et gratuit. Collez ou saisissez un texte pour voir instantanément le point de code U+ de chaque caractère, son nom Unicode officiel, sa catégorie générale (Lu, Ll, Nd, Po, etc.), son bloc Unicode et les séquences complètes d'octets UTF-8 et UTF-16. Filtrez par catégorie ou par bloc, recherchez par nom ou par point de code et explorez des détails complets caractère par caractère — le tout traité localement dans votre navigateur, sans envoi. Sans inscription.

Unicode Code Point Viewer

Paste or type any text to view detailed Unicode information for each character - code point, name, category, block, UTF-8 and UTF-16 byte sequences, and more. All processing is local.

Text Input
0 code points

Paste or type text above to view detailed Unicode code point information for every character.

Pourquoi utiliser notre visualiseur de points de code Unicode ?

  • Informations Unicode complètes : consultez chaque détail sur chaque caractère de votre texte — point de code Unicode (U+), valeur décimale, nom officiel du caractère, catégorie générale, bloc Unicode et séquences d'octets UTF-8/UTF-16 — dans un tableau clair et triable.
  • Analyse en temps réel : obtenez une analyse instantanée des points de code Unicode dès que vous saisissez ou collez du texte. Les cartes de synthèse affichent le total des points de code, le nombre de lettres, chiffres, ponctuations et symboles, ainsi que la taille totale en octets pour les encodages UTF-8 et UTF-16 — le tout mis à jour en temps réel.
  • Filtrage et recherche puissants : filtrez les points de code par catégorie (Lu, Ll, Nd, Po, etc.) ou par bloc Unicode en un clic. Recherchez par point de code, nom de caractère, bloc ou n'importe quel attribut. Cliquez sur une ligne pour obtenir une vue détaillée avec des valeurs copiables.
  • 100 % gratuit et privé : notre visualiseur de points de code Unicode est entièrement gratuit, sans inscription, sans publicité et sans limite d'utilisation. Toute l'analyse s'exécute localement dans votre navigateur — votre texte ne quitte jamais votre appareil. Aucune donnée n'est envoyée à un serveur.

Cas d'usage courants du visualiseur de points de code Unicode

  • Débogage des problèmes d'encodage : lorsque le texte s'affiche sous forme de caractères illisibles ou de mojibake, utilisez le visualiseur de points de code Unicode pour inspecter chaque caractère au niveau de l'octet. Comparez les séquences UTF-8 et UTF-16 pour identifier les incohérences d'encodage et corriger le texte corrompu.
  • Développement et tests logiciels : les développeurs peuvent utiliser le visualiseur pour vérifier la gestion d'Unicode dans leurs applications — s'assurer que le traitement des chaînes gère correctement les caractères multioctets, les paires de substitution, les marques combinantes et les caractères de largeur nulle pendant le développement et les tests.
  • Travail d'internationalisation (i18n) : lorsque vous travaillez sur du contenu multilingue, utilisez le visualiseur de points de code Unicode pour comprendre comment différentes écritures — du latin et du cyrillique aux idéogrammes CJK, à l'arabe, au devanagari et aux emoji — sont encodées et représentées dans les différents blocs Unicode.
  • Analyse de polices et de typographie : les professionnels de la typographie peuvent analyser un texte caractère par caractère pour déterminer quels points de code Unicode sont utilisés, identifier les caractères invisibles, repérer les espacements non standard et vérifier la couverture d'une police sur différents blocs Unicode.
  • Nettoyage et normalisation de données : lors du nettoyage de jeux de données, utilisez le visualiseur pour identifier les caractères de largeur nulle, les séparateurs invisibles, les caractères de contrôle et autres points de code non visibles qui peuvent provoquer des erreurs de traitement, des échecs de comparaison de chaînes ou des problèmes de stockage.
  • Apprentissage et enseignement : les étudiants et les enseignants peuvent explorer la norme Unicode de manière interactive — voir comment UTF-8 et UTF-16 encodent différemment le même caractère, comprendre la structure des blocs et catégories Unicode et apprendre les fondamentaux de l'encodage des caractères.

Qu'est-ce qu'un point de code Unicode ?

Un point de code Unicode est un numéro unique attribué à chaque caractère de la norme Unicode. Chaque point de code s'écrit U+ suivi d'un nombre hexadécimal (par ex. U+0041 pour la lettre latine A, U+4E00 pour l'idéogramme CJK 一 ou U+1F600 pour l'emoji visage souriant 😀). La norme Unicode définit plus de 149 000 caractères répartis sur 161 écritures et des centaines de blocs, ce qui en fait le système d'encodage universel utilisé par la quasi-totalité des logiciels modernes et du web. Notre visualiseur de points de code Unicode vous permet d'explorer chaque caractère de n'importe quel texte en affichant son point de code, son nom officiel, sa catégorie, son bloc et ses encodages au niveau de l'octet.

Comment utiliser ce visualiseur de points de code Unicode

  1. 1. Saisissez ou collez du texte : tapez ou collez n'importe quel texte dans la zone de saisie. L'outil analyse instantanément chaque caractère et affiche des informations Unicode détaillées pour chaque point de code dans un tableau triable. Les caractères sont parcourus par point de code Unicode, et non par groupes de graphèmes visibles.
  2. 2. Consultez les statistiques de synthèse : les cartes de synthèse affichent le total des points de code, le nombre de lettres, chiffres, ponctuations et symboles, ainsi que la taille totale en octets pour UTF-8 et UTF-16. Les graphiques de répartition par catégorie et par bloc vous aident à comprendre la composition de votre texte en un coup d'œil.
  3. 3. Filtrez, recherchez et explorez : utilisez le champ de recherche pour trouver des caractères précis par nom ou par point de code. Filtrez par catégorie Unicode (Lu pour les majuscules, Nd pour les chiffres, etc.) ou par bloc Unicode. Cliquez sur une ligne pour afficher des informations détaillées, notamment les séquences d'octets UTF-8/UTF-16, les entités HTML et les séquences d'échappement JSON — toutes copiables pour vos projets.

Concepts clés d'Unicode expliqués par cet outil

  • Points de code et unités de code : un point de code (U+0041) est l'identifiant abstrait du caractère. Les unités de code sont les séquences d'octets réellement utilisées pour stocker ou transmettre le caractère — UTF-8 utilise 1 à 4 octets par point de code, tandis qu'UTF-16 utilise 1 à 2 unités de 16 bits (2 à 4 octets). Les caractères au-delà de U+FFFF nécessitent deux unités de code UTF-16, appelées paire de substitution.
  • Catégories Unicode : chaque point de code appartient à une catégorie générale identifiée par un code à deux lettres : Lu (lettre majuscule), Ll (lettre minuscule), Nd (nombre décimal), Po (autre ponctuation), Sm (symbole mathématique), Sc (symbole monétaire) et bien d'autres. La première lettre indique la classe principale : L (lettre), N (nombre), P (ponctuation), S (symbole), Z (séparateur), C (contrôle), M (marque).
  • Blocs Unicode : les caractères sont organisés en plages contiguës appelées blocs, chacune couvrant une écriture ou une catégorie — Latin de base, Cyrillique, Idéogrammes unifiés CJK, Émoticônes, Opérateurs mathématiques et plus de 250 autres. Chaque bloc possède un nom et une plage de points de code définie.
  • Encodages UTF-8 et UTF-16 : UTF-8 est l'encodage dominant sur le web et utilise des séquences d'octets de longueur variable (1 à 4 octets par point de code) rétrocompatibles avec l'ASCII. UTF-16 utilise 2 ou 4 octets par point de code et équipe les chaînes JavaScript ainsi que de nombreuses API système. L'outil affiche les deux encodages pour chaque caractère afin que vous puissiez voir la différence.

Limites et considérations des points de code Unicode

Bien que notre visualiseur de points de code Unicode fournisse une analyse complète des points de code individuels, certains concepts importants méritent d'être compris. Les points de code ne sont pas identiques aux caractères visibles — un seul groupe de graphèmes peut être composé de plusieurs points de code (par ex. une lettre de base suivie de diacritiques combinants, ou un emoji suivi d'un sélecteur de variation). L'outil analyse les points de code individuellement, de sorte que les séquences de caractères combinants apparaissent comme des entrées distinctes. Les caractères hors du plan multilingue de base (BMP), dont la plupart des emoji et de nombreux caractères CJK, utilisent des paires de substitution en UTF-16, affichées sous forme de deux unités de code. La base de noms de caractères couvre l'ASCII courant, le supplément Latin-1 et les caractères Unicode populaires — au-delà de cette plage, le point de code est affiché comme nom de repli. Toute l'analyse est effectuée entièrement dans votre navigateur — aucune donnée n'est envoyée à un serveur.

Foire aux questions

Un point de code Unicode est un numéro unique attribué à chaque caractère de la norme Unicode. Il s'écrit U+ suivi d'un nombre hexadécimal — par exemple U+0041 pour la lettre A, U+00A9 pour le signe de copyright © ou U+1F600 pour l'emoji visage souriant 😀. Chaque point de code représente un caractère précis, indépendamment de la plateforme, du programme ou de la langue.

Un point de code (par ex. U+1F600) est l'identifiant abstrait du caractère. Une unité de code est l'unité de taille fixe utilisée par un encodage donné : UTF-16 utilise des unités de 16 bits, donc U+1F600 devient deux unités (D83D DE00), appelées paire de substitution. Un octet est la valeur réelle de 8 bits stockée en mémoire ou transmise : UTF-8 encode U+1F600 sur quatre octets (F0 9F 98 80). Notre visualiseur de points de code Unicode affiche ces trois représentations.

Les catégories Unicode (aussi appelées catégories générales) classent chaque point de code selon sa fonction principale. Les grandes catégories sont : Lettre (L), Marque (M), Nombre (N), Ponctuation (P), Symbole (S), Séparateur (Z) et Autre (C). Chacune possède des sous-catégories : Lu pour lettre majuscule, Ll pour lettre minuscule, Nd pour nombre décimal, Po pour autre ponctuation et Sm pour symbole mathématique.

Les blocs Unicode sont des plages contiguës de points de code qui regroupent les caractères par écriture ou par thème. Par exemple, Latin de base (U+0000-U+007F) couvre l'ASCII, Cyrillique (U+0400-U+04FF) couvre le russe et les écritures associées, Idéogrammes unifiés CJK (U+4E00-U+9FFF) couvre les caractères chinois et Émoticônes (U+1F600-U+1F64F) couvre les visages emoji.

UTF-8 est un encodage à largeur variable qui utilise de 1 à 4 octets par point de code. Les caractères ASCII (U+0000-U+007F) occupent 1 octet. Les caractères jusqu'à U+07FF occupent 2 octets, jusqu'à U+FFFF 3 octets, et au-delà de U+FFFF 4 octets. UTF-8 est l'encodage dominant sur le web grâce à sa compatibilité avec l'ASCII et son efficacité.

Un seul caractère visible (groupe de graphèmes) peut être composé de plusieurs points de code Unicode. Exemples courants : une lettre de base suivie de diacritiques combinants, des emoji avec des séquences ZWJ (par ex. la famille 👨‍👩‍👧‍👦) et des drapeaux encodés sous forme de paires d'indicateurs régionaux. Notre visualiseur affiche chaque point de code de la séquence séparément.

Oui — 100 % gratuit à vie, sans inscription, sans publicité et sans limite d'utilisation. Toute l'analyse s'exécute entièrement dans votre navigateur. Votre texte n'est jamais envoyé à un serveur. Vous pouvez analyser en toute sécurité n'importe quel texte, y compris des mots de passe, des documents confidentiels et des recherches de sécurité.