Zum Inhalt springen
Aback Tools Logo

Unicode-Codepunkt-Viewer

Sehen Sie detaillierte Unicode-Informationen für jedes Zeichen in jedem Text mit unserem kostenlosen Unicode-Codepunkt-Viewer. Fügen Sie einen beliebigen Text ein oder tippen Sie ihn ein, um sofort den U+-Codepunkt jedes Zeichens, den offiziellen Unicode-Namen, die allgemeine Kategorie (Lu, Ll, Nd, Po usw.), den Unicode-Block und die vollständigen UTF-8- und UTF-16-Byte-Sequenzen zu sehen. Filtern Sie nach Kategorie oder Block, suchen Sie nach Name oder Codepunkt und erkunden Sie umfassende Details pro Zeichen – alles lokal in Ihrem Browser verarbeitet, ohne Uploads. Ohne Anmeldung.

Unicode Code Point Viewer

Paste or type any text to view detailed Unicode information for each character - code point, name, category, block, UTF-8 and UTF-16 byte sequences, and more. All processing is local.

Text Input
0 code points

Paste or type text above to view detailed Unicode code point information for every character.

Warum unseren Unicode-Codepunkt-Viewer verwenden?

  • Vollständige Unicode-Informationen: Sehen Sie jedes Detail zu jedem Zeichen Ihres Textes – Unicode-Codepunkt (U+), Dezimalwert, offizieller Zeichenname, allgemeine Kategorie, Unicode-Block und UTF-8/UTF-16-Byte-Sequenzen – in einer klaren, sortierbaren Tabelle.
  • Echtzeitanalyse: Erhalten Sie sofort eine Unicode-Codepunkt-Analyse, während Sie Text eingeben oder einfügen. Übersichtskarten zeigen die Gesamtzahl der Codepunkte, die Anzahl von Buchstaben, Ziffern, Interpunktionen und Symbolen sowie die Gesamtbytegrößen für UTF-8 und UTF-16 – in Echtzeit aktualisiert.
  • Leistungsstarke Filter und Suche: Filtern Sie Codepunkte per Klick nach Kategorie (Lu, Ll, Nd, Po usw.) oder Unicode-Block. Suchen Sie nach Codepunkt, Zeichenname, Block oder beliebigem Attribut. Klicken Sie auf eine Zeile für eine Detailansicht mit kopierbaren Werten.
  • 100 % kostenlos und privat: Unser Unicode-Codepunkt-Viewer ist völlig kostenlos, ohne Anmeldung, ohne Werbung und ohne Nutzungslimits. Die gesamte Analyse läuft lokal in Ihrem Browser – Ihr Text verlässt nie Ihr Gerät. Es werden keine Daten auf einen Server hochgeladen.

Typische Anwendungsfälle des Unicode-Codepunkt-Viewers

  • Kodierungsprobleme debuggen: Wenn Text als unleserliche Zeichen oder Mojibake erscheint, prüfen Sie mit dem Unicode-Codepunkt-Viewer jedes Zeichen auf Byte-Ebene. Vergleichen Sie UTF-8- und UTF-16-Sequenzen, um Kodierungsabweichungen zu erkennen und beschädigten Text zu reparieren.
  • Softwareentwicklung und Tests: Entwickler können den Viewer nutzen, um den Unicode-Umgang ihrer Anwendungen zu verifizieren – prüfen, ob die String-Verarbeitung Mehrbyte-Zeichen, Surrogatpaare, kombinierende Markierungen und Zeichen mit Breite null während Entwicklung und Tests korrekt behandelt.
  • Internationalisierung (i18n): Bei mehrsprachigen Inhalten zeigt der Unicode-Codepunkt-Viewer, wie verschiedene Schriften – von Latein und Kyrillisch bis hin zu CJK-Ideogrammen, Arabisch, Devanagari und Emojis – über verschiedene Unicode-Blöcke hinweg kodiert und dargestellt werden.
  • Schrift- und Typografieanalyse: Typografie-Fachleute können Text Zeichen für Zeichen analysieren, um zu verstehen, welche Unicode-Codepunkte verwendet werden, unsichtbare Zeichen zu finden, unübliche Abstände zu prüfen und die Schriftabdeckung über verschiedene Unicode-Blöcke zu verifizieren.
  • Datenbereinigung und Normalisierung: Beim Bereinigen von Datensätzen identifizieren Sie mit dem Unicode-Codepunkt-Viewer Zeichen mit Breite null, unsichtbare Trennzeichen, Steuerzeichen und andere nicht sichtbare Codepunkte, die Verarbeitungsfehler, Fehlschläge beim String-Vergleich oder Speicherprobleme verursachen können.
  • Lernen und Lehren: Studierende und Lehrende können den Unicode-Standard interaktiv erkunden – sehen, wie UTF-8 und UTF-16 dasselbe Zeichen unterschiedlich kodieren, die Struktur von Unicode-Blöcken und -Kategorien verstehen und die Grundlagen der Zeichenkodierung lernen.

Was ist ein Unicode-Codepunkt?

Ein Unicode-Codepunkt ist eine eindeutige Nummer, die jedem Zeichen im Unicode-Standard zugewiesen ist. Jeder Codepunkt wird als U+ gefolgt von einer Hexadezimalzahl geschrieben (z. B. U+0041 für den lateinischen Buchstaben A, U+4E00 für das CJK-Ideogramm 一 oder U+1F600 für das grinsende Gesicht-Emoji 😀). Der Unicode-Standard definiert über 149.000 Zeichen in 161 Schriften und Hunderten von Blöcken und ist damit das universelle Zeichenkodierungssystem, das praktisch jede moderne Software und das Web nutzt. Unser Unicode-Codepunkt-Viewer lässt Sie jedes Zeichen in jedem Text erkunden und zeigt Codepunkt, offiziellen Namen, Kategorie, Block und Kodierungen auf Byte-Ebene.

So verwenden Sie diesen Unicode-Codepunkt-Viewer

  1. 1. Text eingeben oder einfügen: Tippen oder fügen Sie beliebigen Text in das Eingabefeld ein. Das Tool analysiert sofort jedes Zeichen und zeigt detaillierte Unicode-Informationen zu jedem Codepunkt in einer sortierbaren Tabelle an. Zeichen werden nach Unicode-Codepunkt durchlaufen, nicht nach sichtbaren Graphem-Clustern.
  2. 2. Übersichtsstatistiken prüfen: Die Übersichtskarten zeigen die Gesamtzahl der Codepunkte, die Anzahl von Buchstaben, Ziffern, Interpunktionen und Symbolen sowie die Gesamtbytegrößen für UTF-8 und UTF-16. Die Verteilungsdiagramme nach Kategorie und Block helfen, die Zusammensetzung Ihres Textes auf einen Blick zu verstehen.
  3. 3. Filtern, suchen und erkunden: Nutzen Sie das Suchfeld, um bestimmte Zeichen nach Name oder Codepunkt zu finden. Filtern Sie nach Unicode-Kategorie (Lu für Großbuchstaben, Nd für Ziffern usw.) oder nach Unicode-Block. Klicken Sie auf eine Zeile, um Detailinformationen zu erweitern, darunter UTF-8/UTF-16-Byte-Sequenzen, HTML-Entities und JSON-Escape-Sequenzen – alle kopierbar für Ihre Projekte.

Wichtige Unicode-Konzepte, die dieses Tool erklärt

  • Codepunkte vs. Codeeinheiten: Ein Codepunkt (U+0041) ist die abstrakte Zeichenkennung. Codeeinheiten sind die tatsächlichen Byte-Sequenzen, mit denen ein Zeichen gespeichert oder übertragen wird – UTF-8 nutzt 1-4 Bytes pro Codepunkt, während UTF-16 1-2 16-Bit-Einheiten (2-4 Bytes) verwendet. Zeichen oberhalb von U+FFFF benötigen zwei UTF-16-Codeeinheiten, ein sogenanntes Surrogatpaar.
  • Unicode-Kategorien: Jeder Codepunkt gehört zu einer allgemeinen Kategorie mit einem zweibuchstabigen Code: Lu (Großbuchstabe), Ll (Kleinbuchstabe), Nd (Dezimalzahl), Po (sonstige Interpunktion), Sm (mathematisches Symbol), Sc (Währungssymbol) und viele mehr. Der erste Buchstabe gibt die Hauptklasse an: L (Buchstabe), N (Zahl), P (Interpunktion), S (Symbol), Z (Trennzeichen), C (Steuerzeichen), M (Markierung).
  • Unicode-Blöcke: Zeichen sind in zusammenhängenden Bereichen namens Blöcke organisiert, die jeweils eine Schrift oder Kategorie abdecken – Basic Latin, Kyrillisch, CJK Unified Ideographs, Emoticons, Mathematische Operatoren und über 250 weitere. Jeder Block hat einen Namen und einen definierten Codepunktbereich.
  • UTF-8- und UTF-16-Kodierung: UTF-8 ist die dominierende Kodierung im Web und verwendet Byte-Sequenzen variabler Länge (1-4 Bytes pro Codepunkt), die abwärtskompatibel zu ASCII sind. UTF-16 verwendet 2 oder 4 Bytes pro Codepunkt und wird von JavaScript-Strings und vielen System-APIs genutzt. Das Tool zeigt beide Kodierungen für jedes Zeichen, damit Sie den Unterschied sehen.

Einschränkungen und Hinweise zu Unicode-Codepunkten

Unser Unicode-Codepunkt-Viewer bietet eine umfassende Analyse einzelner Codepunkte, dennoch sind einige Konzepte wichtig. Codepunkte sind nicht dasselbe wie sichtbare Zeichen – ein einzelnes sichtbares Graphem-Cluster kann aus mehreren Codepunkten bestehen (z. B. ein Basisbuchstabe mit kombinierenden diakritischen Zeichen oder ein Emoji mit einem Variantenselektor). Das Tool analysiert Codepunkte einzeln, daher erscheinen kombinierende Zeichensequenzen als separate Einträge. Zeichen außerhalb der Basic Multilingual Plane (BMP), darunter die meisten Emojis und viele CJK-Zeichen, verwenden in UTF-16 Surrogatpaare, die als zwei Codeeinheiten angezeigt werden. Die Zeichennamen-Datenbank deckt gängiges ASCII, Latin-1 Supplement und populäre Unicode-Zeichen ab – Zeichen außerhalb dieses Bereichs zeigen ihren Codepunkt als Ersatznamen. Die gesamte Analyse erfolgt vollständig in Ihrem Browser – es werden keine Daten auf einen Server hochgeladen.

Häufig gestellte Fragen

Ein Unicode-Codepunkt ist eine eindeutige Nummer, die jedem Zeichen im Unicode-Standard zugewiesen ist. Er wird als U+ gefolgt von einer Hexadezimalzahl geschrieben – zum Beispiel U+0041 für den Buchstaben A, U+00A9 für das Copyright-Zeichen © oder U+1F600 für das grinsende Gesicht-Emoji 😀. Jeder Codepunkt steht für ein bestimmtes Zeichen, unabhängig von Plattform, Programm oder Sprache.

Ein Codepunkt (z. B. U+1F600) ist die abstrakte Zeichenkennung. Eine Codeeinheit ist die Einheit fester Größe, die eine bestimmte Kodierung verwendet – UTF-16 nutzt 16-Bit-Codeeinheiten, sodass U+1F600 zu zwei Codeeinheiten (D83D DE00) wird, einem sogenannten Surrogatpaar. Ein Byte ist der tatsächliche 8-Bit-Wert, der im Speicher liegt oder übertragen wird – UTF-8 kodiert U+1F600 als vier Bytes (F0 9F 98 80). Unser Unicode-Codepunkt-Viewer zeigt alle drei Darstellungen.

Unicode-Kategorien (auch allgemeine Kategorien genannt) klassifizieren jeden Codepunkt nach seiner Hauptfunktion. Die Hauptkategorien sind: Buchstabe (L), Markierung (M), Zahl (N), Interpunktion (P), Symbol (S), Trennzeichen (Z) und Sonstiges (C). Jede hat Unterkategorien – zum Beispiel Lu für Großbuchstaben, Ll für Kleinbuchstaben, Nd für Dezimalzahlen, Po für sonstige Interpunktion und Sm für mathematische Symbole.

Unicode-Blöcke sind zusammenhängende Bereiche von Codepunkten, die Zeichen nach Schrift oder Thema gruppieren. Zum Beispiel deckt Basic Latin (U+0000-U+007F) ASCII ab, Kyrillisch (U+0400-U+04FF) Russisch und verwandte Schriften, CJK Unified Ideographs (U+4E00-U+9FFF) chinesische Zeichen und Emoticons (U+1F600-U+1F64F) Emoji-Gesichter.

UTF-8 ist eine Kodierung variabler Breite, die 1 bis 4 Bytes pro Codepunkt verwendet. ASCII-Zeichen (U+0000-U+007F) belegen 1 Byte. Zeichen bis U+07FF belegen 2 Bytes, bis U+FFFF 3 Bytes und Zeichen über U+FFFF 4 Bytes. UTF-8 ist dank ASCII-Kompatibilität und Effizienz die dominierende Kodierung im Web.

Ein einzelnes sichtbares Zeichen (Graphem-Cluster) kann aus mehreren Unicode-Codepunkten bestehen. Häufige Beispiele sind ein Basisbuchstabe mit kombinierenden diakritischen Zeichen, Emojis mit ZWJ-Sequenzen (z. B. die Familie 👨‍👩‍👧‍👦) und Flaggen, die als Paare regionaler Indikatoren kodiert sind. Unser Viewer zeigt jeden Codepunkt der Sequenz separat an.

Ja – für immer 100 % kostenlos, ohne Anmeldung, ohne Werbung und ohne Nutzungslimits. Die gesamte Analyse läuft vollständig in Ihrem Browser. Ihr Text wird nie auf einen Server hochgeladen. Sie können jeden Text sicher analysieren, einschließlich Passwörtern, vertraulichen Dokumenten und Sicherheitsforschung.