Saltar al contenido
Aback Tools Logo

Visor de puntos de código Unicode

Consulta información Unicode detallada de cada carácter de cualquier texto con nuestro visor de puntos de código Unicode online y gratuito. Pega o escribe cualquier texto para ver al instante el punto de código U+ de cada carácter, su nombre oficial Unicode, la categoría general (Lu, Ll, Nd, Po, etc.), el bloque Unicode y las secuencias completas de bytes UTF-8 y UTF-16. Filtra por categoría o bloque, busca por nombre o punto de código y explora detalles completos por carácter, todo procesado localmente en tu navegador sin subir nada. Sin registro.

Unicode Code Point Viewer

Paste or type any text to view detailed Unicode information for each character - code point, name, category, block, UTF-8 and UTF-16 byte sequences, and more. All processing is local.

Text Input
0 code points

Paste or type text above to view detailed Unicode code point information for every character.

¿Por qué usar nuestro visor de puntos de código Unicode?

  • Información Unicode completa: consulta todos los detalles de cada carácter de tu texto (punto de código Unicode (U+), valor decimal, nombre oficial del carácter, categoría general, bloque Unicode y secuencias de bytes UTF-8/UTF-16) en una tabla clara y ordenable.
  • Análisis en tiempo real: obtén un análisis instantáneo de los puntos de código Unicode mientras escribes o pegas texto. Las tarjetas de resumen muestran el total de puntos de código, los recuentos de letras, dígitos, puntuación y símbolos, y los tamaños totales en bytes de UTF-8 y UTF-16, actualizados en tiempo real.
  • Filtrado y búsqueda potentes: filtra los puntos de código por categoría (Lu, Ll, Nd, Po, etc.) o por bloque Unicode con un clic. Busca por punto de código, nombre de carácter, bloque o cualquier atributo. Haz clic en cualquier fila para ver una vista detallada con valores copiables.
  • 100 % gratis y privado: nuestro visor de puntos de código Unicode es totalmente gratuito, sin registro, sin anuncios y sin límites de uso. Todo el análisis se ejecuta localmente en tu navegador: tu texto nunca sale de tu dispositivo. No se suben datos a ningún servidor.

Casos de uso habituales del visor de puntos de código Unicode

  • Depurar problemas de codificación: cuando el texto aparece con caracteres corruptos o mojibake, usa el visor de puntos de código Unicode para inspeccionar cada carácter a nivel de byte. Compara las secuencias UTF-8 y UTF-16 para identificar desajustes de codificación y corregir texto dañado.
  • Desarrollo y pruebas de software: los desarrolladores pueden usar el visor para verificar el tratamiento de Unicode en sus aplicaciones: comprobar que el procesamiento de cadenas maneja correctamente caracteres multibyte, pares suplentes, marcas combinantes y caracteres de anchura cero durante el desarrollo y las pruebas.
  • Trabajo de internacionalización (i18n): al trabajar con contenido multilingüe, usa el visor de puntos de código Unicode para entender cómo se codifican y representan distintas escrituras (desde latín y cirílico hasta ideogramas CJK, árabe, devanagari y emoji) en los diferentes bloques Unicode.
  • Análisis de fuentes y tipografía: los profesionales de tipografía pueden analizar el texto carácter por carácter para saber qué puntos de código Unicode se usan, identificar caracteres invisibles, comprobar espaciados no estándar y verificar la cobertura de la fuente en distintos bloques Unicode.
  • Limpieza y normalización de datos: al limpiar conjuntos de datos, usa el visor para identificar caracteres de anchura cero, separadores invisibles, caracteres de control y otros puntos de código no visibles que pueden causar problemas de procesamiento, fallos en comparaciones de cadenas o problemas de almacenamiento.
  • Aprendizaje y educación: estudiantes y docentes pueden explorar el estándar Unicode de forma interactiva: ver cómo UTF-8 y UTF-16 codifican el mismo carácter de forma distinta, comprender la estructura de bloques y categorías Unicode y aprender los fundamentos de la codificación de caracteres.

¿Qué es un punto de código Unicode?

Un punto de código Unicode es un número único asignado a cada carácter del estándar Unicode. Cada punto de código se escribe como U+ seguido de un número hexadecimal (por ejemplo, U+0041 para la letra latina A, U+4E00 para el ideograma CJK 一 o U+1F600 para el emoji de cara sonriente 😀). El estándar Unicode define más de 149.000 caracteres en 161 escrituras y cientos de bloques, lo que lo convierte en el sistema de codificación de caracteres universal que usa prácticamente todo el software moderno y la web. Nuestro visor de puntos de código Unicode te permite explorar cada carácter de cualquier texto, mostrando su punto de código, nombre oficial, categoría, bloque y codificaciones a nivel de byte.

Cómo usar este visor de puntos de código Unicode

  1. 1. Introduce o pega texto: escribe o pega cualquier texto en el área de entrada. La herramienta analiza al instante cada carácter y muestra información Unicode detallada de cada punto de código en una tabla ordenable. Los caracteres se recorren por punto de código Unicode, no por grupos de grafemas visibles.
  2. 2. Revisa las estadísticas de resumen: las tarjetas de resumen muestran el total de puntos de código, los recuentos de letras, dígitos, puntuación y símbolos, y los tamaños totales en bytes para UTF-8 y UTF-16. Los gráficos de distribución por categoría y bloque te ayudan a entender de un vistazo la composición de tu texto.
  3. 3. Filtra, busca y explora: usa el cuadro de búsqueda para encontrar caracteres concretos por nombre o punto de código. Filtra por categoría Unicode (Lu para mayúsculas, Nd para dígitos, etc.) o por bloque Unicode. Haz clic en cualquier fila para ampliar la información detallada, incluidas las secuencias de bytes UTF-8/UTF-16, las entidades HTML y las secuencias de escape JSON, todo copiable para usar en tus proyectos.

Conceptos clave de Unicode que explica esta herramienta

  • Puntos de código frente a unidades de código: un punto de código (U+0041) es el identificador abstracto del carácter. Las unidades de código son las secuencias de bytes reales que se usan para almacenar o transmitir el carácter: UTF-8 usa 1-4 bytes por punto de código, mientras que UTF-16 usa 1-2 unidades de 16 bits (2-4 bytes). Los caracteres por encima de U+FFFF requieren dos unidades de código UTF-16, lo que se conoce como par suplente.
  • Categorías Unicode: cada punto de código pertenece a una categoría general identificada por un código de dos letras: Lu (letra mayúscula), Ll (letra minúscula), Nd (número decimal), Po (otra puntuación), Sm (símbolo matemático), Sc (símbolo de moneda) y muchas más. La primera letra indica la clase principal: L (letra), N (número), P (puntuación), S (símbolo), Z (separador), C (control), M (marca).
  • Bloques Unicode: los caracteres se organizan en rangos contiguos llamados bloques, cada uno de los cuales cubre una escritura o categoría: Latín básico, Cirílico, Ideogramas CJK unificados, Emoticonos, Operadores matemáticos y más de 250 bloques adicionales. Cada bloque tiene un nombre y un rango definido de puntos de código.
  • Codificación UTF-8 y UTF-16: UTF-8 es la codificación dominante en la web y usa secuencias de bytes de longitud variable (1-4 bytes por punto de código) compatibles con ASCII. UTF-16 usa 2 o 4 bytes por punto de código y es la que emplean las cadenas de JavaScript y muchas API del sistema. La herramienta muestra ambas codificaciones para cada carácter, así puedes ver la diferencia.

Limitaciones y consideraciones de los puntos de código Unicode

Aunque nuestro visor de puntos de código Unicode ofrece un análisis exhaustivo de puntos de código individuales, hay conceptos importantes que conviene entender. Los puntos de código no son lo mismo que los caracteres visibles: un único grupo de grafemas puede estar formado por varios puntos de código (por ejemplo, una letra base seguida de marcas diacríticas combinantes, o un emoji seguido de un selector de variación). La herramienta analiza los puntos de código de forma individual, por lo que las secuencias de caracteres combinantes se muestran como entradas separadas. Los caracteres fuera del Plano Multilingüe Básico (BMP), incluidos la mayoría de los emojis y muchos caracteres CJK, usan pares suplentes en UTF-16, que se muestran como dos unidades de código. La base de datos de nombres de caracteres cubre ASCII común, Suplemento Latin-1 y caracteres Unicode populares: los caracteres fuera de este rango muestran su punto de código como nombre de reserva. Todo el análisis se realiza por completo en tu navegador: no se suben datos a ningún servidor.

Preguntas frecuentes

Un punto de código Unicode es un número único asignado a cada carácter del estándar Unicode. Se escribe como U+ seguido de un número hexadecimal; por ejemplo, U+0041 para la letra A, U+00A9 para el signo de copyright © o U+1F600 para el emoji de cara sonriente 😀. Cada punto de código representa un carácter concreto independientemente de la plataforma, el programa o el idioma.

Un punto de código (p. ej., U+1F600) es el identificador abstracto del carácter. Una unidad de código es la unidad de tamaño fijo que usa una codificación concreta: UTF-16 usa unidades de 16 bits, así que U+1F600 se convierte en dos unidades (D83D DE00), lo que se denomina par suplente. Un byte es el valor real de 8 bits almacenado en memoria o transmitido: UTF-8 codifica U+1F600 como cuatro bytes (F0 9F 98 80). Nuestro visor de puntos de código Unicode muestra las tres representaciones.

Las categorías Unicode (también llamadas categorías generales) clasifican cada punto de código según su función principal. Las categorías principales son: Letra (L), Marca (M), Número (N), Puntuación (P), Símbolo (S), Separador (Z) y Otro (C). Cada una tiene subcategorías; por ejemplo, Lu es letra mayúscula, Ll es letra minúscula, Nd es número decimal, Po es otra puntuación y Sm es símbolo matemático.

Los bloques Unicode son rangos contiguos de puntos de código que agrupan caracteres por escritura o temática. Por ejemplo, Latín básico (U+0000-U+007F) cubre ASCII, Cirílico (U+0400-U+04FF) cubre el ruso y escrituras afines, Ideogramas CJK unificados (U+4E00-U+9FFF) cubre caracteres chinos y Emoticonos (U+1F600-U+1F64F) cubre caras emoji.

UTF-8 es una codificación de ancho variable que usa de 1 a 4 bytes por punto de código. Los caracteres ASCII (U+0000-U+007F) usan 1 byte. Los caracteres hasta U+07FF usan 2 bytes, hasta U+FFFF usan 3 bytes y los superiores a U+FFFF usan 4 bytes. UTF-8 es la codificación dominante en la web por su compatibilidad con ASCII y su eficiencia.

Un único carácter visible (grupo de grafemas) puede estar formado por varios puntos de código Unicode. Ejemplos habituales: una letra base seguida de marcas diacríticas combinantes, emojis con secuencias ZWJ (por ejemplo, la familia 👨‍👩‍👧‍👦) y banderas codificadas como pares de indicadores regionales. Nuestro visor muestra cada punto de código de la secuencia por separado.

Sí: 100 % gratis para siempre, sin registro, sin anuncios y sin límites de uso. Todo el análisis se ejecuta por completo en tu navegador. Tu texto nunca se sube a ningún servidor. Puedes analizar con seguridad cualquier texto, incluidos contraseñas, documentos confidenciales e investigación de seguridad.