Pular para o conteúdo
Aback Tools Logo

Visualizador de pontos de código Unicode

Veja informações Unicode detalhadas de cada caractere de qualquer texto com nosso visualizador de pontos de código Unicode online e gratuito. Cole ou digite qualquer texto para ver instantaneamente o ponto de código U+ de cada caractere, seu nome oficial Unicode, a categoria geral (Lu, Ll, Nd, Po etc.), o bloco Unicode e as sequências completas de bytes UTF-8 e UTF-16. Filtre por categoria ou bloco, pesquise por nome ou ponto de código e explore detalhes completos por caractere — tudo processado localmente no seu navegador, sem envios. Sem cadastro.

Unicode Code Point Viewer

Paste or type any text to view detailed Unicode information for each character - code point, name, category, block, UTF-8 and UTF-16 byte sequences, and more. All processing is local.

Text Input
0 code points

Paste or type text above to view detailed Unicode code point information for every character.

Por que usar nosso visualizador de pontos de código Unicode?

  • Informações Unicode completas: veja todos os detalhes de cada caractere do seu texto — ponto de código Unicode (U+), valor decimal, nome oficial do caractere, categoria geral, bloco Unicode e sequências de bytes UTF-8/UTF-16 — em uma tabela clara e classificável.
  • Análise em tempo real: obtenha análise instantânea dos pontos de código Unicode enquanto você digita ou cola texto. Os cartões de resumo mostram o total de pontos de código, as contagens de letras, dígitos, pontuação e símbolos, além dos tamanhos totais em bytes para UTF-8 e UTF-16 — atualizados em tempo real.
  • Filtragem e busca poderosas: filtre pontos de código por categoria (Lu, Ll, Nd, Po etc.) ou por bloco Unicode com um clique. Pesquise por ponto de código, nome do caractere, bloco ou qualquer atributo. Clique em qualquer linha para ver detalhes com valores copiáveis.
  • 100 % grátis e privado: nosso visualizador de pontos de código Unicode é totalmente gratuito, sem cadastro, sem anúncios e sem limites de uso. Toda a análise roda localmente no seu navegador — seu texto nunca sai do seu dispositivo. Nenhum dado é enviado a servidores.

Casos de uso comuns do visualizador de pontos de código Unicode

  • Depurar problemas de codificação: quando o texto aparece com caracteres corrompidos ou mojibake, use o visualizador de pontos de código Unicode para inspecionar cada caractere no nível do byte. Compare sequências UTF-8 e UTF-16 para identificar incompatibilidades de codificação e corrigir textos corrompidos.
  • Desenvolvimento e testes de software: desenvolvedores podem usar o visualizador para verificar o tratamento de Unicode em suas aplicações — conferir se o processamento de strings lida corretamente com caracteres multibyte, pares substitutos, marcas combinantes e caracteres de largura zero durante o desenvolvimento e os testes.
  • Trabalho de internacionalização (i18n): ao trabalhar com conteúdo multilíngue, use o visualizador de pontos de código Unicode para entender como diferentes escritas — do latim e cirílico aos ideogramas CJK, árabe, devanágari e emoji — são codificadas e representadas nos diferentes blocos Unicode.
  • Análise de fontes e tipografia: profissionais de tipografia podem analisar o texto caractere por caractere para entender quais pontos de código Unicode são usados, identificar caracteres invisíveis, verificar espaçamentos não padrão e conferir a cobertura da fonte em diferentes blocos Unicode.
  • Limpeza e normalização de dados: ao limpar conjuntos de dados, use o visualizador para identificar caracteres de largura zero, separadores invisíveis, caracteres de controle e outros pontos de código não visíveis que podem causar problemas de processamento, falhas em comparações de strings ou problemas de armazenamento.
  • Aprendizado e educação: alunos e professores podem explorar o padrão Unicode de forma interativa — ver como UTF-8 e UTF-16 codificam o mesmo caractere de maneiras diferentes, entender a estrutura dos blocos e categorias Unicode e aprender os fundamentos da codificação de caracteres.

O que é um ponto de código Unicode?

Um ponto de código Unicode é um número único atribuído a cada caractere do padrão Unicode. Cada ponto de código é escrito como U+ seguido de um número hexadecimal (por exemplo, U+0041 para a letra latina A, U+4E00 para o ideograma CJK 一 ou U+1F600 para o emoji de rosto sorridente 😀). O padrão Unicode define mais de 149.000 caracteres em 161 escritas e centenas de blocos, o que o torna o sistema universal de codificação de caracteres usado por praticamente todo software moderno e pela web. Nosso visualizador de pontos de código Unicode permite explorar cada caractere de qualquer texto, mostrando seu ponto de código, nome oficial, categoria, bloco e codificações em nível de byte.

Como usar este visualizador de pontos de código Unicode

  1. 1. Insira ou cole texto: digite ou cole qualquer texto na área de entrada. A ferramenta analisa instantaneamente cada caractere e exibe informações Unicode detalhadas de cada ponto de código em uma tabela classificável. Os caracteres são percorridos por ponto de código Unicode, não por grupos de grafemas visíveis.
  2. 2. Confira as estatísticas do resumo: os cartões de resumo mostram o total de pontos de código, as contagens de letras, dígitos, pontuação e símbolos, além dos tamanhos totais em bytes para UTF-8 e UTF-16. Os gráficos de distribuição por categoria e bloco ajudam a entender a composição do seu texto em um relance.
  3. 3. Filtre, pesquise e explore: use a caixa de busca para encontrar caracteres específicos por nome ou ponto de código. Filtre por categoria Unicode (Lu para maiúsculas, Nd para dígitos etc.) ou por bloco Unicode. Clique em qualquer linha para expandir informações detalhadas, incluindo sequências de bytes UTF-8/UTF-16, entidades HTML e sequências de escape JSON — todas copiáveis para usar em seus projetos.

Conceitos-chave do Unicode explicados por esta ferramenta

  • Pontos de código versus unidades de código: um ponto de código (U+0041) é o identificador abstrato do caractere. As unidades de código são as sequências de bytes reais usadas para armazenar ou transmitir o caractere — o UTF-8 usa 1 a 4 bytes por ponto de código, enquanto o UTF-16 usa 1 a 2 unidades de 16 bits (2 a 4 bytes). Caracteres acima de U+FFFF exigem duas unidades de código UTF-16, conhecidas como par substituto.
  • Categorias Unicode: cada ponto de código pertence a uma categoria geral identificada por um código de duas letras: Lu (letra maiúscula), Ll (letra minúscula), Nd (número decimal), Po (outra pontuação), Sm (símbolo matemático), Sc (símbolo monetário) e muitas outras. A primeira letra indica a classe principal: L (letra), N (número), P (pontuação), S (símbolo), Z (separador), C (controle), M (marca).
  • Blocos Unicode: os caracteres são organizados em faixas contíguas chamadas blocos, cada uma cobrindo uma escrita ou categoria — Latim básico, Cirílico, Ideogramas CJK unificados, Emoticons, Operadores matemáticos e mais de 250 outros. Cada bloco tem um nome e uma faixa definida de pontos de código.
  • Codificação UTF-8 e UTF-16: UTF-8 é a codificação dominante na web, com sequências de bytes de comprimento variável (1 a 4 bytes por ponto de código) compatíveis com ASCII. UTF-16 usa 2 ou 4 bytes por ponto de código e é usada pelas strings de JavaScript e por muitas APIs do sistema. A ferramenta mostra as duas codificações para cada caractere, para você ver a diferença.

Limitações e considerações dos pontos de código Unicode

Embora nosso visualizador de pontos de código Unicode ofereça uma análise abrangente de pontos de código individuais, há conceitos importantes a entender. Pontos de código não são a mesma coisa que caracteres visíveis — um único grupo de grafemas pode consistir em vários pontos de código (por exemplo, uma letra base seguida de marcas diacríticas combinantes, ou um emoji seguido de um seletor de variação). A ferramenta analisa os pontos de código individualmente, então sequências de caracteres combinantes aparecem como entradas separadas. Caracteres fora do Plano Multilíngue Básico (BMP), incluindo a maioria dos emojis e muitos caracteres CJK, usam pares substitutos em UTF-16, exibidos como duas unidades de código. A base de nomes de caracteres cobre ASCII comum, Suplemento Latin-1 e caracteres Unicode populares — caracteres fora dessa faixa mostram seu ponto de código como nome alternativo. Toda a análise é realizada inteiramente no seu navegador — nenhum dado é enviado a servidores.

Perguntas frequentes

Um ponto de código Unicode é um número único atribuído a cada caractere do padrão Unicode. Ele é escrito como U+ seguido de um número hexadecimal — por exemplo, U+0041 para a letra A, U+00A9 para o símbolo de copyright © ou U+1F600 para o emoji de rosto sorridente 😀. Cada ponto de código representa um caractere específico, independentemente da plataforma, do programa ou do idioma.

Um ponto de código (por exemplo, U+1F600) é o identificador abstrato do caractere. Uma unidade de código é a unidade de tamanho fixo usada por uma codificação específica — o UTF-16 usa unidades de 16 bits, então U+1F600 vira duas unidades (D83D DE00), chamadas de par substituto. Um byte é o valor real de 8 bits armazenado na memória ou transmitido — o UTF-8 codifica U+1F600 em quatro bytes (F0 9F 98 80). Nosso visualizador de pontos de código Unicode mostra as três representações.

As categorias Unicode (também chamadas de categorias gerais) classificam cada ponto de código pela sua função principal. As categorias principais são: Letra (L), Marca (M), Número (N), Pontuação (P), Símbolo (S), Separador (Z) e Outro (C). Cada uma tem subcategorias — por exemplo, Lu é letra maiúscula, Ll é letra minúscula, Nd é número decimal, Po é outra pontuação e Sm é símbolo matemático.

Blocos Unicode são faixas contíguas de pontos de código que agrupam caracteres por escrita ou tema. Por exemplo, Latim básico (U+0000-U+007F) cobre ASCII, Cirílico (U+0400-U+04FF) cobre o russo e escritas relacionadas, Ideogramas CJK unificados (U+4E00-U+9FFF) cobre caracteres chineses e Emoticons (U+1F600-U+1F64F) cobre rostos de emoji.

UTF-8 é uma codificação de largura variável que usa de 1 a 4 bytes por ponto de código. Caracteres ASCII (U+0000-U+007F) usam 1 byte. Caracteres até U+07FF usam 2 bytes, até U+FFFF usam 3 bytes e acima de U+FFFF usam 4 bytes. UTF-8 é a codificação dominante na web por sua compatibilidade com ASCII e eficiência.

Um único caractere visível (grupo de grafemas) pode consistir em vários pontos de código Unicode. Exemplos comuns incluem uma letra base seguida de marcas diacríticas combinantes, emojis com sequências ZWJ (por exemplo, a família 👨‍👩‍👧‍👦) e bandeiras codificadas como pares de indicadores regionais. Nosso visualizador mostra cada ponto de código da sequência separadamente.

Sim — 100 % grátis para sempre, sem cadastro, sem anúncios e sem limites de uso. Toda a análise roda inteiramente no seu navegador. Seu texto nunca é enviado a nenhum servidor. Você pode analisar com segurança qualquer texto, incluindo senhas, documentos confidenciais e pesquisa de segurança.