Detector de BOM
Envie qualquer arquivo para detectar marcas de ordem de bytes (BOM) e identificar a codificação de texto. Nosso Detector de BOM lê o cabeçalho do arquivo e o compara com as assinaturas BOM conhecidas de UTF-8, UTF-16 (Big Endian e Little Endian), UTF-32, UTF-7, GB 18030 e mais. Veja o dump hexadecimal interativo com os bytes BOM destacados, obtenha informações detalhadas da codificação com detecção de endianness e receba recomendações práticas para compatibilidade multiplataforma. Todo o processamento é feito inteiramente no seu navegador - sem envios, sem cadastro.
Upload any file to detect Byte Order Marks (BOMs) - hidden byte sequences at the start of files that identify the text encoding and byte order. Supports UTF-8, UTF-16 (BE/LE), UTF-32 (BE/LE), UTF-7, GB 18030, and other BOM signatures. Displays the hex dump with BOM bytes highlighted, encoding details, and recommendations for cross-platform compatibility. All processing is done entirely in your browser - no uploads, no signup required.
Drag & drop a file here, or click to select
Detects BOM signatures in text and binary files
Por Que Usar Nosso Detector de BOM?
- Detecção abrangente de assinaturas BOM: detecta todas as assinaturas padrão de marca de ordem de bytes: UTF-8 (EF BB BF), UTF-16 Big Endian (FE FF), UTF-16 Little Endian (FF FE), UTF-32 Big Endian (00 00 FE FF), UTF-32 Little Endian (FF FE 00 00), UTF-7 (+/v), UTF-1, SCSU, BOCU-1 e GB 18030. Cada BOM é identificada com o nome da codificação, conjunto de caracteres IANA, endianness e contexto de uso comum.
- Exibição interativa em hexadecimal e ASCII: mostra os primeiros 48 bytes do arquivo como um dump hexadecimal interativo com representação ASCII lado a lado. Os bytes BOM detectados são destacados em âmbar para facilitar a identificação visual. Os dados hexadecimais podem ser copiados para a área de transferência com um clique para documentação ou análise posterior.
- Recomendações de codificação: oferece recomendações práticas com base na codificação BOM detectada. Alerta sobre problemas de compatibilidade multiplataforma - por exemplo, avisa quando um BOM UTF-8 é detectado em código-fonte que pode causar problemas em sistemas Unix/Linux, ou sugere conversão de UTF-16 para UTF-8 para maior eficiência de armazenamento e compatibilidade com ferramentas.
- Processamento 100 % privado no navegador: toda a detecção de BOM acontece inteiramente no seu navegador. Apenas os primeiros 1024 bytes do arquivo são lidos usando a API FileReader - nenhum dado é enviado a qualquer servidor. Seus arquivos nunca saem do seu dispositivo, tornando seguro analisar arquivos sensíveis ou proprietários.
Casos de Uso Comuns do Detector de BOM
- Depuração de problemas de codificação em desenvolvimento web: quando arquivos PHP, Python ou JavaScript exibem saída inesperada (como caracteres  no topo de uma página web), o BOM UTF-8 costuma ser o culpado. Use nosso Detector de BOM para identificar rapidamente se os arquivos de código-fonte têm BOM e depois converta para UTF-8 sem BOM para uma renderização limpa.
- Compatibilidade de arquivos multiplataforma: arquivos criados no Windows frequentemente incluem um BOM UTF-8 que causa problemas ao serem transferidos para sistemas Unix/Linux/macOS. Scripts com linha shebang (#!) podem falhar, arquivos de configuração podem ser lidos incorretamente e ferramentas de diff podem mostrar diferenças fantasma. Detecte BOMs para diagnosticar e resolver esses problemas de compatibilidade.
- Verificação de codificação em CSV e arquivos de dados: arquivos CSV exportados do Microsoft Excel frequentemente incluem um BOM UTF-8, o que pode afetar a forma como as ferramentas de processamento de dados analisam o arquivo. Detecte o BOM e a codificação para garantir que seus pipelines ETL, importações de banco de dados e ferramentas de análise tratem o arquivo corretamente.
- Migração de formatos de arquivo legados: ao migrar sistemas legados que usam codificação UTF-16, UTF-32 ou GB 18030 para os padrões UTF-8 modernos, use a detecção de BOM para identificar quais arquivos precisam de conversão. O mecanismo de recomendações orienta sobre a melhor estratégia de conversão para cada tipo de codificação.
- QA e validação de arquivos em pipelines CI/CD: integre a detecção de BOM ao seu fluxo de garantia de qualidade. Garanta que todo o código-fonte, arquivos de configuração e documentação sigam os padrões de codificação da sua equipe. Detecte e sinalize arquivos com BOMs inesperadas antes que causem problemas em produção.
- Computação e educação sobre Unicode: aprenda de forma interativa sobre codificação Unicode, ordem de bytes, endianness e o caractere BOM (U+FEFF). Envie arquivos em codificações diferentes e observe como as assinaturas BOM variam. Uma ferramenta didática prática para cursos de internacionalização e codificação de caracteres.
O Que É uma Marca de Ordem de Bytes (BOM)?
Uma marca de ordem de bytes (BOM) é um caractere Unicode (U+FEFF) colocado no início de um arquivo de texto para indicar sua codificação e ordem de bytes. A BOM foi criada para resolver um problema fundamental das codificações multibyte: arquiteturas de computador diferentes armazenam valores multibyte em ordens de bytes diferentes (endianness). Ao ler os primeiros bytes de um arquivo, um programa consegue determinar se o texto está codificado em UTF-8, UTF-16 Big Endian, UTF-16 Little Endian ou outro formato, e interpretar corretamente os bytes seguintes. A BOM é especificada no padrão Unicode e reconhecida por muitos editores de texto, navegadores web e ambientes de execução de linguagens de programação.
Como Funciona Nosso Detector de BOM
- Leitura do arquivo: quando você envia um arquivo, nossa ferramenta lê os primeiros 1024 bytes usando a API FileReader do navegador. Apenas o cabeçalho é lido, o que torna o processo de detecção rápido mesmo para arquivos grandes.
- Correspondência de assinaturas BOM: os bytes no início do arquivo são comparados com um banco de dados de 10 assinaturas BOM conhecidas. Cada assinatura é verificada byte a byte para correspondência exata. Se uma BOM for encontrada, a codificação, o endianness e o conjunto de caracteres IANA são identificados.
- Verificação aprofundada: além de checar o início do arquivo, a ferramenta procura mais adiante (até 128 bytes) por outros padrões semelhantes a BOM. Isso ajuda a detectar arquivos concatenados ou estruturas de arquivo incomuns que possam ter BOMs em deslocamentos diferentes de zero.
- Geração de recomendações: com base na codificação detectada, a ferramenta oferece recomendações personalizadas sobre compatibilidade multiplataforma, eficiência de armazenamento e interoperabilidade entre ferramentas.
Quando Usar (e Não Usar) BOMs
- UTF-8 com BOM (EF BB BF): comum no Windows, mas pode causar problemas em Unix/Linux. Scripts PHP com BOM provocarão erros de «headers already sent». Scripts Python podem falhar na linha shebang. Scripts shell podem quebrar silenciosamente. Recomendado: use UTF-8 sem BOM para conteúdo web e código-fonte.
- BOMs UTF-16 (FE FF / FF FE): essenciais para identificar a ordem de bytes em arquivos UTF-16. Exigidas por algumas APIs do Windows e aplicações .NET. No entanto, arquivos UTF-16 são mais difíceis de processar com ferramentas Unix padrão (grep, sed, awk) e ocupam mais espaço em conteúdo com muito ASCII.
- BOMs UTF-32 (00 00 FE FF / FF FE 00 00): usadas muito raramente. O UTF-32 quadruplica o tamanho de armazenamento em relação ao UTF-8 para a maioria dos textos e é suportado por muito poucas aplicações. Não recomendado para uso geral.
- BOMs não Unicode: a BOM GB 18030 é usada em sistemas governamentais chineses. Outros marcadores de codificação (UTF-7, SCSU, BOCU-1, UTF-1) estão obsoletos ou são extremamente raros em aplicações modernas.
Privacidade, Segurança e Limitações
Nosso Detector de BOM processa tudo inteiramente no seu navegador. Apenas os primeiros 1024 bytes de cada arquivo são lidos - nenhum dado é enviado a qualquer servidor. A ferramenta é 100 % gratuita, sem cadastro, sem conta e sem limites de uso.
Assinaturas BOM suportadas: UTF-8, UTF-16 BE/LE, UTF-32 BE/LE, UTF-7, UTF-1, SCSU, BOCU-1 e GB 18030 - cobrindo todas as assinaturas BOM padrão definidas no padrão Unicode e nas especificações de codificação relacionadas.
Limitações: a detecção de BOM identifica apenas o marcador de codificação - ela não valida se o restante do arquivo está em conformidade com essa codificação. Arquivos sem BOM (como a maioria dos arquivos UTF-8 em Unix/Linux) serão exibidos como «Nenhum BOM encontrado». Arquivos binários podem começar por coincidência com bytes que correspondem a assinaturas BOM, podendo gerar falsos positivos. A ferramenta lê apenas os primeiros 1024 bytes; BOMs além desse intervalo não serão detectadas.
Perguntas frequentes
Uma marca de ordem de bytes (BOM) é um caractere Unicode (U+FEFF) codificado no início de um arquivo de texto que identifica a codificação e a ordem de bytes usadas. Ela ajuda o software a interpretar corretamente a codificação do texto sem precisar adivinhar.
Nosso Detector de BOM suporta 10 assinaturas BOM: UTF-8 com BOM, UTF-16 Big Endian, UTF-16 Little Endian, UTF-32 Big Endian, UTF-32 Little Endian, UTF-7, UTF-1, SCSU, BOCU-1 e GB 18030.
Recomenda-se UTF-8 sem BOM para compatibilidade multiplataforma, especialmente em desenvolvimento web e código-fonte. O BOM pode causar problemas com PHP, Python e scripts shell em sistemas Unix/Linux.
Sim. Arquivos binários podem começar por coincidência com bytes que correspondem a assinaturas BOM. Considere o contexto do tipo de arquivo ao interpretar os resultados.
Os primeiros 1024 bytes (1 KB) são lidos, o que é mais que suficiente, já que as BOM têm no máximo 4 bytes.
Sim. Apenas os primeiros 1024 bytes são lidos e todo o processamento é feito no navegador - nenhum dado é enviado.
A ferramenta exibe «Nenhum BOM encontrado» para arquivos sem BOM. A maioria dos arquivos UTF-8 em Unix/Linux/macOS é salva sem BOM, que é a prática recomendada.
Sim! 100 % gratuito, sem cadastro, sem conta, sem chave de API e sem limites de uso.