Detector de BOM
Sube cualquier archivo para detectar las marcas de orden de bytes (BOM) e identificar la codificación de texto. Nuestro Detector de BOM lee la cabecera del archivo y la compara con las firmas BOM conocidas de UTF-8, UTF-16 (Big Endian y Little Endian), UTF-32, UTF-7, GB 18030 y más. Consulta el volcado hexadecimal interactivo con los bytes BOM resaltados, obtén información detallada de la codificación con detección de endianness y recibe recomendaciones prácticas para la compatibilidad multiplataforma. Todo el procesamiento se realiza íntegramente en tu navegador: sin subidas y sin registro.
Upload any file to detect Byte Order Marks (BOMs) - hidden byte sequences at the start of files that identify the text encoding and byte order. Supports UTF-8, UTF-16 (BE/LE), UTF-32 (BE/LE), UTF-7, GB 18030, and other BOM signatures. Displays the hex dump with BOM bytes highlighted, encoding details, and recommendations for cross-platform compatibility. All processing is done entirely in your browser - no uploads, no signup required.
Drag & drop a file here, or click to select
Detects BOM signatures in text and binary files
¿Por Qué Usar Nuestro Detector de BOM?
- Detección exhaustiva de firmas BOM: detecta todas las firmas estándar de marca de orden de bytes: UTF-8 (EF BB BF), UTF-16 Big Endian (FE FF), UTF-16 Little Endian (FF FE), UTF-32 Big Endian (00 00 FE FF), UTF-32 Little Endian (FF FE 00 00), UTF-7 (+/v), UTF-1, SCSU, BOCU-1 y GB 18030. Cada BOM se identifica con su nombre de codificación, conjunto de caracteres IANA, endianness y contexto de uso habitual.
- Visualización interactiva en hexadecimal y ASCII: muestra los primeros 48 bytes del archivo como un volcado hexadecimal interactivo con representación ASCII en paralelo. Los bytes BOM detectados se resaltan en ámbar para facilitar la identificación visual. Los datos hexadecimales se pueden copiar al portapapeles con un clic para documentación o análisis posterior.
- Recomendaciones de codificación: ofrece recomendaciones prácticas según la codificación BOM detectada. Avisa sobre problemas de compatibilidad multiplataforma; por ejemplo, advierte cuando se detecta una BOM UTF-8 en código fuente que puede causar problemas en sistemas Unix/Linux, o sugiere convertir de UTF-16 a UTF-8 para mejorar la eficiencia de almacenamiento y la compatibilidad con herramientas.
- Procesamiento 100 % privado en el navegador: toda la detección de BOM ocurre íntegramente en tu navegador. Solo se leen los primeros 1024 bytes del archivo mediante la API FileReader: nunca se sube ningún dato a ningún servidor. Tus archivos nunca salen de tu dispositivo, por lo que es seguro analizar archivos confidenciales o propietarios.
Casos de Uso Habituales del Detector de BOM
- Depuración de problemas de codificación en desarrollo web: cuando los archivos PHP, Python o JavaScript muestran una salida inesperada (como caracteres  al inicio de una página web), la BOM UTF-8 suele ser la culpable. Usa nuestro Detector de BOM para identificar rápidamente si los archivos de código fuente tienen BOM y luego conviértelos a UTF-8 sin BOM para una representación limpia.
- Compatibilidad de archivos multiplataforma: los archivos creados en Windows a menudo incluyen una BOM UTF-8 que causa problemas al transferirlos a sistemas Unix/Linux/macOS. Los scripts con línea shebang (#!) pueden fallar, los archivos de configuración pueden leerse mal y las herramientas de diferencias pueden mostrar diferencias fantasma. Detecta las BOM para diagnosticar y resolver estos problemas de compatibilidad.
- Verificación de codificación en CSV y archivos de datos: los archivos CSV exportados desde Microsoft Excel suelen incluir una BOM UTF-8, lo que puede afectar a cómo las herramientas de procesamiento de datos analizan el archivo. Detecta la BOM y la codificación para garantizar que tus canalizaciones ETL, importaciones de bases de datos y herramientas de análisis de datos manejen el archivo correctamente.
- Migración de formatos de archivo heredados: al migrar sistemas heredados que usan codificación UTF-16, UTF-32 o GB 18030 a los estándares UTF-8 modernos, usa la detección de BOM para identificar qué archivos necesitan conversión. El motor de recomendaciones ofrece orientación sobre la mejor estrategia de conversión para cada tipo de codificación.
- QA y validación de archivos en canalizaciones CI/CD: integra la detección de BOM en tu flujo de control de calidad. Asegúrate de que todo el código fuente, los archivos de configuración y la documentación sigan los estándares de codificación de tu equipo. Detecta y marca los archivos con BOM inesperadas antes de que causen problemas en producción.
- Informática y educación sobre Unicode: aprende de forma interactiva sobre la codificación Unicode, el orden de bytes, el endianness y el carácter BOM (U+FEFF). Sube archivos con distintas codificaciones y observa cómo difieren las firmas BOM. Una herramienta didáctica práctica para cursos de internacionalización y codificación de caracteres.
¿Qué es una marca de orden de bytes (BOM)?
Una marca de orden de bytes (BOM) es un carácter Unicode (U+FEFF) que se coloca al inicio de un archivo de texto para indicar su codificación y orden de bytes. La BOM se diseñó para resolver un problema fundamental de las codificaciones multibyte: distintas arquitecturas de computadora almacenan valores multibyte en órdenes de bytes diferentes (endianness). Al leer los primeros bytes de un archivo, un programa puede determinar si el texto está codificado en UTF-8, UTF-16 Big Endian, UTF-16 Little Endian u otro formato, e interpretar correctamente los bytes siguientes. La BOM está especificada en el estándar Unicode y la reconocen muchos editores de texto, navegadores web y entornos de ejecución de lenguajes de programación.
Cómo Funciona Nuestro Detector de BOM
- Lectura del archivo: cuando subes un archivo, nuestra herramienta lee los primeros 1024 bytes con la API FileReader del navegador. Solo se lee la cabecera, lo que hace que el proceso de detección sea rápido incluso con archivos grandes.
- Coincidencia de firmas BOM: los bytes al inicio del archivo se comparan con una base de datos de 10 firmas BOM conocidas. Cada firma se comprueba byte a byte para una coincidencia exacta. Si se encuentra una BOM, se identifican la codificación, el endianness y el conjunto de caracteres IANA.
- Escaneo profundo: además de comprobar el inicio del archivo, la herramienta busca más a fondo (hasta 128 bytes) otros patrones similares a BOM. Esto ayuda a detectar archivos concatenados o estructuras de archivo inusuales que puedan tener BOM en desplazamientos distintos de cero.
- Generación de recomendaciones: según la codificación detectada, la herramienta ofrece recomendaciones personalizadas sobre compatibilidad multiplataforma, eficiencia de almacenamiento e interoperabilidad entre herramientas.
Cuándo Usar (y Cuándo No) BOM
- UTF-8 con BOM (EF BB BF): habitual en Windows, pero puede causar problemas en Unix/Linux. Los scripts PHP con BOM provocarán errores de «headers already sent». Los scripts Python pueden fallar en la línea shebang. Los scripts de shell pueden romperse silenciosamente. Recomendado: usa UTF-8 sin BOM para contenido web y código fuente.
- BOM de UTF-16 (FE FF / FF FE): esenciales para identificar el orden de bytes en archivos UTF-16. Requeridas por algunas API de Windows y aplicaciones .NET. Sin embargo, los archivos UTF-16 son más difíciles de procesar con herramientas Unix estándar (grep, sed, awk) y ocupan más espacio en contenido con mucho ASCII.
- BOM de UTF-32 (00 00 FE FF / FF FE 00 00): muy raramente usadas. UTF-32 cuadruplica el tamaño de almacenamiento respecto a UTF-8 para la mayoría del texto y lo admiten muy pocas aplicaciones. No se recomienda para uso general.
- BOM no Unicode: la BOM de GB 18030 se usa en sistemas gubernamentales chinos. Otros marcadores de codificación (UTF-7, SCSU, BOCU-1, UTF-1) están obsoletos o son extremadamente raros en aplicaciones modernas.
Privacidad, Seguridad y Limitaciones
Nuestro Detector de BOM procesa todo íntegramente en tu navegador. Solo se leen los primeros 1024 bytes de cada archivo: nunca se sube ningún dato a ningún servidor. La herramienta es 100 % gratuita, sin registro, sin cuenta y sin límites de uso.
Firmas BOM compatibles: UTF-8, UTF-16 BE/LE, UTF-32 BE/LE, UTF-7, UTF-1, SCSU, BOCU-1 y GB 18030, lo que cubre todas las firmas BOM estándar definidas en el estándar Unicode y en las especificaciones de codificación relacionadas.
Limitaciones: la detección de BOM solo identifica el marcador de codificación, no valida si el resto del archivo cumple esa codificación. Los archivos sin BOM (como la mayoría de los archivos UTF-8 en Unix/Linux) se mostrarán como «No se encontró BOM». Los archivos binarios pueden empezar casualmente con bytes que coincidan con firmas BOM, lo que puede producir falsos positivos. La herramienta solo lee los primeros 1024 bytes; las BOM más allá de este rango no se detectarán.
Preguntas frecuentes
Una marca de orden de bytes (BOM) es un carácter Unicode (U+FEFF) codificado al inicio de un archivo de texto que identifica la codificación y el orden de bytes utilizados. Ayuda al software a interpretar correctamente la codificación del texto sin tener que adivinarla.
Nuestro Detector de BOM admite 10 firmas BOM: UTF-8 con BOM, UTF-16 Big Endian, UTF-16 Little Endian, UTF-32 Big Endian, UTF-32 Little Endian, UTF-7, UTF-1, SCSU, BOCU-1 y GB 18030.
Se recomienda UTF-8 sin BOM para la compatibilidad multiplataforma, especialmente en desarrollo web y código fuente. La BOM puede causar problemas con PHP, Python y scripts de shell en sistemas Unix/Linux.
Sí. Los archivos binarios pueden empezar casualmente con bytes que coinciden con firmas BOM. Ten en cuenta el contexto del tipo de archivo al interpretar los resultados.
Se leen los primeros 1024 bytes (1 KB), más que suficiente, ya que las BOM tienen como máximo 4 bytes de longitud.
Sí. Solo se leen los primeros 1024 bytes y todo el procesamiento ocurre en el navegador: nunca se sube ningún dato.
La herramienta indica «No se encontró BOM» en archivos sin BOM. La mayoría de los archivos UTF-8 en Unix/Linux/macOS se guardan sin BOM, que es la práctica recomendada.
¡Sí! 100 % gratuito, sin registro, sin cuenta, sin clave de API y sin límites de uso.