#494 · Herramienta para desarrolladores

BOM Detector

Detecta marcas de orden de bytes visibles al principio de una entrada y distingue el BOM Unicode U+FEFF de secuencias mojibake frecuentes como . También cuenta apariciones internas que pueden provocar encabezados inesperados, claves distintas o errores al comparar texto. La utilidad está orientada a contenido pegado o leído como texto en el navegador; no pretende sustituir un inspector hexadecimal cuando necesitas identificar bytes UTF-16 o UTF-32 antes de su decodificación.

Datos de entrada

Texto para inspeccionar
Espacio publicitario

Cómo usar esta herramienta para desarrolladores

  1. Pega el texto o carga un archivo de texto.
  2. Ejecuta el detector.
  3. Comprueba si existe U+FEFF al inicio o dentro del contenido.
  4. Si necesitas conocer los bytes originales, confirma el resultado con un visor hexadecimal.

Qué hace esta herramienta para desarrolladores

El diagnóstico indica si el string que recibió JavaScript conserva una marca U+FEFF y si aparecen secuencias típicas de un BOM UTF-8 mal decodificado.

Se inspecciona el primer code point, se cuentan U+FEFF posteriores y se buscan prefijos mojibake comunes. No se infieren bytes que el navegador ya haya eliminado al decodificar el archivo.

File.text() y algunos editores pueden retirar el BOM UTF-8 antes de que llegue a la herramienta; ausencia de U+FEFF no prueba que el archivo original no tuviera BOM.

Ejemplo

Entrada con un carácter U+FEFF inicial:

nombre,valor
uno,1

El detector informa de un BOM inicial y muestra el texto sin esa marca para inspección.

Casos de uso

  • Depurar CSV con una primera columna inesperada.
  • Revisar JSON o scripts copiados desde editores distintos.
  • Localizar U+FEFF insertados en mitad de un archivo.
  • Distinguir un BOM real de mojibake visible.

Consejos para obtener resultados fiables

  • Usa un inspector de bytes para UTF-16/UTF-32.
  • Comprueba el primer carácter cuando una clave parece correcta pero no coincide.
  • No elimines U+FEFF internos automáticamente sin conocer su función.
  • Conserva una copia del archivo original antes de normalizarlo.

Detalles del procesamiento

JavaScript representa U+FEFF como un único carácter. La herramienta comprueba su posición, genera una vista sin el BOM inicial y busca la cadena , señal habitual de bytes EF BB BF interpretados con una codificación incorrecta.

El análisis trabaja sobre texto ya decodificado. No puede distinguir de forma fiable BOM UTF-16 LE, UTF-16 BE, UTF-32 LE o UTF-32 BE si los bytes originales no están disponibles.

Preguntas frecuentes

¿Cómo detecto un BOM UTF-8 al principio de un CSV?

Si el BOM llega al navegador como U+FEFF, la herramienta lo identifica en la primera posición. Algunos métodos de lectura pueden retirarlo antes.

¿Qué significa ver  al principio de un archivo?

Suele indicar que los bytes EF BB BF de un BOM UTF-8 se interpretaron con una codificación de un solo byte en lugar de UTF-8.

¿Un BOM es obligatorio en UTF-8?

No. UTF-8 no necesita BOM para determinar el orden de bytes, aunque algunos programas lo escriben para señalar la codificación.

¿La herramienta puede detectar BOM de UTF-16 y UTF-32?

No de forma fiable sobre texto ya decodificado. Para esos casos necesitas inspeccionar los bytes originales del archivo.

¿Puedo eliminar automáticamente el BOM detectado?

La salida muestra el contenido sin un U+FEFF inicial para facilitar la revisión, pero conviene confirmar primero que realmente es una marca de archivo y no un carácter intencionado.

Resumen técnico

ElementoValor
CategoríaCodificación y decodificación
Número494
EjecuciónLocal en el navegador
DependenciasNinguna