#409 · Idioma y Unicode

Detector de codificación

Revisa un texto en busca de señales típicas de problemas de codificación. Como el navegador ya recibe caracteres Unicode, la herramienta no puede identificar con certeza el juego de bytes original, pero sí puede detectar mojibake, caracteres de reemplazo y patrones sospechosos.

Entrada de texto

Texto para revisar
Espacio publicitario

Cómo usar esta herramienta de texto

  1. Pega o escribe el contenido en el área de entrada.
  2. Ajusta las opciones disponibles si necesitas cambiar el comportamiento.
  3. Pulsa el botón principal o usa Ctrl/Cmd + Enter.
  4. Revisa el resumen, las métricas y el resultado antes de copiarlo o descargarlo.

Qué hace esta herramienta

Busca patrones que suelen aparecer cuando un texto se decodifica con una codificación incorrecta.

Se buscan secuencias asociadas a mojibake y el carácter de reemplazo U+FFFD.

El resultado se genera en tu navegador. Revisa siempre el contenido antes de publicarlo o usarlo en producción.

Ejemplo

Entrada:

España, información, comillas “incorrectas” y símbolo �.

Resultado: ejecuta el ejemplo incorporado para ver una salida verificable con las mismas reglas del procesador.

Casos de uso

  • Revisión rápida antes de publicar documentación.
  • Normalización de contenido pegado desde distintas fuentes.
  • Comprobación local sin depender de servicios externos.

Consejos para obtener mejores resultados

  • Usa una entrada suficientemente representativa.
  • Conserva una copia del original antes de reemplazar contenido.
  • Revisa nombres propios, código y valores sensibles tras el procesamiento.
  • Prueba casos límite si el resultado se integrará en un flujo automatizado.

Detalles del procesamiento

El procesamiento se ejecuta localmente con JavaScript y opera sobre el texto visible en el navegador. No requiere una API externa.

El análisis se basa en patrones y no sustituye un parser, compilador o detector especializado cuando se necesita validación normativa completa.

Preguntas frecuentes

¿Puede saber si un archivo original era UTF-8 solo pegando el texto?

No con certeza. Una vez que el navegador ha convertido los bytes a Unicode, se pierde información necesaria para identificar de forma inequívoca la codificación original.

¿Qué significa encontrar secuencias como ñ o ’?

Suelen aparecer cuando bytes UTF-8 se interpretaron con una codificación de un solo byte, por lo que son señales típicas de mojibake.

¿Qué indica el carácter � en un texto?

Es U+FFFD, el carácter de reemplazo Unicode. Normalmente señala que una secuencia de bytes no pudo decodificarse correctamente.

¿La herramienta corrige automáticamente el texto dañado?

No. Señala patrones sospechosos y ofrece un diagnóstico, porque una corrección automática puede empeorar contenido cuya codificación real se desconoce.

¿Por qué un texto sin alertas puede seguir teniendo una codificación incorrecta?

Porque no todos los errores producen patrones reconocibles. La ausencia de señales solo significa que no se detectaron los casos típicos incluidos en esta comprobación.

Resumen de módulos

MóduloFunción
EntradaTexto pegado, escrito o cargado desde archivo
ProcesamientoReglas específicas del tipo de herramienta
SalidaResultado copiable y descargable