#026 · Herramienta para desarrolladores

Unicode Encoder

Representa texto Unicode mediante escapes explícitos para depuración, archivos fuente y pruebas de compatibilidad. Puedes convertir cada punto de código a formato JavaScript \uXXXX, incluida la pareja de sustitutos necesaria fuera del BMP, o a notación U+XXXX. El resultado deja visible qué puntos de código forman una cadena, algo especialmente útil con emojis, caracteres combinados y alfabetos que no se distinguen fácilmente a simple vista.

Datos de entrada

Texto Unicode
Espacio publicitario

Cómo usar esta herramienta para desarrolladores

  1. Pega texto Unicode.
  2. Elige escapes JavaScript o puntos de código U+.
  3. Pulsa Codificar Unicode.
  4. Compara puntos de código, unidades UTF-16 y bytes UTF-8.

Qué hace esta herramienta para desarrolladores

La salida muestra los puntos de código del texto sin depender de la apariencia de la fuente.

Itera por puntos de código con el protocolo Unicode de JavaScript y genera notación U+ o escapes UTF-16 compatibles con \uXXXX.

Un carácter visible puede estar formado por varios puntos de código, por ejemplo una letra más una marca combinante.

Ejemplo

Entrada

ñ😀

Salida

\u00F1\uD83D\uDE00

Casos de uso

  • Depurar emojis y caracteres invisibles.
  • Crear fixtures con escapes Unicode.
  • Inspeccionar diferencias entre UTF-8 y UTF-16.

Consejos para obtener resultados fiables

  • Distingue punto de código de grafema visible.
  • Para JavaScript moderno también existe la sintaxis \u{1F600}.
  • Comprueba normalización si dos cadenas se ven iguales pero difieren.
  • No confundas Unicode escaping con cifrado.

Detalles del procesamiento

JavaScript itera la cadena por puntos de código mediante [...texto]. Para valores superiores a U+FFFF se calculan los sustitutos alto y bajo de UTF-16.

No normaliza NFC/NFD ni segmenta grafemas; representa exactamente la secuencia de puntos de código introducida.

Preguntas frecuentes

¿Cómo convertir un emoji a secuencias Unicode \uXXXX?

Selecciona el formato JavaScript. Los emojis fuera del BMP se convierten en una pareja de sustitutos UTF-16.

¿Qué diferencia hay entre U+1F600 y \uD83D\uDE00?

U+1F600 es el punto de código Unicode; los dos escapes representan sus unidades sustitutas UTF-16.

¿Por qué una letra acentuada puede tener más de un punto de código?

Unicode permite formas descompuestas, por ejemplo una letra base seguida de una marca combinante.

¿El codificador Unicode cambia la normalización del texto?

No. Conserva la secuencia de entrada sin aplicar NFC, NFD, NFKC ni NFKD.

¿Los escapes Unicode son una forma de cifrado?

No. Son otra representación legible de los mismos caracteres.

Módulos del procesamiento

MóduloFunción
Iterador UnicodeLee puntos de código completos.
Generador de escapesProduce U+ o \uXXXX.
MétricasCompara puntos de código, UTF-16 y UTF-8.