#173 · Conversión y codificación

Texto a Unicode

Convierte cualquier texto en una secuencia de puntos de código Unicode con formato U+XXXX. La herramienta trabaja por carácter Unicode real, por lo que reconoce correctamente emojis y símbolos que ocupan pares sustitutos en UTF-16. Es útil para depurar problemas de codificación, identificar caracteres invisibles, documentar símbolos, comparar variantes visualmente parecidas o preparar datos para tareas técnicas en las que necesitas conocer el valor exacto de cada carácter.

Entrada de texto

Procesamiento local en el navegador
Espacio publicitario

Cómo usar esta herramienta de texto

  1. Escribe o pega el texto original.
  2. Ejecuta “Convertir a Unicode”.
  3. Consulta la secuencia U+XXXX en el mismo orden que el texto.
  4. Copia o descarga los puntos de código si los necesitas en documentación o código.

Qué hace esta herramienta

Muestra el punto de código Unicode correspondiente a cada carácter, usando al menos cuatro dígitos hexadecimales y más cuando el valor lo requiere.

La cadena se recorre por puntos de código mediante iteración Unicode, evitando dividir los caracteres suplementarios en dos unidades UTF-16.

Unicode identifica caracteres mediante puntos de código; UTF-8 y UTF-16 son formas de codificarlos en bytes o unidades de almacenamiento.

Ejemplo

Entrada: Añ😀

Salida: U+0041 U+00F1 U+1F600

Casos de uso

  • Identificar emojis y símbolos por su punto de código.
  • Analizar diferencias entre caracteres visualmente similares.
  • Documentar texto internacional en especificaciones técnicas.
  • Detectar caracteres no ASCII dentro de una cadena.

Consejos para obtener mejores resultados

  • Copia la salida U+XXXX para compararla con tablas Unicode.
  • Ten en cuenta que un grafema visible puede contener varios puntos de código.
  • Usa la herramienta Unicode a texto para invertir la conversión.
  • No confundas puntos de código con bytes UTF-8.

Detalles del procesamiento

La iteración se hace por puntos de código completos. Esto permite que un emoji como 😀 se represente como U+1F600 y no como dos valores sustitutos UTF-16.

Una letra visual puede estar compuesta por varios puntos de código, por ejemplo una base más una marca combinante; la herramienta los muestra por separado.

Preguntas frecuentes

¿Cómo saber el código Unicode de una letra con tilde o una ñ?

Introduce el carácter y ejecuta la herramienta. Se mostrará su punto de código en formato U+XXXX, por ejemplo U+00F1 para ñ.

¿La herramienta reconoce emojis con códigos superiores a U+FFFF?

Sí. Recorre la cadena por puntos de código completos y puede mostrar valores como U+1F600.

¿Por qué una letra visible puede producir dos códigos Unicode?

Puede tratarse de una secuencia con una letra base y una marca combinante. Unicode permite varias composiciones visualmente equivalentes.

¿U+0041 es lo mismo que el byte UTF-8 de la letra A?

No. U+0041 es el punto de código. UTF-8 es una codificación que representa ese punto de código mediante uno o más bytes.

¿Puedo usar esta salida para volver a crear el texto original?

Sí. La herramienta Unicode a texto acepta puntos de código Unicode y reconstruye los caracteres correspondientes.

Resumen del procesamiento

ElementoDescripción
EntradaTexto o secuencia proporcionada por el usuario
ProcesamientoLa cadena se recorre por puntos de código mediante iteración Unicode, evitando dividir los caracteres suplementarios en dos unidades UTF-16.
SalidaPuntos de código Unicode