#198 · Conversión y codificación

Codificador UTF-8

Codifica cualquier texto Unicode como una secuencia real de bytes UTF-8 utilizando las capacidades nativas del navegador. Puedes ver esos bytes en hexadecimal, decimal o binario, comprobar el tamaño total y comparar el número de caracteres con el número de bytes. Es especialmente útil para depurar APIs, archivos, protocolos y problemas de longitud multibyte.

Entrada de texto

Procesamiento local en el navegador
Espacio publicitario

Cómo usar esta herramienta de texto

  1. Escribe el texto Unicode.
  2. Elige hexadecimal, decimal o binario.
  3. Pulsa «Codificar en UTF-8» y copia la secuencia de bytes.

Qué hace esta herramienta

Transforma puntos de código Unicode en la secuencia de bytes definida por UTF-8.

Se usa TextEncoder del navegador y después cada byte se presenta en la base seleccionada.

La representación hexadecimal muestra bytes, no puntos de código Unicode.

Ejemplo

Entrada:

ñ

Resultado:

C3 B1

Casos de uso

  • Depurar contenido enviado por APIs o sockets.
  • Comprobar el tamaño real en bytes de texto internacional.
  • Entender por qué un emoji ocupa varios bytes.

Consejos para obtener mejores resultados

  • Hexadecimal es el formato más habitual para inspeccionar bytes.
  • No cuentes caracteres como bytes cuando haya texto no ASCII.
  • Usa el decodificador UTF-8 para reconstruir texto a partir de bytes.
  • Los saltos de línea también tienen representación en bytes.

Detalles del procesamiento

TextEncoder aplica UTF-8 estándar y devuelve un Uint8Array; la herramienta solo cambia la representación visual de esos bytes.

No añade BOM ni interpreta codificaciones distintas de UTF-8.

Preguntas frecuentes

¿Cómo convierto una letra ñ a bytes UTF-8?

En hexadecimal, ñ se codifica como C3 B1.

¿Por qué un emoji ocupa más bytes que un carácter ASCII?

UTF-8 usa entre uno y cuatro bytes por punto de código. Los caracteres ASCII usan uno; muchos símbolos y emojis necesitan varios.

¿Puedo ver los bytes UTF-8 en decimal o binario?

Sí. El selector de formato permite cambiar entre hexadecimal, decimal y binario.

¿La herramienta añade un BOM UTF-8?

No. Codifica únicamente el contenido introducido y no antepone una marca BOM.

¿La cantidad de bytes UTF-8 es igual al número de caracteres?

Solo para texto compuesto completamente por caracteres ASCII de un byte. El texto internacional suele ocupar más bytes.

Resumen de módulos

MóduloFunción
TextEncoderGenera bytes UTF-8 reales
Formatos de byteHexadecimal, decimal o binario
MétricasCompara caracteres y bytes
Explorar más herramientas de conversión y codificación
Ver el centro de categoría con más utilidades relacionadas.