#480 · Utilidad y seguridad

Contador de bytes UTF-8

Cuenta los bytes reales que ocupa un texto codificado en UTF-8 usando el codificador integrado del navegador. Además del total, muestra puntos de código, unidades UTF-16, promedio de bytes por punto de código y un desglose de cada símbolo con su valor Unicode y su tamaño en UTF-8, útil para detectar caracteres multibyte.

Entrada de texto

Procesamiento local
Espacio publicitario

Cómo usar esta herramienta de texto

  • Introduce o pega el contenido en el cuadro de entrada.
  • Ajusta las opciones específicas de esta herramienta si aparecen disponibles.
  • Pulsa el botón principal o usa Ctrl/Cmd + Enter.
  • Revisa el resultado, las métricas y la interpretación antes de copiar o descargar.

Qué hace esta herramienta

Mide el tamaño UTF-8 real de un texto y muestra qué caracteres consumen más de un byte.

TextEncoder obtiene los bytes UTF-8 de la cadena completa y de cada punto de código para producir un conteo exacto en el navegador.

Un grafema visible puede contener varios puntos de código, por ejemplo ciertos emoji combinados. Esta herramienta informa por punto de código Unicode.

Ejemplo

Entrada: Hola, España 👋

Resultado: ejecuta el ejemplo integrado para obtener una salida verificable con la lógica de esta página.

Casos de uso

  • Comprobar o transformar texto rápidamente sin instalar software.
  • Preparar ejemplos para documentación, soporte o formación.
  • Verificar formatos y tamaños antes de copiar datos a otro sistema.

Consejos para obtener mejores resultados

  • Usa el botón Ejemplo para comprobar el comportamiento antes de trabajar con datos propios.
  • Revisa los caracteres especiales y separadores cuando el formato sea sensible.
  • Copia o descarga el resultado solo después de revisar la interpretación.
  • Para entradas muy largas, procesa bloques razonables si necesitas inspección detallada.

Detalles del procesamiento

Todo el procesamiento principal se ejecuta en JavaScript dentro del navegador. La herramienta calcula la salida a partir del texto actual y de las opciones visibles, sin depender de una API externa.

Un grafema visible puede contener varios puntos de código, por ejemplo ciertos emoji combinados. Esta herramienta informa por punto de código Unicode.

Preguntas frecuentes

¿Cómo contar los bytes UTF-8 de un texto con emoji?

Pega el texto y ejecuta el contador. TextEncoder calcula los bytes reales, incluidos los caracteres emoji y otros símbolos multibyte.

¿Por qué “ñ” ocupa más bytes que una letra ASCII en UTF-8?

UTF-8 asigna un byte a caracteres ASCII básicos y usa secuencias de varios bytes para muchos otros puntos de código Unicode.

¿Puntos de código y caracteres visibles son siempre lo mismo?

No. Un símbolo visible puede estar formado por varios puntos de código, especialmente en emoji con modificadores o secuencias combinadas.

¿El contador UTF-8 incluye saltos de línea y espacios?

Sí. Todos los caracteres de la cadena, incluidos espacios y saltos de línea, forman parte del conteo de bytes.

¿El conteo UTF-8 se realiza en el navegador?

Sí. Se utiliza TextEncoder localmente y el contenido no necesita enviarse a un servicio externo.

Resumen de módulos

MóduloFunción
EntradaTexto procesado localmente en el navegador
ProcesamientoTextEncoder obtiene los bytes UTF-8 de la cadena completa y de cada punto de código para producir un conteo exacto en el navegador.
SalidaResultado copiable y descargable
PrivacidadSin API externa para el procesamiento