#414 · Idioma y Unicode

Contador de texto coreano

Analiza texto coreano y separa las principales unidades Unicode: sílabas hangul precompuestas, jamo, palabras que contienen coreano, caracteres totales y líneas. Resulta útil para revisar contenido, subtítulos, interfaces, datasets y límites de longitud sin modificar el texto original.

Entrada de texto

Procesamiento local en el navegador
Espacio publicitario

Cómo usar esta herramienta de texto

  1. Pega o escribe el contenido en el cuadro de entrada.
  2. Ajusta únicamente las opciones que correspondan a tu objetivo.
  3. Pulsa el botón principal o usa Ctrl/Cmd + Enter.
  4. Revisa el resultado y las métricas; copia o descarga el informe si lo necesitas.

Qué hace esta herramienta

Cuenta componentes coreanos según sus rangos Unicode sin alterar el texto, diferenciando sílabas hangul precompuestas y jamo.

Recorre el texto por puntos de código, clasifica Hangul Syllables y bloques de jamo, y cuenta tokens no vacíos que contienen escritura coreana.

El concepto de “palabra” se aproxima por separación con espacios; el coreano puede requerir análisis morfológico para una segmentación lingüística exacta.

Ejemplo

Entrada: 안녕하세요 한국어

La salida informa por separado sílabas hangul, palabras con coreano y caracteres totales.

Casos de uso

  • Revisar texto antes de publicarlo o importarlo en otro sistema.
  • Detectar problemas invisibles que pueden afectar búsquedas, copias o comparaciones.
  • Preparar datos multilingües para hojas de cálculo, CMS, bases de datos o código.
  • Medir contenido multilingüe antes de aplicar límites de caracteres.

Consejos para obtener mejores resultados

  • Usa el conteo de sílabas para límites de interfaz o subtítulos.
  • Revisa jamo si trabajas con datos normalizados o teclados IME.
  • No interpretes el conteo de palabras como análisis morfológico.
  • Compara textos con el mismo método de normalización Unicode.

Detalles del procesamiento

El procesamiento se realiza localmente con JavaScript y reglas Unicode explícitas. La herramienta no necesita API, cuenta externa ni transferencia del contenido a un servidor.

Los resultados dependen de la representación Unicode de la entrada y no sustituyen una revisión lingüística especializada cuando el significado depende del contexto, la ortografía o un estándar editorial concreto.

Preguntas frecuentes

¿Cómo contar caracteres hangul en un texto coreano?

Pega el texto y la herramienta contará las sílabas hangul precompuestas de U+AC00 a U+D7A3.

¿El contador distingue hangul compuesto y jamo?

Sí. Las sílabas precompuestas y los rangos de jamo se muestran por separado.

¿Qué significa “palabras con coreano” en el resultado?

Son tokens separados por espacios que contienen al menos un carácter hangul o jamo.

¿Los emojis y signos cuentan como caracteres totales?

Sí. El total se basa en puntos de código JavaScript y puede incluir símbolos, signos y emojis como unidades del texto.

¿Sirve para comprobar límites de subtítulos coreanos?

Sí como conteo de longitud; para velocidad de lectura o segmentación de subtítulos necesitas criterios adicionales.

Resumen de módulos

MóduloFunción
HangulConteo de sílabas precompuestas
JamoConteo de bloques jamo Unicode
TokensPalabras que contienen coreano

Explorar Idioma y Unicode

Consulta más herramientas para analizar, normalizar y transformar texto multilingüe y caracteres Unicode.

Ver categoría Idioma y Unicode