#416 · Idioma y Unicode

Contador de texto chino

Analiza texto chino y cuenta caracteres Han, letras latinas, números, signos de puntuación, líneas y longitud total. Es útil para edición, localización, anuncios, formularios y datasets cuando necesitas medir el contenido sin depender de segmentación de palabras.

Entrada de texto

Procesamiento local en el navegador
Espacio publicitario

Cómo usar esta herramienta de texto

  1. Pega o escribe el contenido en el cuadro de entrada.
  2. Ajusta únicamente las opciones que correspondan a tu objetivo.
  3. Pulsa el botón principal o usa Ctrl/Cmd + Enter.
  4. Revisa el resultado y las métricas; copia o descarga el informe si lo necesitas.

Qué hace esta herramienta

Cuenta ideogramas Han y otros grupos de caracteres sin intentar segmentar palabras, lo que evita depender de diccionarios externos.

Clasifica puntos de código mediante propiedades Unicode Han, Latin, Number y Punctuation, y calcula también líneas y longitud total.

Han es una escritura compartida por chino, japonés y otros contextos. El conteo no determina por sí solo el idioma de cada ideograma.

Ejemplo

Entrada: 中文 ABC 123。

El resultado separa caracteres Han, letras latinas, dígitos y puntuación.

Casos de uso

  • Revisar texto antes de publicarlo o importarlo en otro sistema.
  • Detectar problemas invisibles que pueden afectar búsquedas, copias o comparaciones.
  • Preparar datos multilingües para hojas de cálculo, CMS, bases de datos o código.
  • Medir contenido multilingüe antes de aplicar límites de caracteres.

Consejos para obtener mejores resultados

  • Usa caracteres Han para límites editoriales basados en ideogramas.
  • No confundas caracteres con palabras; el chino no siempre usa espacios.
  • Combina con el comprobador de simplificado/tradicional si necesitas revisar variantes.
  • Verifica por bytes aparte cuando una plataforma imponga límites de almacenamiento.

Detalles del procesamiento

El procesamiento se realiza localmente con JavaScript y reglas Unicode explícitas. La herramienta no necesita API, cuenta externa ni transferencia del contenido a un servidor.

Los resultados dependen de la representación Unicode de la entrada y no sustituyen una revisión lingüística especializada cuando el significado depende del contexto, la ortografía o un estándar editorial concreto.

Preguntas frecuentes

¿Cómo contar caracteres chinos sin contar espacios como ideogramas?

La métrica “Caracteres Han” cuenta solo caracteres con script Unicode Han; los espacios quedan fuera de esa cifra.

¿El contador separa chino simplificado y tradicional?

No. Para esa revisión utiliza el comprobador específico de chino simplificado y tradicional.

¿Un carácter Han equivale siempre a una palabra china?

No. Una palabra puede contener uno o varios caracteres, y la segmentación lingüística requiere un método diferente.

¿Se cuentan letras inglesas y números dentro del mismo texto?

Sí. Se muestran métricas separadas para letras latinas y caracteres numéricos.

¿El total de caracteres coincide con el límite de bytes de una plataforma?

No necesariamente. Este total mide puntos de código; un límite en bytes UTF-8 puede producir una cifra distinta.

Resumen de módulos

MóduloFunción
HanConteo de ideogramas por Unicode
PuntuaciónConteo de signos
MixtoLetras latinas y números

Explorar Idioma y Unicode

Consulta más herramientas para analizar, normalizar y transformar texto multilingüe y caracteres Unicode.

Ver categoría Idioma y Unicode