#418 · Idioma y Unicode

Limpieza de texto transliterado

Depura transliteraciones académicas, bibliográficas o de datos multilingües. Normaliza Unicode a NFC o NFD, unifica signos equivalentes, elimina caracteres invisibles y corrige espacios repetidos, manteniendo los diacríticos salvo que la normalización elegida cambie su representación interna.

Entrada de texto

Procesamiento local en el navegador
Espacio publicitario

Cómo usar esta herramienta de texto

  1. Pega o escribe el contenido en el cuadro de entrada.
  2. Ajusta únicamente las opciones que correspondan a tu objetivo.
  3. Pulsa el botón principal o usa Ctrl/Cmd + Enter.
  4. Revisa el resultado y las métricas; copia o descarga el informe si lo necesitas.

Qué hace esta herramienta

Estandariza la representación técnica de transliteraciones para reducir diferencias causadas por Unicode, espacios y puntuación equivalente.

Limpia invisibles, normaliza separadores y permite elegir NFC o NFD sin eliminar deliberadamente los diacríticos.

NFC y NFD pueden verse iguales pero producir secuencias de código distintas. Elige la forma requerida por tu sistema de destino.

Ejemplo

Entrada: Šāh ‘Abbās — Ḥusayn

Salida: Šāh 'Abbās - Ḥusayn

Casos de uso

  • Revisar texto antes de publicarlo o importarlo en otro sistema.
  • Detectar problemas invisibles que pueden afectar búsquedas, copias o comparaciones.
  • Preparar datos multilingües para hojas de cálculo, CMS, bases de datos o código.

Consejos para obtener mejores resultados

  • Usa NFC para la mayoría de aplicaciones web y bases de datos.
  • Usa NFD solo si tu flujo lingüístico lo requiere explícitamente.
  • Conserva diacríticos en datos académicos o bibliográficos.
  • Estandariza signos antes de detectar duplicados.

Detalles del procesamiento

El procesamiento se realiza localmente con JavaScript y reglas Unicode explícitas. La herramienta no necesita API, cuenta externa ni transferencia del contenido a un servidor.

Los resultados dependen de la representación Unicode de la entrada y no sustituyen una revisión lingüística especializada cuando el significado depende del contexto, la ortografía o un estándar editorial concreto.

Preguntas frecuentes

¿Qué normalización Unicode conviene para una transliteración con diacríticos?

NFC suele ser adecuada para uso general porque combina secuencias equivalentes cuando existe una forma compuesta.

¿NFD elimina los acentos de una transliteración?

No. NFD separa letras base y marcas combinantes, pero conserva visualmente los diacríticos.

¿La limpieza convierte automáticamente entre sistemas de transliteración?

No. No transforma, por ejemplo, un estándar académico en otro; solo limpia la representación del texto existente.

¿Se pueden unificar guiones largos y apóstrofos tipográficos?

Sí. La opción de signos los convierte a equivalentes ASCII sencillos para facilitar coincidencias.

¿Cómo detectar si una transliteración contiene caracteres combinantes?

El resultado muestra una métrica de marcas combinantes calculada sobre la forma NFD del texto.

Resumen de módulos

MóduloFunción
UnicodeNFC, NFD o sin normalización
SignosUnificación tipográfica
InvisiblesLimpieza de caracteres de ancho cero

Explorar Idioma y Unicode

Consulta más herramientas para analizar, normalizar y transformar texto multilingüe y caracteres Unicode.

Ver categoría Idioma y Unicode