#771 · Publicación y documentos

Extractor de títulos de capítulos EPUB

Extrae títulos de capítulos a partir de fragmentos de navegación, XHTML o HTML de un EPUB pegados en el navegador. La herramienta detecta textos de enlaces del índice y encabezados habituales, elimina etiquetas y devuelve una lista limpia para revisar la estructura editorial sin modificar el archivo original.

Entrada de texto

Procesamiento editorial
Espacio publicitario

Cómo usar esta herramienta de texto

  1. Pega el texto o carga un archivo compatible.
  2. Ajusta las opciones específicas de la herramienta.
  3. Pulsa el botón principal o usa Ctrl/Cmd + Enter.
  4. Revisa el resumen, las métricas y el resultado antes de copiarlo o descargarlo.

Qué hace esta herramienta

Extrae títulos de capítulos a partir de fragmentos de navegación, XHTML o HTML de un EPUB pegados en el navegador. La herramienta detecta textos de enlaces del índice y encabezados habituales, elimina etiquetas y devuelve una lista limpia para revisar la estructura editorial sin modificar el archivo original.

Se analizan enlaces de navegación y encabezados HTML; después se decodifican entidades, se limpia el marcado y se eliminan duplicados conservando el orden de aparición.

Todo el procesamiento principal se realiza en el navegador. Revisa siempre el resultado antes de incorporarlo a un documento definitivo.

Ejemplo

Entrada:

<nav epub:type="toc"><ol><li><a href="cap1.xhtml">Introducción</a></li><li><a href="cap2.xhtml">El viaje comienza</a></li></ol></nav>
<h1>Capítulo 3: Regreso</h1>

Resultado: la herramienta aplica las reglas seleccionadas y presenta un resultado verificable en el panel derecho.

Casos de uso

  • Preparación y limpieza de manuscritos antes de maquetar.
  • Revisión de documentación técnica y material editorial.
  • Normalización de contenido procedente de varias fuentes.
  • Comprobaciones rápidas antes de una publicación o entrega.

Consejos para obtener mejores resultados

  • Trabaja con una copia del texto cuando vayas a reemplazar contenido.
  • Usa el ejemplo para confirmar el formato esperado.
  • Revisa manualmente nombres propios, numeración y referencias.
  • Procesa bloques razonables si el documento es muy extenso.
  • Exporta el resultado solo después de comprobar las métricas.

Detalles del procesamiento

Se analizan enlaces de navegación y encabezados HTML; después se decodifican entidades, se limpia el marcado y se eliminan duplicados conservando el orden de aparición.

La herramienta trabaja con patrones de texto y no sustituye una revisión editorial especializada ni valida por sí sola las normas de una editorial concreta.

Preguntas frecuentes

¿Cómo extraer títulos de capítulos desde el archivo nav.xhtml de un EPUB?

Pega el contenido de nav.xhtml o un fragmento equivalente. La herramienta toma el texto visible de los enlaces de navegación y lo devuelve en el orden en que aparece.

¿El extractor reconoce encabezados H1, H2 y otros niveles dentro del XHTML?

Sí. Puede detectar encabezados HTML de H1 a H6 y permite incluir o excluir H1 mediante la opción disponible.

¿Qué ocurre si el EPUB usa entidades HTML en los títulos?

Se decodifican entidades habituales como &amp;, &lt;, &gt; y comillas para que el título resultante sea legible.

¿Se eliminan títulos de capítulos repetidos al extraer el índice EPUB?

Sí. Los títulos idénticos detectados más de una vez se consolidan conservando la primera aparición.

¿La herramienta abre directamente un archivo .epub comprimido?

No. Esta versión trabaja con texto XHTML, HTML o navegación pegado o cargado como archivo de texto; no descomprime el contenedor EPUB.

Resumen del módulo

MóduloFunción
EntradaTexto procesado localmente
ResultadoTítulos detectados
ExportaciónTXT, CSV o JSON cuando corresponda