Cómo usar esta herramienta PDF
- Selecciona un archivo PDF válido.
- Define el rango de páginas y las opciones específicas.
- Pulsa el botón de procesamiento y revisa las métricas.
- Descarga el archivo nuevo generado por el navegador.
Localiza líneas que se repiten en la franja inferior de un documento, como avisos legales, referencias, nombres de empresa o pies editoriales. El análisis se realiza sobre la capa de texto del PDF sin subir el archivo.
Localiza líneas que se repiten en la franja inferior de un documento, como avisos legales, referencias, nombres de empresa o pies editoriales. El análisis se realiza sobre la capa de texto del PDF sin subir el archivo.
Los pies que cambian en cada página, por ejemplo por incluir numeración, pueden aparecer como candidatos distintos.
PDF con texto digital como entrada y TXT como informe. Los escaneos sin texto reconocible requieren OCR previo.
| Entrada | PDF (.pdf) |
|---|---|
| Salida | TXT |
| Procesamiento | Local en el navegador |
Analiza la franja inferior de cada página y cuenta las líneas que se repiten según el umbral elegido.
Sí, siempre que estén en la capa de texto y aparezcan de forma suficientemente consistente.
Porque el número cambia entre páginas y modifica la cadena detectada.
No. Trabaja con el texto digital ya presente en el PDF.
Sí. Introduce el rango de páginas que quieras analizar.
| Módulo | Uso |
|---|---|
| PDF.js / pdf-lib / Tesseract.js | Solo se cargan los componentes necesarios para esta herramienta. |
| Blob API | Genera el archivo de salida descargable sin reutilizar el original sin cambios. |