Cómo usar esta herramienta PDF
- Selecciona un único archivo PDF.
- Indica Todas, un rango como 1-5 o páginas como 1,3,7.
- Pulsa el botón de procesamiento y espera a que termine el análisis local.
- Revisa la vista previa y descarga el archivo generado.
Localiza direcciones de correo electrónico dentro de la capa de texto del PDF y crea una lista deduplicada con las páginas donde aparecen. El análisis se realiza en el navegador.
Localiza direcciones de correo electrónico dentro de la capa de texto del PDF y crea una lista deduplicada con las páginas donde aparecen. El análisis se realiza en el navegador.
Puede omitir direcciones partidas entre líneas o escritas de forma ofuscada, como nombre [arroba] dominio.
Entrada: PDF con texto seleccionable. Salida: JSON. Un PDF escaneado requiere OCR previo.
| Elemento | Compatibilidad |
|---|---|
| Entrada | |
| Procesamiento | Local en navegador |
| Salida | JSON |
La herramienta lee el texto de cada página y detecta direcciones con formato de correo, eliminando duplicados.
No de forma fiable. Está pensada para direcciones con formato estándar usuario@dominio.
Sí. El JSON conserva una lista de páginas para cada dirección detectada.
No mediante extracción de texto. Primero necesitas OCR para convertir la imagen en texto reconocible.
No. La detección y el archivo de salida se generan localmente en el navegador.
| Módulo | Uso |
|---|---|
| PDF.js | Lectura y extracción de páginas |
| Blob API | Generación del archivo descargable |