#107 · Herramienta de Texto y OCR de PDF

Extraer direcciones de correo de PDF

Localiza direcciones de correo electrónico dentro de la capa de texto del PDF y crea una lista deduplicada con las páginas donde aparecen. El análisis se realiza en el navegador.

Herramienta PDF

Procesamiento local
páginas
Espacio publicitario

Cómo usar esta herramienta PDF

  1. Selecciona un único archivo PDF.
  2. Indica Todas, un rango como 1-5 o páginas como 1,3,7.
  3. Pulsa el botón de procesamiento y espera a que termine el análisis local.
  4. Revisa la vista previa y descarga el archivo generado.

Qué hace esta herramienta

Localiza direcciones de correo electrónico dentro de la capa de texto del PDF y crea una lista deduplicada con las páginas donde aparecen. El análisis se realiza en el navegador.

Extrae texto con PDF.js y aplica una expresión regular de correo electrónico. Normaliza a minúsculas, elimina duplicados y conserva las páginas de aparición.

Puede omitir direcciones partidas entre líneas o escritas de forma ofuscada, como nombre [arroba] dominio.

Formatos compatibles

Entrada: PDF con texto seleccionable. Salida: JSON. Un PDF escaneado requiere OCR previo.

ElementoCompatibilidad
EntradaPDF
ProcesamientoLocal en navegador
SalidaJSON

Consejos para obtener mejores resultados

  • Verifica manualmente direcciones críticas antes de utilizarlas.
  • Las direcciones partidas por saltos de línea pueden no detectarse.
  • Respeta la privacidad y la base legal aplicable antes de usar datos de contacto extraídos.

Preguntas frecuentes

¿Cómo extraer todos los correos electrónicos de un PDF?

La herramienta lee el texto de cada página y detecta direcciones con formato de correo, eliminando duplicados.

¿Detecta correos escritos como nombre arroba dominio punto com?

No de forma fiable. Está pensada para direcciones con formato estándar usuario@dominio.

¿El resultado indica en qué página aparece cada correo?

Sí. El JSON conserva una lista de páginas para cada dirección detectada.

¿Funciona si el correo está dentro de una imagen escaneada?

No mediante extracción de texto. Primero necesitas OCR para convertir la imagen en texto reconocible.

¿Se envían las direcciones extraídas a algún servidor?

No. La detección y el archivo de salida se generan localmente en el navegador.

Resumen técnico

MóduloUso
PDF.jsLectura y extracción de páginas
Blob APIGeneración del archivo descargable

Explora más herramientas PDF

Categorías de herramientas PDF