#323 · Extractores

Extractor de dominios

Extrae nombres de dominio desde URL, correos electrónicos y texto que contenga dominios escritos de forma explícita. Normaliza el resultado a minúsculas, elimina el prefijo www. y ofrece una lista deduplicada cuando se solicita. Resulta práctico para auditorías de enlaces, inventarios de fuentes, limpieza de datos y revisión rápida de dominios en contenido pegado.

Entrada de texto

Texto de origen
Espacio publicitario

Cómo usar esta herramienta de texto

  • Pega el texto o carga un archivo compatible.
  • Ajusta las opciones disponibles, incluida la eliminación de duplicados.
  • Pulsa el botón de extracción o usa Ctrl/Cmd + Enter.
  • Revisa las coincidencias y cópialas o descárgalas en el formato que necesites.

Qué hace esta herramienta

Esta herramienta identifica dominios presentes en el texto y devuelve las coincidencias en el orden en que aparecen.

Busca secuencias de etiquetas de dominio separadas por puntos y con una extensión alfabética de al menos dos caracteres. Después elimina www. y normaliza a minúsculas.

No se consulta el registro DNS ni la lista pública de sufijos; el resultado es una detección sintáctica.

Ejemplo

Entrada:

https://www.ejemplo.com y usuario@mail.ejemplo.org

Resultado:

ejemplo.com
mail.ejemplo.org

Casos de uso

  • Limpiar datos copiados desde documentos, correos o registros.
  • Crear listas reutilizables a partir de texto sin estructurar.
  • Revisar rápidamente coincidencias antes de importarlas a una hoja de cálculo.
  • Separar datos relevantes del contenido narrativo sin usar servicios externos.

Consejos para obtener mejores resultados

  • Usa texto lo más limpio posible para reducir falsos positivos.
  • Mantén activada la deduplicación cuando necesites una lista única.
  • Revisa manualmente datos ambiguos antes de utilizarlos en procesos críticos.
  • Conserva una copia del texto original si necesitas rastrear el contexto de cada coincidencia.
  • Para archivos grandes, procesa por bloques si el navegador se vuelve lento.

Detalles del procesamiento

Se analizan dominios visibles en URL, direcciones de correo y texto normal. La normalización facilita comparar resultados procedentes de distintas fuentes.

Puede incluir cadenas técnicamente parecidas a dominios que no estén registradas y no distingue automáticamente el dominio registrable de todos los subdominios.

Preguntas frecuentes

¿El extractor de dominios elimina automáticamente www.?

Sí. El resultado normaliza el prefijo www. para que www.ejemplo.com y ejemplo.com puedan compararse con facilidad.

¿Puede obtener dominios desde direcciones de correo electrónico?

Sí. Si el texto contiene usuario@sub.ejemplo.com, se detectará sub.ejemplo.com como dominio.

¿Distingue el dominio principal de los subdominios?

Muestra el nombre encontrado tal como aparece, salvo www. Por tanto, mail.ejemplo.com se conserva como subdominio.

¿Comprueba si un dominio está registrado o activo?

No. La herramienta no consulta DNS ni registradores; solo identifica patrones de dominio en el texto.

¿Admite dominios internacionalizados con caracteres no ASCII?

La detección directa está orientada a nombres ASCII y punycode. Los dominios Unicode pueden necesitar convertirse antes a su forma punycode.

Módulos de extracción

MóduloFunción
DetectorLocaliza patrones compatibles dentro del texto.
FiltroDescarta candidatos que no cumplen las reglas básicas.
DeduplicaciónConserva la primera aparición cuando la opción está activada.
ExportaciónPermite copiar o descargar TXT, CSV y JSON cuando hay resultados.