#322 · Extractores

Extractor de URL

Encuentra URL dentro de texto sin estructurar y las reúne en una lista limpia. Reconoce direcciones con http o https y también enlaces que comienzan por www., elimina signos de puntuación finales habituales y puede quitar duplicados. Es útil para revisar documentos, registros, mensajes o contenidos copiados sin procesarlos fuera del navegador.

Entrada de texto

Texto de origen
Espacio publicitario

Cómo usar esta herramienta de texto

  • Pega el texto o carga un archivo compatible.
  • Ajusta las opciones disponibles, incluida la eliminación de duplicados.
  • Pulsa el botón de extracción o usa Ctrl/Cmd + Enter.
  • Revisa las coincidencias y cópialas o descárgalas en el formato que necesites.

Qué hace esta herramienta

Esta herramienta identifica url presentes en el texto y devuelve las coincidencias en el orden en que aparecen.

Detecta cadenas que empiezan por http://, https:// o www. y recorta puntuación de cierre que normalmente pertenece a la frase, no a la URL.

La herramienta extrae cadenas con apariencia de URL; no visita los enlaces ni comprueba si responden.

Ejemplo

Entrada:

Consulta https://ejemplo.com/guia y www.ejemplo.es/ayuda.

Resultado:

https://ejemplo.com/guia
www.ejemplo.es/ayuda

Casos de uso

  • Limpiar datos copiados desde documentos, correos o registros.
  • Crear listas reutilizables a partir de texto sin estructurar.
  • Revisar rápidamente coincidencias antes de importarlas a una hoja de cálculo.
  • Separar datos relevantes del contenido narrativo sin usar servicios externos.

Consejos para obtener mejores resultados

  • Usa texto lo más limpio posible para reducir falsos positivos.
  • Mantén activada la deduplicación cuando necesites una lista única.
  • Revisa manualmente datos ambiguos antes de utilizarlos en procesos críticos.
  • Conserva una copia del texto original si necesitas rastrear el contexto de cada coincidencia.
  • Para archivos grandes, procesa por bloques si el navegador se vuelve lento.

Detalles del procesamiento

La detección usa un patrón amplio para enlaces web y una fase posterior que retira puntos, comas, punto y coma y cierres de paréntesis o corchetes cuando aparecen al final.

URL sin protocolo ni prefijo www. pueden no detectarse. Algunos enlaces con puntuación intencional al final pueden requerir revisión manual.

Preguntas frecuentes

¿El extractor encuentra enlaces que empiezan por www. sin https?

Sí. Reconoce tanto http:// y https:// como enlaces que comienzan por www.

¿Se eliminan los puntos o comas que aparecen después de una URL en una frase?

Sí. Se recorta la puntuación final habitual para evitar incluir signos de cierre ajenos al enlace.

¿La herramienta abre o verifica las URL encontradas?

No. Solo extrae texto con formato de enlace y no realiza solicitudes de red.

¿Puedo quitar URL duplicadas de un texto largo?

Sí. Activa la eliminación de duplicados para conservar una sola aparición de cada URL.

¿Puede detectar dominios escritos sin protocolo, como ejemplo.com?

Este extractor prioriza URL explícitas con http, https o www. Para dominios sueltos conviene usar el Extractor de dominios.

Módulos de extracción

MóduloFunción
DetectorLocaliza patrones compatibles dentro del texto.
FiltroDescarta candidatos que no cumplen las reglas básicas.
DeduplicaciónConserva la primera aparición cuando la opción está activada.
ExportaciónPermite copiar o descargar TXT, CSV y JSON cuando hay resultados.