#442 · Herramienta para desarrolladores

HTML Link Extractor

Recorre HTML y extrae enlaces de elementos a, area y link para revisar destinos, texto visible, rel, target y resolución de URL. Puedes indicar una URL base para convertir rutas relativas en destinos absolutos y localizar enlaces vacíos o potencialmente externos.

Datos de entrada

HTML con enlaces
Espacio publicitario

Cómo usar esta herramienta para desarrolladores

  1. Pega HTML con enlaces.
  2. Indica una URL base si quieres resolver rutas relativas.
  3. Ejecuta la extracción.
  4. Revisa destinos, texto, rel y target y exporta el resultado.

Qué hace esta herramienta para desarrolladores

Obtiene un inventario de enlaces declarados en el HTML y, cuando existe una base válida, calcula el destino absoluto con la API URL.

Se inspeccionan a[href], area[href] y link[href]. Las URLs que empiezan por # se clasifican como anclas y los esquemas mailto:, tel: y javascript: se conservan sin tratarlos como navegación HTTP.

La herramienta no rastrea páginas ni comprueba si el destino responde; solo analiza el HTML proporcionado.

Ejemplo

Base: https://site.test/blog/ Entrada: <a href="../about">Acerca</a> Resultado: https://site.test/about

Casos de uso

  • Auditar enlaces antes de publicar.
  • Preparar migraciones de URLs.
  • Detectar target="_blank" sin rel apropiado.
  • Separar navegación interna y externa.

Consejos para obtener resultados fiables

  • Usa la URL real de la página como base.
  • Revisa href vacíos y valores solo con #.
  • Los enlaces javascript: requieren revisión manual.
  • No interpretes una URL externa como rota sin comprobarla por red.

Detalles del procesamiento

DOMParser identifica los nodos y URL resuelve rutas relativas solo cuando la base es válida. La clasificación externa compara el origin resuelto con el de la base.

No realiza solicitudes HTTP, por lo que no informa códigos 404, redirecciones ni disponibilidad.

Preguntas frecuentes

¿Qué tipo de entrada acepta HTML Link Extractor?

Acepta HTML completo o fragmentos con atributos href.

¿Cómo trata HTML Link Extractor el HTML o CSS no válido?

El DOMParser normaliza HTML recuperable; los href sintácticamente extraños se conservan y se marcan sin resolver cuando corresponde.

¿Los datos que pego en HTML Link Extractor se envían a un servidor?

No. El procesamiento principal se ejecuta localmente en el navegador y no necesita una API externa.

¿Puedo usar el resultado de HTML Link Extractor directamente en mi proyecto?

Sí, pero conviene revisarlo cuando la entrada contenga sintaxis ambigua, fragmentos incompletos o datos generados por terceros.

¿Funciona HTML Link Extractor con texto Unicode y caracteres acentuados?

Sí. La herramienta trabaja con cadenas JavaScript y conserva Unicode; en descargas utiliza UTF-8.

Resumen técnico

MóduloFunción
EntradaHTML con enlaces
ProcesamientoLocal en el navegador
Salida.json y exportaciones cuando corresponda