Define la entrega antes de inspeccionar
Este flujo ayuda cuando una página, un documento, un feed o una lista de URLs va a reutilizarse, migrarse o publicarse. Guarda una captura autorizada y define destino, campos, dominios, política de query, endpoints de feed y variantes de robots. El resultado debe ser una decisión trazable, no una promesa sobre calidad o visibilidad.
Extrae el inventario antes de comprobarlo
Empieza por atributos HTML, fuentes de imagen y metadatos para no perder href, src, referencias lazy, Open Graph o datos estructurados. Luego elige la rama adecuada: tablas a CSV, texto limpio si las etiquetas estorban o enlaces Markdown de todos los formatos. Conserva cada salida con su ubicación de origen.
Valida estructura y comportamiento de URL
Con el inventario preparado, ejecuta las comprobaciones estáticas de Markdown, deduplica URLs HTTP/HTTPS y agrupa dominios. Después analiza rutas, fragmentos y queries. Clasifica seguimiento, filtros, paginación y selección de contenido y registra si se conservan, se mapean o se excluyen. Un hallazgo estático no equivale a una respuesta en vivo.
Cierra con los canales de exposición
Revisa el RSS o Atom después del análisis de URLs para comparar fechas, orden, duplicados y resumen con el objetivo. Pasa robots.txt por el lint al final y prueba las URLs importantes contra sus reglas. Entrega alcance, evidencia y huecos de prueba junto con una decisión de aceptar, corregir, aplazar o bloquear; no la conviertas en una garantía de SEO.