2
Cómo rastrear usando wget para descargar SOLAMENTE archivos HTML (ignorar imágenes, css, js)
Esencialmente, quiero rastrear un sitio completo con Wget, pero lo necesito para NUNCA descargar otros activos (por ejemplo, imágenes, CSS, JS, etc.). Solo quiero los archivos HTML. Las búsquedas de Google son completamente inútiles. Aquí hay un comando que he probado: wget --limit-rate=200k --no-clobber --convert-links --random-wait -r -E -e robots=off …
14
wget
web-crawler