wget vs HTTrack vs descargador online: ¿cuál deberías usar?
Tres formas muy distintas de descargar un sitio web entero: un clásico de la línea de comandos, un veterano de escritorio y el enfoque desde el navegador. Puntos fuertes, débiles y una recomendación clara para cada caso.
Website Downloader 3 min de lectura
Los tres enfoques
Las tres herramientas resuelven el mismo problema —convertir un sitio en vivo en archivos en tu disco— pero se diferencian de raíz en dónde ocurre el trabajo y a quién se le supone capaz de manejarlas.
wget: el clásico programable
wget viene con prácticamente todas las distribuciones de Linux y está disponible para macOS y Windows. Un espejo completo se ve así:
wget --mirror --convert-links --adjust-extension --page-requisites --no-parent https://ejemplo.com
Fuerte en: gratuito, programable (tareas cron, tuberías de CI), reanudable, probado durante más de 25 años.
Flojo en: solo terminal, opciones crípticas, fácil de equivocarse (recursos ausentes, bucles infinitos en calendarios), tu máquina trabaja todo el tiempo y el espejo en bruto suele necesitar arreglos manuales antes de funcionar sin conexión.
Ideal para: desarrolladores que automatizan copias periódicas.
HTTrack: el veterano de escritorio
HTTrack añade una interfaz gráfica sobre la misma idea: defines un proyecto, fijas las reglas del espejo y rastreas.
Fuerte en: gratuito y de código abierto, sin terminal, reglas finas de inclusión y exclusión, funciona totalmente offline.
Flojo en: interfaz anticuada, requiere instalación, exceso de configuración, dificultades con algunos sitios modernos y el ordenador debe permanecer encendido.
Ideal para: usuarios avanzados que hacen espejos de sitios grandes con regularidad y quieren control sin terminal. Más en nuestra guía de alternativas a HTTrack.
Descargador de webs online: el enfoque sin configuración
Una herramienta de navegador como Website Downloader ejecuta el rastreo en sus propios servidores y te entrega un ZIP.
Fuerte en: nada que instalar, funciona en cualquier dispositivo, el rastreo continúa aunque tu portátil se suspenda, resultados guardados 24 horas en el plan gratuito y 30 días con un paquete de pago, indicador de progreso en directo.
Flojo en: el nivel gratuito está limitado a 100 subpáginas (sitios mayores: 7,99 € en pago único o un plan); como en todos los copiadores, las aplicaciones con mucho JavaScript y las zonas protegidas por inicio de sesión pueden salir incompletas.
Ideal para: cualquiera que quiera una copia offline funcional en minutos sin tocar ninguna configuración.
Cara a cara
- Tiempo de puesta en marcha: online: ninguno · HTTrack: minutos · wget: de minutos a horas (curva de aprendizaje)
- Conocimientos necesarios: online: ninguno · HTTrack: medios · wget: altos
- Coste: wget/HTTrack: gratis e ilimitado · online: gratis hasta 100 subpáginas, de pago a partir de ahí
- Funciona con el PC apagado: solo la herramienta online
- Automatización: gana wget con claridad
- Multiplataforma, tabletas incluidas: solo la herramienta online
Las opciones de wget, explicadas
Si te decides por wget, esto es lo que hace realmente el comando de espejo estándar:
- --mirror: atajo para descarga recursiva de profundidad infinita más marcas de tiempo; el núcleo de la operación.
- --convert-links: reescribe los enlaces dentro del HTML descargado para que funcionen sin conexión. Sin esta opción, al pulsar un enlace vuelves al sitio en vivo.
- --adjust-extension: guarda las páginas como archivos .html para que los navegadores las abran correctamente.
- --page-requisites: descarga también el CSS, las imágenes y los scripts que cada página necesita; sin ella obtienes texto pelado.
- --no-parent: impide que wget suba por encima de tu carpeta de inicio y se descargue medio internet.
Trampas clásicas del espejo casero
- Calendarios infinitos: los calendarios de eventos con enlaces «mes siguiente» sin fin pueden tener ocupado a un rastreador para siempre; pon límites de profundidad o excluye esas rutas.
- Límites de velocidad: machacar un servidor con peticiones en paralelo hace que bloqueen tu IP; usa esperas (--wait) y sé considerado.
- URL de sesión: los sitios que añaden identificadores de sesión generan URL «nuevas» infinitas; excluye ese parámetro o el espejo no terminará nunca.
- Espacio en disco: un sitio grande vuelca gigabytes en tu propio disco; un descargador online lo mantiene fuera de tu máquina hasta que recojas el ZIP.
Veredicto
No hay un único ganador: hay tres tipos de usuario distintos. Si programas copias de seguridad, wget. Si haces espejos de sitios grandes cada mes y disfrutas del control, HTTrack. Si quieres una web en ZIP ahora mismo, desde cualquier dispositivo y sin configurar nada, prueba el descargador online: el nivel gratuito de 100 subpáginas responde a la pregunta más rápido que cualquier artículo comparativo.
- wget espejo web
- httrack vs wget
- comparativa copiadores web
- descargar sitio web completo