每个页面的 HTML,以及页面引用的文件:图片(PNG、JPG、GIF、WebP)、样式表、JavaScript、字体(WOFF、WOFF2、TTF、EOT)和媒体文件(MP4、MP3、WebM、WAV)。它们会分门别类地放在页面旁边的 images、css、js、fonts 和 media 文件夹里,因此离线打开时和线上看到的一样。
部分适用。我们保存的是服务器返回的内容,而单页应用往往只返回一个几乎空白的 HTML 外壳,内容要到浏览器里才生成。文件会进入 ZIP,但可见的正文未必。传统网站和服务端渲染的网站——WordPress、TYPO3、静态站点生成器,以及大多数企业网站——效果很好。
不能。下载器像匿名访客那样请求页面,不带你的会话,也不带你的 Cookie,因此登录之后的内容无法触及。它会保存登录页本身,而不是它保护的内容。
不遵守——下载器不会读取 robots.txt,也不解析抓取规则。因此责任在你:只下载属于你自己、或你有权复制的网站,并遵守各网站的使用条款。
这更多取决于对方服务器,而不是我们。我们一次抓取五个文件;几百个子页面的网站通常几分钟就能完成。一次运行在 15 分钟后会被中止,所以非常大或非常慢的网站可能提前结束,得到一份不完整的存档。
如果已经写入了页面,这些内容仍然归你:不完整的存档会被打包交付,而不是丢弃,进度显示也会说明出了什么问题。只有在超时、或第一页尚未落盘就失败的情况下,才会什么都拿不到。
会。每个文件都按服务器返回的原样保存——不重新压缩、不缩放、不转换格式。因此 ZIP 的体积与原网站的文件大致相当。
不能作为限制条件。从 example.cn/blog 开始会让抓取从那里起步,但下载器会沿着同一域名下的所有内部链接前进,所以该文件夹之外的页面也可能被收录。真正的边界来自你所购方案的页数上限,以及最多十层的链接深度。
付款通过 Stripe 完成,系统会立即发送付款确认邮件。订阅用户还会在每个计费周期收到正式发票,随时可以在账户中链接的计费门户里查看。
在账户里一键取消。取消将在你已付费的周期结束时生效——在此之前套餐可以完整使用,之后不再扣款。
对于一次下载:你输入的网址、生成的存档及其大小。若注册了账户,还包括你的姓名、邮箱地址,以及由 Stripe 保管的付款记录。存档会自动删除——免费方案 24 小时后,付费方案 30 天后。若要删除账户及其关联的一切,请与我们联系,处理完成后我们会答复确认。
通常有三个原因:达到了你所购方案的页数上限;内容是在浏览器里生成的,而不是由服务器返回;或者文件位于另一个域名上——CDN、视频平台、外部字体服务——而下载器有意不去追踪它们。