喂给它一份 sitemap,拿回每个模板的截图。
无论是迁移前、改版期间,还是 CMS 升级之后,问题永远是同一个:哪些页面坏了?
拉取网址,提交列表
直接上传文件,而不用手动拼装 JSON。任何看起来像网址的行都会被识别,所以一次对 sitemap 的原始 grep 结果无需额外清理。
curl -s https://example.com/sitemap.xml \ | grep -oP '(?<=<loc>)[^<]+' \ | head -500 > urls.txt curl -X POST https://url2image.com/api/v1/batch \ -H "Authorization: Bearer $URL2IMAGE_KEY" \ -F "file=@urls.txt" -F "name=example.com before migration"
真正可比对的迁移前后截图
用相同的视口宽度,对旧站点和新站点跑同一份列表。文件名是从网址路径派生的,因此两份 zip 能逐文件对齐,一次目录级的差异对比就能看出哪些页面变样了。
清单记录了每个页面的 HTTP 状态码,能捕捉到另一种常见的迁移故障:某个模板渲染正常,但现在返回 404 或跳转到了意料之外的地方。
估算任务规模
一个五百页的网站是一个批次。一个五千页的网站就是十个批次,按入门额度单价算,整次截图只需几美元。大多数网站不需要截取每一个页面:每个模板截一个网址的批次,通常就足以发现问题。
常见问题
你们会帮我抓取 sitemap 吗?
不会。网址由你提供。本服务只渲染给定的内容,不会顺着链接抓取列表之外的页面,这样结果才可预测,你也能完全掌控哪些内容会被请求。
sitemap 索引文件怎么处理?
先拉取子 sitemap,再把网址拼接在一起。一个批次是五百个网址,所以大型网站本来就要拆成多个批次。
会遵守 robots.txt 吗?
你请求的是自己指定的具体页面,就像浏览器获取它们一样。这不是爬虫,也不会自行发现网址。
完整价格表
按张计费,预付制,永不过期。
Enough to shoot a competitor set, a client portfolio, or a sitemap crawl.
The usual pick once a nightly job is running against your own URL list.
For monitoring pipelines and agent fleets that render around the clock.
Archive work, whole-market sweeps, and anything with a seven figure URL list.