Dale un sitemap, obtén una imagen de cada plantilla.
Antes de una migración, durante un rediseño o tras una actualización de CMS, la pregunta es siempre la misma: ¿qué páginas se rompieron?
Extrae las URLs, envía la lista
Sube el archivo directamente en lugar de construir un JSON. Se recoge cualquier línea que parezca una URL, así que un grep directo del sitemap no necesita limpieza adicional.
curl -s https://example.com/sitemap.xml \ | grep -oP '(?<=<loc>)[^<]+' \ | head -500 > urls.txt curl -X POST https://url2image.com/api/v1/batch \ -H "Authorization: Bearer $URL2IMAGE_KEY" \ -F "file=@urls.txt" -F "name=example.com before migration"
Un antes y un después que realmente se puede comparar
Ejecuta la misma lista contra el sitio antiguo y el nuevo con el mismo ancho de viewport. Los nombres de archivo se derivan de la ruta de la URL, así que los dos zips coinciden archivo por archivo y una comparación de directorios te dice qué páginas cambiaron de forma.
El manifest registra el estado HTTP de cada página, lo que detecta el otro fallo habitual de migración: una plantilla que se renderiza bien pero ahora responde 404 o redirige a algún sitio inesperado.
Dimensionar el trabajo
Un sitio de quinientas páginas es un lote. Un sitio de cinco mil páginas son diez, y a la tarifa de crédito de entrada la captura completa cuesta unos pocos dólares. La mayoría de sitios no necesitan cada página: un lote con una URL por plantilla suele encontrar la rotura.
Pruébalo primero con tu propia lista.
10 capturas al mes no cuestan nada y no requieren tarjeta. Si funciona con tu lista, los créditos empiezan en $0.002 cada uno y no caducan.
Pega una listaPreguntas
¿Rastreáis el sitemap por mí?
No. Tú suministras las URLs. Este servicio renderiza lo que se le da y nunca sigue enlaces fuera de la lista, lo que lo hace predecible y te mantiene en control de qué se solicita.
¿Qué pasa con los archivos de índice de sitemap?
Extrae primero los sitemaps hijos y luego concatena las URLs. Un lote es quinientas URLs, así que un sitio grande se convierte en varios lotes de todas formas.
¿Respeta el robots.txt?
Estás pidiendo páginas concretas que has indicado, tal como las obtendría un navegador. No es un rastreador y no descubre URLs por su cuenta.
Precios, en detalle
Por captura, prepagado, sin caducidad.
Enough to shoot a competitor set, a client portfolio, or a sitemap crawl.
The usual pick once a nightly job is running against your own URL list.
For monitoring pipelines and agent fleets that render around the clock.
Archive work, whole-market sweeps, and anything with a seven figure URL list.