Capturador de Páginas Web

Una URL entra.
Una captura sale.

Envíe una lista de URLs y reciba una imagen de cada página: al tamaño de viewport que elija o con la altura de scroll completa, como PNG, WebP, JPEG o PDF. Siete columnas por fila, una de ellas un enlace al archivo. Lea la nota sobre la columna de estado antes de automatizar nada con ella.

500 filas gratis, una sola vez0,002 $ por fila despuéshasta 1.000 URLs por solicitudPNG · WebP · JPEG · PDF
Lea esto primero

«ok» significa capturada,
no renderizada.

Abrimos todas las imágenes que respaldan esta página en lugar de fiarnos de la columna que dice que funcionó. Resultó importar.

Tenemos tres exports reales que cubren cuatro filas y dos URLs. status marca ok en las cuatro, cada archivo de imagen existe y cada uno es un PNG válido de exactamente los 1200 × 800 solicitados. Solo con esas señales, cuatro de cuatro parecen éxitos.

Dos de ellas no lo son. Al abrirlas, las dos capturas anteriores del mismo sitio son ruinas sin estilos -marcadores de imagen rotos, un botón «Toggle Navigation» en crudo, un gráfico enorme descolocado-: la página atrapada antes de que llegaran su CSS y sus recursos. Las otras dos son correctas: una portada completa y bien maquetada, y una página de precios que se ve exactamente como debe. Misma URL, mismo ok, resultado completamente distinto.

La pista barata es el tamaño del archivo. Las dos capturas rotas pesan unos 15 KB cada una; las dos buenas, 182 KB y 953 KB. Una página con estilos e imágenes sencillamente pesa más que una que no pudo cargar su hoja de estilos. Así que si va a automatizar esto, ponga un umbral por tamaño en bytes y revise a mano los casos extremos, y no trate status como una garantía de renderizado, porque no está afirmando eso.

livescraper.app · lo verificado
3 ejecuciones, 4 filas, 2 URLs - todos los archivos presentes
Las cuatro exactamente 1200 × 800, todas PNG válido
status = ok en 4 de 4
2 de 4 se renderizaron sin estilos pese al ok!
El tamaño del archivo es la señal de calidad utilizable!
Nosotros abrimos las imágenes. Usted también debería.
Cómo funciona

URLs dentro,
imágenes fuera.

Una URL es la entrada. Tres ajustes opcionales deciden cómo se ve la imagen.

  1. PASO 1Inicie sesión en la plataforma.
  2. PASO 2Abra el WebPage Screenshoter.
  3. PASO 3Pegue sus URLs, una por línea.
  4. PASO 4Fije el ancho y el alto del viewport, o pida una captura de página completa.
  5. PASO 5Elija un formato de imagen y haga clic en Get Data.

Los valores por defecto documentados son 1200 de ancho por 800 de alto, el tamaño que usó cada captura que respalda esta página. La captura de página completa anula la altura. El parámetro de formato acepta WebP, PNG, JPEG y PDF, y su valor por defecto es WebP.

Diccionario de datos

Siete columnas,
y qué contuvo cada una.

Medido a partir de 3 exports reales que cubren 4 filas y 2 URLs, con las mismas siete columnas en el mismo orden cada vez. Los nombres están copiados carácter a carácter de la fila de cabecera.

url
La página capturada, devuelta desde su entrada -https://outscraper.com, https://stripe.com/pricing. Fíjese en que la referencia llama a este campo query; el export lo llama url.
status
Si la captura se completó -ok en las cuatro filas que tenemos. Informa de la captura, no del renderizado; lea la sección de arriba antes de construir sobre ella.
format
El formato de imagen producido -png en todas las filas de aquí. La referencia lista WebP, PNG, JPEG y PDF, con WebP como valor por defecto del parámetro, así que nuestras ejecuciones pidieron PNG explícitamente.
width
Ancho del viewport en píxeles -1200 en todas las filas, coincidiendo con el valor por defecto documentado. Los archivos entregados miden exactamente 1200 píxeles de ancho.
height
Alto del viewport en píxeles -800 en todas las filas, de nuevo el valor por defecto documentado y de nuevo respetado exactamente por los archivos.
full_page
Si se capturó toda la altura de scroll -false en todas las filas que tenemos, y por eso estas son imágenes de la parte visible sin desplazar. Activarlo anula height.
screenshot
Dónde vive la imagen: una ruta de la forma /api/screenshoter/file/<run-id>/<n>.png, numerada desde cero dentro de la ejecución. Una ejecución de dos URLs produjo 0.png y 1.png bajo el mismo id de ejecución.

Todas las columnas llevaron un valor real en todas las filas, y todos los archivos referenciados existían. El esquema es estable: siete nombres, mismo orden, tres ejecuciones. Lo que la tabla no puede decirle es si una imagen sirve: las cuatro nuestras eran PNG válidos con exactamente las dimensiones pedidas, y dos de ellas eran fallos sin estilos. Eso es una propiedad de hacer capturas, no de este export, y por eso el consejo honesto es poner un umbral por tamaño de archivo y mirar los casos extremos.

Antes de conectarlo

Cuatro notas para quien
escriba el importador.

Cada una salió de abrir los archivos de verdad en lugar de leer el export, que es justo por lo que merecen el espacio.

Ponga el umbral en el tamaño del archivo, no en status

Las dos capturas rotas de nuestro conjunto pesan unos 15 KB; las dos correctas, 182 KB y 953 KB. Una página que perdió su hoja de estilos se comprime hasta casi nada, así que el tamaño en bytes las separa con limpieza donde status no puede. Elija un mínimo que encaje con sus objetivos, marque para revisión todo lo que quede por debajo y vuelva a ejecutar esas filas en lugar de darlas por buenas.

La página se renderiza para el lugar desde el que se captura

Nuestra captura de una página de precios volvió mostrando tarifas del Reino Unido -porcentajes en peniques, una línea sobre tarjetas de la UE- porque el sitio sirvió la versión de la región desde la que llegó la petición. Todo lo que varíe por geografía variará también en sus capturas: precios, monedas, disponibilidad, banners de consentimiento e idioma. Conviene saberlo antes de usarlas como prueba de lo que ve un cliente en otro sitio.

La ruta de la imagen es relativa y se numera por ejecución

screenshot contiene una ruta, no una URL absoluta: /api/screenshoter/file/<run-id>/<n>.png. El número vuelve a empezar en cero en cada ejecución, así que 0.png solo es único emparejado con su id de ejecución. Indexe su almacenamiento por el par, o una segunda ejecución sobrescribirá la primera.

Son capturas del viewport salvo que pida otra cosa

full_page estaba en false en todas las filas que tenemos, así que cada imagen son los 800 píxeles superiores y no el documento entero: nuestra captura de la página de precios se corta a media página. Si necesita el artículo completo o el pie, active la opción de página completa, que anula la altura en lugar de convivir con ella.

Flujos de trabajo habituales

Tres trabajos que más
se ejecutan aquí.

Allí donde una página necesita conservarse tal como se veía, y no tal como se lee.

Vigilancia competitiva

Observar cómo se presentan los rivales

Los textos cambian, las maquetas cambian, las ofertas aparecen y desaparecen. Capturar un conjunto de páginas de la competencia de forma periódica da una comparación visual en el tiempo que ningún scraping de texto ofrece, y la página de precios que fotografió el trimestre pasado suele ser el único registro de que alguna vez dijo lo que dijo.

Marketing de producto · Estrategia
Evidencia de cumplimiento

Guardar prueba de lo que mostraba una página

Las afirmaciones publicitarias, las condiciones, las advertencias legales y los precios promocionales deben acreditarse tal como aparecían en una fecha. Una imagen con marca de tiempo es el artefacto que auditores y equipos legales piden de verdad, y una fila por URL hace que capturar todo un conjunto sea sencillo.

Legal · Cumplimiento
Vistas previas y QA

Generar miniaturas y detectar páginas rotas

Directorios, paneles y tarjetas de enlace quieren todos una imagen del destino. La misma ejecución sirve además como prueba de humo de su propio sitio: una página que vuelve con 15 KB cuando sus vecinas pesan 400 KB suele estar diciéndole que algo está roto.

Ingeniería · Operaciones de contenido
Precios

Pague solo por las filas
que realmente extraiga.

Sin suscripción, sin mínimo, sin licencia por usuario. Sus primeras 500 filas corren de nuestra cuenta; después, pago por uso.

Tramo gratuito

500 filas gratis - 0 $

Para cada cuenta nueva, una sola vez. Sin tarjeta de crédito. Gaste unas cuantas en páginas que conozca bien y abra las imágenes: es la única forma de aprender cuánto pesa una buena captura para sus objetivos, que es justo el número que usará su control de calidad.

0 $ para siempre
Pago por uso

0,002 $ por fila tras el tramo gratuito

Unos 2 $ por cada 1.000 páginas, una fila por URL: exacto de presupuestar, porque una página que se captura mal devuelve igualmente exactamente una fila y se factura como cualquier otra.

El más popular
Enterprise

A medida · capturas programadas

Precios por volumen, SLA, workers dedicados y onboarding a medida para equipos que capturan un conjunto grande de páginas de forma periódica. Díganos sus cifras y le presupuestamos.

Hable con nosotros
10 % de descuento en su primera ejecución de pago.Use el código LIVESCRAPER10 al pagar.
Registrarse
Combina bien con

La misma página,
como datos.

Una captura conserva cómo se veía una página. Estos dos le dicen de qué está hecha y quién la registró.

La parte legal

Una imagen de una
página pública.

Más ligero que casi todo este catálogo, con dos salvedades que conviene decir en vez de disimular.

Una captura registra lo que una página web pública mostró a un visitante corriente. Es la misma observación que hace cualquier navegador, guardada en vez de descartada, y por eso capturar páginas públicas está en el extremo suave de lo que hacemos. Aquí nada inicia sesión, y nada sortea un muro de pago.

Dos salvedades. Primera: una página puede contener datos personales -una página de equipo con nombres y fotografías, una reseña con autor, una ficha de perfil- y una captura los recoge con la misma fidelidad que una extracción de texto, además de ser más difícil de censurar después. Piense qué entra en el encuadre antes de archivar a gran escala. Segunda: la imagen es la maquetación y el contenido con copyright de otra persona; usar capturas internamente para monitorización, QA o prueba es práctica corriente, y republicarlas es otra cuestión que depende de su jurisdicción y su finalidad.

Por nuestra parte: solo páginas disponibles públicamente, nada tras un inicio de sesión, sin rastreadores de terceros en la capa de datos, y sus exports -incluidos los archivos de imagen- se borran automáticamente a los 30 días.

livescraper.app · principios
Solo páginas disponibles públicamente
Nada tras un inicio de sesión
Sin rastreadores de terceros en la capa de datos
Los exports y las imágenes se borran solos (30 días)
Una captura puede incluir datos personales: mire qué entra en el encuadre!
Lo que un visitante habría visto, guardado.
Preguntas frecuentes

Lo que preguntan
antes de registrarse.

Las preguntas que más nos hacen. ¿Alguna más? Hable con nosotros: las respuestas las escriben personas, no bots.

¿«ok» en status significa que la captura es buena?+
No: significa que la captura se completó. Abrimos las cuatro imágenes que respaldan esta página: status marcaba ok en todas, las cuatro eran PNG válidos con exactamente el tamaño pedido, y dos de ellas eran ruinas sin estilos atrapadas antes de que cargaran el CSS y los recursos de la página. Juzgue la calidad por el tamaño del archivo y mirando los casos extremos, no por esa columna.
¿Qué vuelve exactamente?+
Siete columnas: url, status, format, width, height, full_page y screenshot. La última es una ruta al propio archivo de imagen, de la forma /api/screenshoter/file/<run-id>/<n>.png. Todas las columnas llevaron un valor real en todas las filas que tenemos, y todos los archivos referenciados existían.
¿Cómo detecto automáticamente una captura mala?+
Por el tamaño del archivo. En nuestro conjunto las dos capturas rotas rondan los 15 KB mientras que las dos correctas pesan 182 KB y 953 KB, porque una página que perdió su hoja de estilos se comprime hasta casi nada. Fije un mínimo que encaje con sus objetivos, marque lo que quede por debajo y vuelva a ejecutar esas filas en lugar de darlas por buenas.
¿Qué tamaño y formato obtengo?+
El viewport por defecto es de 1200 por 800 píxeles, que es lo que usó cada captura de esta página, y los archivos entregados medían exactamente eso. El parámetro de formato acepta WebP, PNG, JPEG y PDF y por defecto es WebP: nuestras ejecuciones pidieron PNG explícitamente. Activar la opción de página completa anula la altura y captura toda la longitud de scroll.
¿La página se verá igual que la veo yo?+
No necesariamente. Nuestra captura de una página de precios volvió mostrando tarifas del Reino Unido, porque el sitio sirve la versión de la región desde la que llega la petición. Precios, monedas, disponibilidad, idioma y banners de consentimiento pueden diferir de lo que ve usted localmente, así que trate una captura como lo que habría visto un visitante desde el lugar de captura.
¿Cuántas URLs puedo enviar de una vez?+
La referencia documenta lotes de hasta 1.000 URLs por solicitud. Nuestras propias ejecuciones fueron pequeñas -cuatro filas en tres exports- así que citamos esa cifra como documentada y no como algo que hayamos ejercitado a esa escala.
¿Cuánto cuesta?+
Las primeras 500 filas de una cuenta nueva son gratuitas y de una sola vez; después son 0,002 $ por fila -unos 2 $ por cada 1.000 páginas- de pago por uso y sin suscripción. Una fila por URL lo hace exacto de presupuestar, y una captura mala se factura como cualquier otra fila, lo que es buena razón para gastar el tramo gratuito en aprender cuánto pesa un archivo sano. Los créditos no caducan y no hay reinicio mensual.

Capture su
lista de páginas.

Pegue sus URLs y obtenga una imagen de cada una, al tamaño y formato que elija. Sus primeras 500 filas son gratis: gaste unas cuantas abriendo los archivos, para saber cuánto pesa una buena captura antes de automatizar la comprobación.

Activación instantánea · sin tarjeta

WebPage Screenshoter: capturar páginas web como imágenes a escala

Hay cosas de una página web que no se pueden capturar como texto. Una maquetación, un banner de oferta, la disposición de una tabla de precios, la forma en que se presentó una afirmación un día concreto: son hechos visuales, y el artefacto que los conserva es una imagen. Este servicio produce una por URL: envíe una lista de páginas y cada una vuelve como una fila que lleva los ajustes de captura y un enlace al archivo. El viewport por defecto es de 1200 por 800 píxeles, la captura de página completa está disponible y anula la altura, y el formato de salida puede ser WebP, PNG, JPEG o PDF.

El export lleva siete columnas, y detrás de esta página hay tres ejecuciones reales que cubren cuatro filas y dos URLs. Todas las columnas llevaron un valor real en todas las filas, los siete nombres aparecieron en el mismo orden cada vez, y todas las imágenes que el export referenciaba existían realmente en disco con exactamente las dimensiones pedidas. La ruta de la imagen es relativa y se numera desde cero dentro de una ejecución, así que un trabajo de dos URLs produjo 0.png y 1.png bajo un mismo id de ejecución, lo que significa que el número de archivo solo es único emparejado con ese id y que el almacenamiento debe indexarse por el par.

Lo más útil que esta página puede decirle salió de abrir los archivos y no de leer la hoja de cálculo. La columna de estado marcaba ok en las cuatro filas. Dos de las cuatro imágenes son correctas: una portada bien maquetada y una página de precios que se ve exactamente como debe. Las otras dos, capturas del mismo sitio tomadas antes, son ruinas sin estilos -marcadores de imagen rotos, un conmutador de navegación en crudo, un gráfico enorme descolocado-: la página atrapada antes de que llegaran su CSS y sus recursos. Misma URL, mismo ok, resultado por completo distinto. Así que status informa de que la captura se completó, no de que la página se renderizara, y cualquier automatismo montado encima necesita una segunda señal. El tamaño del archivo es la barata y eficaz: las dos capturas rotas pesan unos 15 KB cada una mientras que las buenas pesan 182 KB y 953 KB, porque una página que perdió su hoja de estilos se comprime hasta casi nada. Fije un mínimo, marque lo que caiga por debajo y vuelva a ejecutar esas filas. Una observación más que conviene llevarse a cualquier trabajo de monitorización: la página de precios que capturamos volvió mostrando tarifas del Reino Unido, porque los sitios sirven la versión adecuada a la región desde la que llega una petición; precios, monedas, disponibilidad, idioma y banners de consentimiento seguirán al lugar de captura y no al suyo.

Los usos habituales se siguen de ahí. La vigilancia competitiva se beneficia de un registro visual que la extracción de texto no puede producir, y la captura tomada el trimestre pasado suele ser la única prueba de que una página dijo alguna vez lo que dijo. Los equipos legales y de cumplimiento necesitan exactamente esa clase de evidencia fechada para afirmaciones publicitarias, condiciones y precios promocionales. Los directorios y paneles necesitan miniaturas, y la misma ejecución sirve de prueba de humo del propio sitio. En lo legal, una captura registra lo que una página pública mostró a un visitante corriente, y aquí nada inicia sesión ni sortea un muro de pago. Conviene decir dos salvedades con claridad: una captura puede contener datos personales, como nombres y fotografías en una página de equipo, y es más difícil de censurar después que el texto; y la imagen es la maquetación con copyright de otra persona, así que la monitorización interna, la QA y la evidencia son práctica corriente mientras que republicar es una cuestión aparte. Solo páginas disponibles públicamente, sin rastreadores de terceros en la capa de datos, y los exports, incluidos los archivos de imagen, se borran a los 30 días. Sus primeras 500 filas son gratis y no piden tarjeta.