WebPage Screenshoter - capturar páginas web como imagens em escala
Há coisas numa página web que não se conseguem capturar como texto. Um layout, um banner de oferta, a disposição de uma tabela de preços, a forma como uma alegação foi apresentada num determinado dia - são factos visuais, e o artefacto que os preserva é uma imagem. Este serviço produz uma por URL: envie uma lista de páginas e cada uma volta como uma linha que traz as definições de captura e um link para o ficheiro. O viewport assume 1200 por 800 píxeis por omissão, a captura de página inteira está disponível e substitui a altura, e o formato de saída pode ser WebP, PNG, JPEG ou PDF.
O export traz sete colunas, e por trás desta página estão três execuções reais que cobrem quatro linhas e dois URLs. Todas as colunas levaram um valor real em todas as linhas, os sete nomes apareceram pela mesma ordem de cada vez, e todas as imagens que o export referenciava existiam de facto em disco com exatamente as dimensões pedidas. O caminho da imagem é relativo e numerado a partir de zero dentro de uma execução, pelo que um trabalho com dois URLs produziu 0.png e 1.png sob um mesmo id de execução - o que significa que o número do ficheiro só é único emparelhado com esse id, e que o armazenamento deve ser indexado pelo par.
A coisa mais útil que esta página lhe pode dizer veio de abrir os ficheiros e não de ler a folha de cálculo. A coluna de estado indicava ok nas quatro linhas. Duas das quatro imagens estão corretas: uma página inicial bem estilizada e uma página de preços com exatamente o aspeto que devia. As outras duas, capturas do mesmo site tiradas antes, são ruínas sem estilos - marcadores de imagem partidos, um alternador de navegação em bruto, um gráfico enorme deslocado - a página apanhada antes de chegarem o seu CSS e os seus recursos. Mesmo URL, mesmo ok, resultado inteiramente diferente. Portanto o estado reporta que a captura foi concluída, não que a página foi renderizada, e qualquer automatismo construído por cima precisa de um segundo sinal. O tamanho do ficheiro é o barato e eficaz: as duas capturas partidas pesam cerca de 15 KB cada, enquanto as boas pesam 182 KB e 953 KB, porque uma página que perdeu a folha de estilos comprime-se para quase nada. Defina um mínimo, marque o que ficar abaixo, e volte a correr essas linhas. Mais uma observação a levar para qualquer trabalho de monitorização: a página de preços que capturámos voltou a mostrar tarifas do Reino Unido, porque os sites servem a versão adequada à região de onde parte um pedido - preços, moedas, disponibilidade, idioma e banners de consentimento seguirão o local da captura e não o seu.
Os usos comuns decorrem daí. A monitorização da concorrência beneficia de um registo visual que a extração de texto não consegue produzir, e a captura tirada no trimestre passado é muitas vezes a única prova de que uma página alguma vez disse o que dizia. As equipas jurídicas e de conformidade precisam exatamente desse tipo de prova datada para alegações publicitárias, termos e preços promocionais. Diretórios e painéis precisam de miniaturas, e a mesma execução serve de teste de fumo ao seu próprio conjunto. No plano legal, uma captura regista o que uma página pública mostrou a um visitante comum, e aqui nada inicia sessão nem contorna uma barreira de pagamento. Vale a pena dizer duas ressalvas com clareza: uma captura pode conter dados pessoais, como nomes e fotografias numa página de equipa, e é mais difícil de censurar depois do que texto; e a imagem é o layout protegido por direitos de autor de outra pessoa, pelo que monitorização interna, QA e prova são prática corrente enquanto republicar é uma questão à parte. Apenas páginas publicamente disponíveis, sem rastreadores de terceiros na camada de dados, e os exports, incluindo os ficheiros de imagem, apagam-se ao fim de 30 dias. As suas primeiras 500 linhas são grátis e não pedem cartão.