Extraia resultados de imagem do Google com atribuição
O Extrator de Imagens do Google da Livescraper transforma uma lista de consultas em dados de resultados de imagem. Você cola os termos que quer cobrir - até mil por execução - define idioma e país, escolhe quantos resultados retornar por consulta e baixa a saída em CSV, JSON ou Excel.
Cada linha carrega seis campos preenchidos: a consulta que trouxe o resultado à tona, o título da imagem, o site de origem, um link para a página que a hospeda e duas URLs de imagem - o arquivo em tamanho original no servidor do próprio site e uma prévia menor servida por um CDN de terceiros. Colunas de largura e altura também aparecem na exportação, mas nunca carregaram valor nas nossas próprias execuções, então trate como presentes mas não preenchidas. O par em que vale focar é source e link - juntos eles formam uma trilha de atribuição, dizendo não só que uma imagem existe, mas de quem ela é e onde achar o dono.
Essa atribuição é o que torna o conjunto de dados prático. Times de marca e jurídico buscam os próprios termos de produto e procuram linhas cujo domínio de origem não é deles, o que revela uso não autorizado junto com a URL da página necessária para acionar. Times de criação leem a linguagem visual de uma categoria antes de encomendar fotografia que vai ficar ao lado dela. Times internacionais variam idioma e país na mesma consulta, porque o que ranqueia visualmente num mercado costuma ser irreconhecível em outro.
Uma coisa a deixar clara: um resultado de busca é uma referência, nunca uma permissão. As imagens pertencem a quem as criou, e aparecer num resultado não muda nada disso - que é justamente por que o link da página hospedeira está na saída. Note também que o padrão é 100 resultados por consulta, então cinquenta termos viram cinco mil linhas; ajuste a profundidade antes de uma varredura ampla. Comece grátis: suas primeiras 500 linhas não custam nada e não pedem cartão de crédito.