Scraper de Produtos da Zoro

Páginas de produto da Zoro,
como quinze colunas.

Cole uma URL de produto da Zoro, ou uma URL de categoria ou busca, e os produtos voltam como linhas - nome, preço e moeda, disponibilidade, marca, as colunas de identificador, nota e avaliações, uma imagem, um link e uma descrição.

500 linhas grátis, uma única vezUS$ 0,002 por linha depois15 colunasCSV · XLSX · JSON
Como funciona

Cinco passos,
e nenhuma configuração.

Uma entrada e um controle. Aqui não há proxy a configurar, então o trabalho inteiro é uma lista de links e um número.

  1. PASSO 1Entre na plataforma.
  2. PASSO 2Abra o Scraper de Produtos da Zoro.
  3. PASSO 3Cole URLs de produto da Zoro ou URLs de categoria e busca, uma por linha - ou envie um arquivo CSV, XLSX ou TXT.
  4. PASSO 4Defina um limite por consulta, ou coloque zero para levar tudo, e clique em Get Data.
  5. PASSO 5Baixe o resultado como CSV, XLSX ou JSON.

O limite é por consulta: cinco URLs de categoria com limite de duzentos são duzentos produtos de cada uma - não duzentos no total.

Por que as equipes usam

Um catálogo que dá para ordenar,
não uma grade para rolar.

Um link de produto ou uma categoria inteira

Uma linha pode ser uma página de produto sozinha ou uma URL de categoria ou busca, e uma categoria volta desdobrada nos seus produtos, uma linha cada. É assim que uma página de navegação vira algo que você consegue ordenar por preço ou agrupar por marca.

Sem proxy necessário

Alguns varejistas deste pipeline compartilhado precisam de uma saída residencial própria - a ferramenta aponta Lowes, Grainger, Zalando e Fastenal. A Zoro não é um deles. A execução passa pelo nosso pool, e não há nada para você configurar.

Colunas de identificador, mantidas à parte

sku, mpn e gtin chegam como colunas próprias em vez de enterrados num título, e currency fica ao lado de price em vez de dentro. É isso que torna uma exportação casável com um catálogo que não é o da Zoro - onde a página declarar esses campos.

O que esta página pode e não pode dizer

Os nomes estão confirmados.
Os conteúdos não.

Vale dizer com franqueza, porque muda o jeito de ler o dicionário abaixo.

Os quinze nomes de coluna são sólidos: estão confirmados em dobro, pelo array de colunas publicado para este serviço e pela linha de cabeçalho de toda pasta de trabalho que temos do pipeline compartilhado por trás dele - idêntica na preenchida e nas vazias. Construa um esquema em torno desses nomes com confiança.

O que não podemos fazer é lhe dizer o que a Zoro põe nelas, porque nunca rodamos isto contra a Zoro. Nenhuma das exportações que temos é uma execução da Zoro. Quase todas voltaram com um cabeçalho e nenhuma linha, e a única preenchida é de um varejista completamente diferente. Em vez de maquiar isso, esta página não imprime valores de exemplo nem formatos - sem uma execução da Zoro, estaríamos inventando.

A boa notícia é como isso se resolve barato. Quais das treze colunas declaradas a Zoro realmente publica é uma pergunta que uma única execução pequena responde de vez, e as primeiras 500 linhas não custam nada - então aponte-a para uma única categoria, veja o que voltou e você saberá mais sobre esta exportação do que qualquer página poderia honestamente lhe dizer de antemão.

Dicionário de dados

Quinze colunas,
e um teto honesto.

Os nomes são exatos e duplamente confirmados. As descrições dizem para que serve cada coluna - não o que ela vai conter, porque isso é decisão do varejista e não nossa, e a nota abaixo explica por quê.

query
A URL que você enviou para esta linha - a página de produto, categoria ou busca de onde ela veio. É escrita pelo scraper, então está em todas as linhas.
service
De qual varejista esta linha veio. Este scraper divide um pipeline com vários outros serviços de produto, e o que você escolheu fica carimbado em cada linha - útil se você mantém mais de um varejista na mesma tabela.
name
O nome do produto como a página o declara.
price
O preço que a página declara.
currency
A moeda desse preço, como coluna separada - assim você não precisa extrair um símbolo do campo de preço.
availability
O status de estoque que a página declara.
brand
A marca que a página declara.
sku
O código de item do próprio varejista.
mpn
O número de peça do fabricante. Junto com gtin, é o que torna uma exportação casável com um catálogo que não é o da Zoro.
gtin
O número global de item comercial - o identificador do código de barras.
rating
A nota do produto, se a página publicar uma. Nenhuma escala é informada aqui; não vimos nenhum valor.
reviews
A contagem de avaliações. Um número, não o texto - não há corpo de avaliação nesta exportação.
image
A imagem do produto que a página declara.
url
O link do produto.
description
A descrição do produto que a página declara.

Duas coisas sobre as evidências por trás desta página. Primeiro, o mecanismo: os produtos são lidos do JSON-LD que uma página publica sobre si mesma - os dados estruturados que os varejistas embutem para os buscadores. Isso estabelece um teto que esta página não vai fingir ultrapassar. Toda coluna depois de service só existe se a Zoro declarar aquele campo, então um vazio significa não publicado, não execução falhou. Segundo, a lacuna: nunca rodamos isto contra a Zoro. Temos quarenta e cinco exportações do pipeline compartilhado por trás deste serviço e nenhuma é uma execução da Zoro - quarenta e quatro voltaram vazias e a única preenchida é de outro varejista. Essa exportação vale um dado honesto sobre a ferramenta e não sobre a Zoro: query e service preencheram em toda linha, porque o scraper os escreve ele mesmo - e seis das quinze estavam vazias em cada uma das linhas. Conte com lacunas aqui também, conte que elas caiam em outro lugar porque outro varejista publica dados estruturados diferentes, e deixe sua primeira execução gratuita dizer quais. É também por isso que esta página não imprime valores de exemplo nem formatos: sem uma execução da Zoro, estaríamos inventando.

Controles da execução

Duas entradas,
e é esse o formulário inteiro.

Uma lista de URLs e um limite. Sem ordenação, sem filtro, sem campo de proxy - neste varejista não há mais nada para definir.

https://www.zoro.com/…/i/G8596095/ Uma URL de produto, ou de categoria / busca Uma por linha Envio CSV · XLSX · TXT Limite por consulta, ou 0 para tudo Uma linha por produto Sem proxy residencial Lido do JSON-LD da página
De onde vêm os campos

A página declara,
nós reportamos.

Este scraper lê os dados estruturados que uma página de produto publica sobre si mesma - o bloco JSON-LD que os varejistas embutem para que os buscadores possam exibir preço e status de estoque. É por isso que as colunas são o que são: sku, mpn, gtin, brand, availability e currency são o vocabulário padrão para descrever um produto, e não nomes que inventamos.

A consequência prática é a que vale planejar. Uma coluna só vale o quanto valer a marcação do próprio varejista. Se um campo falta nos dados estruturados da página, ele volta vazio, e por mais que você rode de novo isso não muda - não é uma falha, é uma ausência. Na única exportação preenchida que temos desta ferramenta compartilhada, seis das quinze colunas estavam vazias em todas as linhas.

Se você precisa de algo que a marcação não carrega, isso é outro trabalho - o Scraper Universal com IA lê a própria página e devolve os atributos que você nomear, em vez de apenas o que foi declarado para os buscadores.

livescraper.app · o teto
Lido do JSON-LD da página
query e service: escritos por nós
Os outros treze: declarados pela página
Vazio = não publicado, não falhou!
Confira as lacunas na sua primeira execução
Dados estruturados são escolha do varejista, e ela varia entre eles.
Entregando a lista

Uploads somam
e não removem duplicatas.

Um arquivo enviado não limpa a caixa - as linhas são acrescentadas ao que você já tinha digitado, e duplicatas não são removidas. Envie o mesmo arquivo duas vezes e aquelas URLs serão de fato buscadas duas vezes, e cobradas duas vezes. Isso é próprio deste pipeline: alguns dos nossos outros scrapers deduplicam no upload e este não, então não traga o hábito de lá.

Para um CSV ou TXT a linha inteira é tomada como uma URL, então uma planilha com colunas extras não é o que você quer aqui. Só um XLSX é lido por coluna, e ali ele pega a coluna A.

O seletor lista Parquet ao lado de CSV, XLSX e TXT, mas na verdade não consegue ler um no navegador e vai lhe dizer isso - use um dos outros três.

livescraper.app · o upload
CSV · XLSX · TXT
Duplicatas NÃO são removidas!
CSV e TXT: a linha inteira
XLSX: coluna A
Acrescentado ao que você digitou
Confira a caixa antes de rodar - uma lista dobrada é uma conta dobrada.
Fluxos de trabalho comuns

Três trabalhos que as pessoas
mais rodam aqui.

Alguns exemplos do que um catálogo de fornecedor vale depois que vira uma tabela.

Sortimento

Ver uma categoria como lista, não como grade

Dê a ele uma página de categoria e você recebe cada produto dela como linha, com a marca e as colunas de identificador ao lado do nome. Ordenar uma página de navegação por algo que não seja o que o site oferece é justamente o objetivo.

Merchandising · Pesquisa
Comparação

Colocar um fornecedor ao lado dos outros que você acompanha

Como service vem carimbado em cada linha, uma mesma tabela pode ter a Zoro ao lado dos outros varejistas deste pipeline e ainda assim se separar direitinho. Onde mpn ou gtin estiverem declarados, o mesmo item pode ser casado entre fornecedores.

Sourcing · Compras
Monitoramento

Rodar uma categoria de novo e comparar

A mesma URL de categoria de forma programada dá dois arquivos comparáveis. O que apareceu, o que sumiu e o que mudou é um diff em vez de uma tarde de cliques - e sku é a chave para comparar, onde ela for publicada.

Análise · Relatórios
Preços

Pague só pelos produtos
que você realmente extrai.

Sem assinatura, sem mínimo, sem cobrança recorrente. Suas primeiras 500 linhas são por nossa conta - depois é pagamento conforme o uso, com a mesma tarifa fixa de qualquer outro scraper daqui.

Plano gratuito

500 linhas grátis - US$ 0

Em toda conta nova, uma única vez. Sem cartão de crédito. Limites por consulta, upload de arquivo e todos os formatos de exportação incluídos - e neste varejista, também não há proxy para pagar.

US$ 0 para sempre
Pague conforme o uso

US$ 0,002 por linha, após o plano gratuito

A mesma tarifa fixa de qualquer outro scraper da plataforma. O estimador prévio mostra a quantidade de linhas e o custo em créditos antes de começar - vale uma olhada aqui, porque o limite é por consulta e uma lista de URLs de categoria multiplica.

Mais popular
Volume

Sob medida · alto volume

Preço por volume, workers dedicados e um SLA para acompanhar um catálogo de forma programada. Conte seus números e enviamos uma proposta.

Fale conosco
10% de desconto na sua primeira execução paga.Use o código LIVESCRAPER10 no checkout.
Cadastre-se
Combina bem com

O mesmo pipeline,
e o caminho para além dele.

Dois irmãos na mesma ferramenta compartilhada, e um para quando os dados estruturados não carregam o que você precisa.

A parte jurídica

É legal fazer scraping da
Zoro?

Resposta curta: isto são dados públicos de catálogo sem dados pessoais dentro - e os dados estruturados são publicados, de saída, para serem lidos por máquinas.

Tudo nestas quinze colunas é mostrado a qualquer visitante numa página de produto pública da Zoro, logado ou não. Nenhum login é usado, nenhum paywall é atravessado e nenhuma conta é tocada, e a execução passa pelo nosso pool de proxies em vez do seu próprio IP. O que é lido especificamente é o bloco JSON-LD - dados estruturados que um varejista embute justamente para que leitores automatizados consigam captar o nome, o preço e a disponibilidade.

Nenhuma pessoa é nomeada nesta exportação. Não há coluna de cliente, de quem avaliou nem de vendedor - reviews é uma contagem, não o texto das avaliações, então nem o corpo de uma avaliação volta. São produtos e preços, o que a coloca na ponta mais leve em termos de proteção de dados.

Os próprios termos da Zoro regem a coleta automatizada do site deles, então leia antes de escalar em vez de confiar no fato de as páginas serem públicas. E se você republicar descrições de produto ou imagens, lembre que são textos e fotografias de outra pessoa - coletar para análise é uma questão, publicar é outra. Não rodamos rastreadores de terceiros na camada de dados, e suas exportações se autoexcluem depois de 30 dias.

livescraper.app · princípios
Apenas páginas de produto públicas
Sem logins, sem tocar em contas
Dados estruturados, publicados para máquinas
Produtos e preços - ninguém é nomeado
As exportações se apagam (30 dias)
Verifique os próprios termos da Zoro antes de escalar.
Perguntas frequentes

O que as pessoas perguntam
antes de se cadastrar.

As perguntas que mais ouvimos. Mais alguma coisa? Fale com a gente - quem escreve as respostas são pessoas, não bots.

Como faço scraping de produtos da Zoro?+
Com o Scraper de Produtos da Zoro: entre na plataforma, abra o Scraper de Produtos da Zoro, cole URLs de produto da Zoro ou URLs de categoria e busca uma por linha (ou envie um arquivo CSV, XLSX ou TXT), defina um limite por consulta ou coloque zero para levar tudo, então clique em Get Data e baixe o resultado como CSV, XLSX ou JSON.
Preciso de um proxy residencial para este?+
Não. A execução passa pelo nosso pool compartilhado e não há nada para você configurar. Vale dizer isso porque não é assim com todo varejista deste pipeline - a ferramenta aponta Lowes, Grainger, Zalando e Fastenal como precisando de uma saída residencial própria. A Zoro não está entre eles.
O que posso colar como entrada?+
Uma URL de produto da Zoro, ou uma URL de categoria ou busca - as duas funcionam, uma por linha. O exemplo da própria plataforma para este serviço é uma página de produto. Uma URL de categoria devolve os produtos que há nela, uma linha cada, até o limite que você definir.
Quais colunas eu vou receber?+
Quinze, nesta ordem: query, service, name, price, currency, availability, brand, sku, mpn, gtin, rating, reviews, image, url e description. Esses nomes estão confirmados em dobro - pelo array de colunas publicado para este serviço e pela linha de cabeçalho de toda pasta de trabalho que temos do pipeline compartilhado por trás dele. O JSON acrescenta um décimo sexto campo, position; o CSV e o XLSX param em quinze.
Por que esta página não mostra valores de exemplo?+
Porque nunca rodamos isto contra a Zoro, e preferimos dizer isso a inventá-los. Das quarenta e cinco exportações que temos do pipeline compartilhado por trás deste serviço, nenhuma é uma execução da Zoro: quarenta e quatro voltaram com um cabeçalho e nenhuma linha, e a única preenchida é de outro varejista. Os nomes das colunas são sólidos; os conteúdos das células não são algo que possamos descrever honestamente ainda.
Por que uma coluna pode voltar vazia?+
Porque a página nunca declarou aquele campo. Os produtos são lidos do JSON-LD que uma página publica sobre si mesma, então toda coluna depois de service só existe se o varejista a colocou nos dados estruturados dele - um vazio significa não publicado, e não execução falhou, e rodar de novo não muda isso. Na única exportação preenchida que temos desta ferramenta compartilhada, seis das quinze colunas estavam vazias em todas as linhas.
Enviar um arquivo substitui o que eu digitei?+
Não - é acrescentado a isso, e duplicatas não são removidas. Envie o mesmo arquivo duas vezes e aquelas URLs serão buscadas duas vezes e cobradas duas vezes, então confira a caixa antes de rodar. Em CSV e TXT a linha inteira é tomada como uma URL; só o XLSX é lido por coluna, e ali ele pega a coluna A. Parquet aparece no seletor mas não pode ser lido no navegador.
Quanto custa?+
As primeiras 500 linhas são grátis e valem uma única vez, sem cartão de crédito. Depois disso são US$ 0,002 por linha - a mesma tarifa fixa de qualquer outro scraper da plataforma. O estimador mostra o custo de uma execução antes de ela começar, o que aqui vale uma olhada porque o limite é por consulta e uma lista de URLs de categoria multiplica.

Transforme uma página de categoria
em uma tabela que dá para ordenar.

Suas primeiras 500 linhas são grátis - sem cartão, sem assinatura. Depois são US$ 0,002 por linha, tarifa fixa.

Ativa na hora · sem cartão

Fazer scraping de páginas de produto da Zoro para linhas

O Scraper de Produtos da Zoro transforma páginas de produto e de categoria da zoro.com em linhas. Cole uma URL de produto, ou uma URL de categoria ou busca, uma por linha - ou envie um arquivo CSV, XLSX ou TXT -, defina um limite por consulta, e cada produto volta como um registro com a consulta de onde veio, o serviço que o produziu, o nome, preço e moeda, disponibilidade, marca, sku, mpn e gtin, uma nota e número de avaliações, uma imagem, um link e uma descrição. Quinze colunas no arquivo e dezesseis no JSON, uma linha por produto. Diferente de alguns varejistas deste pipeline compartilhado - a ferramenta aponta Lowes, Grainger, Zalando e Fastenal - a Zoro não precisa de proxy residencial seu, então não há nada para configurar além da lista e do limite.

Duas coisas vale entender antes de construir sobre esta exportação, e as duas se resumem a de onde vêm os dados. Os produtos são lidos do JSON-LD que uma página publica sobre si mesma - os dados estruturados que os varejistas embutem para que os buscadores possam exibir um preço e um status de estoque. É por isso que as colunas têm os nomes que têm: sku, mpn, gtin, brand, availability e currency são o vocabulário padrão para descrever um produto. Isso também impõe um teto: toda coluna depois de service só existe se o varejista declarou aquele campo, então uma célula vazia significa não publicado e não execução falhou, e rodar de novo não vai preenchê-la.

A segunda é que esta página não imprime valores de exemplo, porque nunca a rodamos contra a Zoro. Das quarenta e cinco exportações que temos do pipeline compartilhado por trás deste serviço, nenhuma é uma execução da Zoro - quarenta e quatro devolveram um cabeçalho e nenhuma linha, e a única preenchida é de outro varejista. Essa exportação vale exatamente uma observação honesta, e ela é sobre a ferramenta e não sobre a Zoro: query e service preencheram em toda linha porque o scraper os escreve ele mesmo, e seis das quinze colunas estavam vazias em todas as linhas. Conte com lacunas aqui também, conte que elas caiam em outro lugar porque outro varejista publica dados estruturados diferentes, e deixe uma pequena execução gratuita dizer quais - é uma pergunta que 500 linhas gratuitas resolvem de vez.

No lado jurídico, esta é uma das exportações mais leves do nosso catálogo. Tudo o que é coletado é mostrado a qualquer visitante numa página de produto pública, não há login nem paywall envolvido, e nenhuma pessoa é nomeada em nenhuma das quinze colunas - reviews é uma contagem e não texto de avaliação, então nem um corpo de avaliação volta. São produtos e preços. Os próprios termos da Zoro continuam regendo a coleta automatizada do site deles, então leia antes de escalar, e lembre que descrições de produto e imagens são textos e fotografias de outra pessoa se você pretende republicá-los. Comece grátis: suas primeiras 500 linhas não custam nada e não precisam de cartão, e depois são US$ 0,002 por linha, tarifa plana.