Scraper de Produtos do GlobalIndustrial

Bloqueado às 03:43.
Tranquilo às 03:54.

A mesma URL, com onze minutos de diferença, recusada e depois servida. Esse é o achado útil aqui: o bloqueio é intermitente, então uma nova tentativa vale mais do que um contorno. O achado menos confortável é que a linha que obtivemos não é uma linha de produto, e esta página explica por quê antes de você construir em cima dela.

4 execuções: 1 ok, 3 bloqueadasa mesma URL recusada e depois servida 11 minutos depoisa linha ok é uma página de busca, não um produtocobrado pelas linhas devolvidas - uma execução bloqueada não cobra nada
Como funciona

Uma lista de URLs entra, uma planilha sai.

  1. PASSO 1Entre na plataforma.
  2. PASSO 2Abra o GlobalIndustrial Products Scraper.
  3. PASSO 3Cole as URLs da GlobalIndustrial que quiser, uma por linha - e leia a nota abaixo sobre quais formas realmente resolvem para um produto.
  4. PASSO 4Escolha o formato de saída (CSV / JSON / XLSX).
  5. PASSO 5Dispare o trabalho.
  6. PASSO 6Leia primeiro a coluna status e rode de novo tudo o que voltou bloqueado.
O que realmente encontramos

Tudo abaixo vem das nossas próprias execuções e verificações.

A mesma URL, recusada e depois servida

Este é o achado que vale a pena. Em 3 de julho de 2026 enviamos uma URL de produto às 03:43 e recebemos blocked (needs residential proxy); enviamos a URL idêntica às 03:54 e recebemos ok. Onze minutos. Nada mais mudou. Onde neste catálogo um bloqueio parece permanente, aqui ele comprovadamente não é - e isso faz da nova tentativa a resposta certa, não de uma fonte substituta.

Mas a linha bem-sucedida não é uma linha de produto

Preferimos sinalizar a deixar passar. Essa linha ok preencheu cinco campos e deixou dez vazios - sem identificador, sem marca, sem descrição, sem estoque, sem imagem. Seu name é o slug da URL, hífens e tudo, em vez de um título de produto. Uma linha que se batiza com o próprio endereço é uma linha que não encontrou produto, e esta página a trata assim.

Porque a URL redireciona para uma página de busca

Verificamos, e a explicação é limpa. Aquele endereço não serve página de produto nenhuma: ele responde com um redirecionamento permanente para uma página de resultados de busca do mesmo slug. O destino é uma listagem de muitos produtos - por isso a linha tem um slug como nome e por isso nove das suas colunas estão vazias. O número na coluna de preço aparece nessa página de busca; não está estabelecido que seja o preço da máquina que o slug nomeia, e não o apresentamos como tal.

E o redirecionamento cai num caminho que o robots.txt exclui

O robots.txt do site foi lido sem problemas e não traz nenhuma exclusão geral para rastreadores comuns. Mas conferido com um comparador correto, o caminho de produto está permitido enquanto o caminho de busca está proibido - e a URL permitida redireciona para a proibida. O exemplo de entrada registrado no nosso próprio catálogo de serviços é exatamente essa URL de busca. Sinalizamos a incoerência em vez de repetir o exemplo como recomendação.

A coluna de status dá a instrução

Duas das nossas quatro linhas voltaram com blocked (intermittent - retry) - o serviço dizendo o que fazer e não apenas o que aconteceu. Combinado com o experimento de onze minutos acima, o quadro é coerente: aqui um bloqueio é um momento, não um veredito. Conte as linhas bloqueadas por execução, tente de novo, e concilie por status e não pela contagem de linhas.

Uma execução bloqueada não gera cobrança

A cobrança segue as linhas realmente devolvidas, o que torna barato seguir o conselho de tentar de novo: três das nossas quatro execuções não produziram nada e não teriam custado nada. É também por isso que esta página não abre com um botão de cadastro. Uma linha que acabou descrevendo uma página de busca não é um resultado que vamos vender.

O que você recebe

Dezessete colunas, cinco delas preenchidas uma vez.

Lidas de uma exportação real, na ordem da planilha. Onde aqui se diz que uma coluna trazia valor, isso descreve a única linha que voltou ok - uma linha da qual temos motivos para desconfiar, pela razão exposta na nota abaixo.

query
A URL da GlobalIndustrial que você enviou, devolvida. Preenchida nas nossas quatro linhas, inclusive nas três bloqueadas, e é isso que permite rodar de novo exatamente as entradas que falharam.
sku_code
Prevista para a referência própria da GlobalIndustrial. Vazia na nossa linha ok. A ausência dela é parte do motivo pelo qual lemos aquela linha como uma página de busca e não como um produto.
product_url
Prevista para a página canônica do produto. Vazia na nossa linha ok - o endereço ficou em url e nada resolveu para um produto.
name
O título do produto. Na nossa linha ok isto é o slug da URL, com os hífens intactos, em vez de um título de varejo. Trate um valor em minúsculas e com hífens aqui como sinal de que a execução não chegou a uma página de produto.
description
Prevista para o texto do produto. Vazia na nossa linha ok.
parsed_price
O preço como número puro. Preenchida na nossa linha ok - mas leia a nota abaixo antes de usar. O número aparece na página de busca para a qual a URL redireciona; não está estabelecido que seja o preço do item que o slug nomeia.
price
O mesmo número com símbolo de moeda. Preenchida na nossa linha ok, com a mesma ressalva.
currency
A moeda em que o preço está expresso. Preenchida como um valor em dólares dos Estados Unidos na nossa linha ok.
availability
Prevista para o estado de disponibilidade. Vazia na nossa linha ok.
rating
Prevista para uma avaliação média. Vazia na nossa linha ok.
reviews
Prevista para a quantidade de resenhas. Vazia na nossa linha ok.
images
Prevista para as imagens do anúncio. Vazia na nossa linha ok - mais um sinal de que nenhuma página de produto foi alcançada.
brand
Prevista para o fabricante. Vazia na nossa linha ok.
sku
Prevista para um segundo identificador. Vazia na nossa linha ok, então não podemos dizer se este site a preenche de forma diferente de sku_code.
url
O endereço de que a linha saiu. Preenchida nas quatro linhas, porque é o que enviamos.
image
Prevista para a imagem principal em separado. Vazia na nossa linha ok.
status
Um indicador por linha escrito pelo nosso exportador, não pela GlobalIndustrial - e a coluna mais informativa deste serviço. Em quatro execuções ele assumiu três valores: ok uma vez, blocked (needs residential proxy) uma vez e blocked (intermittent - retry) duas vezes. O último é uma instrução, e o experimento de onze minutos acima diz que é boa.

Dezessete colunas por linha · CSV, JSON ou Excel

A coisa mais útil desta página é um aviso sobre os seus próprios dados. Nossa única linha bem-sucedida traz um nome que é o slug da URL, um preço, uma moeda - e dez colunas vazias. Verificamos por quê, e a resposta é que o endereço que enviamos não é uma página de produto: ele responde com um redirecionamento permanente para uma página de resultados de busca do mesmo slug. Uma página de busca não tem um único título de produto, e por isso o nome recaiu no slug, nem um único identificador, descrição, marca, valor de estoque ou imagem, e por isso essas colunas estão vazias. O número do preço aparece sim nessa página de busca, mas uma página de busca lista muitos produtos, então nada o estabelece como o preço da máquina que o slug nomeia - e por isso esta página nunca o apresenta assim. Há um segundo aviso, relacionado: o robots.txt do site permite o caminho de produto e proíbe o de busca, então a URL que você pode buscar redireciona para outra que pediram para você não rastrear. O exemplo de entrada registrado no nosso próprio catálogo de serviços é essa URL de busca. Envie URLs de produto reais, leia status primeiro, e tente de novo tudo o que vier bloqueado.

O que fazer com isso

Onde isso deixa o seu projeto.

Tente de novo, não substitua

Agende uma segunda tentativa, não um contorno

O resultado dos onze minutos é a lição prática. Aqui um bloqueio é um momento e não um veredito, então coloque uma nova tentativa no agendamento e conte as linhas bloqueadas por execução. Tentativas não custam nada quando falham, porque a cobrança segue as linhas devolvidas.

Operações · Agendamento
Confira o formato

Envie URLs de produto e confira o nome

Se um name devolvido parece um slug de URL - minúsculas, com hífens, batendo com o endereço -, a execução não chegou a um produto. É uma checagem de uma linha que merece estar no seu importador, e neste serviço ela teria pegado a nossa própria melhor linha.

Qualidade de dados · Engenharia
Atenção ao redirecionamento

Saiba onde a sua URL realmente cai

Um endereço que redireciona permanentemente para uma página de busca vai devolver dados de página de busca, e o próprio robots.txt do site pede que rastreadores comuns fiquem fora desse caminho. Resolva as suas URLs de entrada antes de enfileirá-las, e não depois de ler os resultados.

Conformidade · Planejamento
Fontes vizinhas

Precifique a categoria onde há linhas por trás

Se a pergunta é quanto custam suprimentos industriais e prediais, e não quanto este varejista especificamente cobra, os nossos serviços da Uline, Gemplers e Fastenal cobrem esse terreno nas mesmas dezessete colunas, e essas páginas relatam contagens de preenchimento reais de execuções reais.

Compras · Substituição
Preços

Linhas devolvidas, não tentativas feitas.

Nível gratuito

As primeiras 500 linhas são grátis

Uma única vez, no cadastro. Sem cartão e sem nada para cancelar depois.

Uma única vez, no cadastro
Tarifa

depois US$ 0,002 por linha

Cobrado pelas linhas realmente devolvidas, que é o que torna barato o conselho de tentar de novo desta página: três das nossas quatro execuções não produziram nada e não teriam custado nada.

Cobrado pelas linhas devolvidas
Sem assinatura

Nada recorrente

O saldo não expira num ciclo mensal, então um agendamento construído em torno de novas tentativas não escoa nada em silêncio entre elas.

Sem expiração mensal
10% de desconto na sua primeira execução paga.Use o código LIVESCRAPER10 no checkout.
Cadastre-se
Experimente também

As mesmas dezessete colunas, com linhas mais cheias.

A parte jurídica

É legal fazer scraping da GlobalIndustrial?

Preços e referências numa página pública de catálogo são fatos comerciais corriqueiros. O que merece cuidado aqui não é a permissão em geral, e sim um caminho específico - e um redirecionamento que o atravessa.

Um preço, um nome de produto e um número de catálogo são fatos sobre mercadoria posta à venda, lidos de uma página servida a qualquer visitante. Nada nas dezessete colunas descreve uma pessoa: nem nome, nem e-mail, nem telefone, nem conta - então as questões de proteção de dados que moldam os nossos serviços de dados pessoais não se colocam aqui.

Duas coisas são específicas deste site. Primeiro, o bloqueio, que é real e comprovadamente intermitente: a mesma URL foi recusada e depois servida onze minutos mais tarde, e duas das nossas linhas trazem um status que literalmente aconselha tentar de novo. Nós expomos o bloqueio na coluna de status e paramos aí, em vez de contorná-lo, e preferimos que você agende uma segunda tentativa a supor que a fonte está fechada. Segundo, e mais delicado: o robots.txt do site foi lido sem problemas e não traz nenhuma exclusão geral, mas o seu grupo geral proíbe o caminho de busca enquanto permite os caminhos de produto - e a URL de produto que enviamos responde com um redirecionamento permanente para esse caminho de busca. Um endereço que você tem permissão de pedir pode, portanto, cair onde pediram que você não rastreie. Relatamos isso em vez de tratar o redirecionamento como permissão, e sugeriríamos resolver as suas URLs de entrada antes de enfileirá-las. O exemplo de entrada registrado no nosso próprio catálogo de serviços é essa URL de busca, e é exatamente por isso que a apontamos em vez de repeti-la.

Nossos próprios termos são os mesmos de qualquer outro serviço daqui. Só páginas de acesso público, nada atrás de um login, nenhum rastreador de terceiros na camada de dados, e as exportações são apagadas automaticamente em 30 dias. A cobrança segue as linhas devolvidas, então uma tentativa bloqueada não é cobrança.

livescraper.app · o que as nossas execuções devolveram
Mesma URL: bloqueada às 03:43, ok às 03:54
3 de 4 linhas bloqueadas; duas delas aconselham tentar de novo
A linha ok é uma página de busca, não um produto
robots.txt permite o caminho de produto e proíbe o de busca
Cobrado pelas linhas devolvidas - as execuções bloqueadas não custaram nada
Nenhum número da nossa única linha ok é apresentado como o preço do produto que o seu slug nomeia.
Perguntas frequentes

O que as pessoas perguntam antes de se cadastrar.

A GlobalIndustrial está bloqueada?+
Às vezes, e podemos ser precisos. Das nossas quatro execuções, três voltaram bloqueadas e uma voltou ok - e a bloqueada e a bem-sucedida enviaram a mesma URL, com onze minutos de diferença, em 3 de julho de 2026. Então o bloqueio é um momento, não um veredito. Duas das linhas bloqueadas trazem até um status que diz blocked (intermittent - retry).
Então o serviço funciona?+
Ele devolveu uma linha, mas não uma útil, e preferimos dizer isso a contar como vitória. A linha bem-sucedida preencheu cinco campos e deixou dez vazios, e o seu name é o slug da URL em vez de um título de produto. É assim que se parece uma execução que não chega a uma página de produto.
Por que não chegou a uma página de produto?+
Porque a URL não é uma. Verificamos em 12 de agosto de 2026: aquele endereço responde com um redirecionamento permanente para uma página de resultados de busca do mesmo slug. Uma página de busca lista muitos produtos, então não há título, identificador, marca, descrição, valor de estoque ou imagem únicos a registrar - que é exatamente o formato da linha que obtivemos.
E o preço naquela linha?+
O número aparece sim na página de busca para a qual a URL redireciona. Mas essa página lista muitos produtos, então nada o estabelece como o preço do item que o slug nomeia - e por isso não o imprimimos em lugar nenhum desta página como o preço daquele produto. Trate-o como um valor lido de uma página de listagem e confirme antes de usar.
Que URLs eu devo enviar?+
URLs de produto reais, e resolva-as antes. O robots.txt do site permite os caminhos de produto e proíbe o de busca, e a URL em formato de produto que usamos redireciona para esse caminho de busca. O exemplo de entrada registrado no nosso próprio catálogo para este serviço é a URL de busca, e é por isso que a sinalizamos em vez de repeti-la.
Como devo lidar com o bloqueio?+
Tentando de novo. Conte as linhas bloqueadas por execução, reenvie-as, e concilie por status e não pela contagem de linhas. A cobrança segue as linhas realmente devolvidas, então as tentativas que falham não custam nada - é isso que torna um agendamento de novas tentativas a resposta barata aqui.
A lista de colunas é real?+
Sim. As dezessete colunas vêm da linha de cabeçalho de uma exportação genuína e são idênticas ao esquema usado pelos nossos serviços da Uline, Gemplers, CDW, Waxie, Otto, Newegg e Decathlon, então um importador escrito para qualquer um deles lê um arquivo da GlobalIndustrial sem mudanças.
Uma execução bloqueada vai me custar alguma coisa?+
Não. A cobrança segue as linhas realmente devolvidas. Três das nossas quatro execuções não produziram linhas aproveitáveis e não teriam custado nada.
Em que formatos posso exportar?+
CSV, JSON ou Excel. As dezessete colunas e a ordem delas são as mesmas nos três.

Tente de novo. E confira o nome.

Aqui o bloqueio é intermitente - a mesma URL falhou e onze minutos depois funcionou -, então uma segunda tentativa vale mais do que um contorno. Só garanta que a URL resolva para um produto, porque a nossa não resolveu. Uma execução bloqueada não cobra nada.

Cobrado pelas linhas devolvidas · uma tentativa bloqueada não é cobrança

Fazer scraping de dados de produtos da GlobalIndustrial

A GlobalIndustrial vende equipamento industrial, de movimentação de materiais e predial, e a nossa exportação para ela guarda quatro execuções - uma bem-sucedida e três bloqueadas. A coisa mais útil nesse pequeno conjunto de dados é uma coincidência de horário que acaba não sendo uma. Em 3 de julho de 2026 enviamos uma URL em formato de produto às 03:43 e a execução voltou bloqueada, pedindo um proxy residencial. Enviamos a URL idêntica às 03:54 e ela voltou bem-sucedida. Onze minutos, sem que nada mais mudasse. Duas das nossas outras linhas trazem um status que diz, com todas as letras, que o bloqueio é intermitente e que o pedido deve ser repetido. Somados, isso forma um quadro coerente e acionável: neste site um bloqueio é um momento e não um veredito, e um agendamento de novas tentativas vence um contorno.

A metade menos confortável da história é a própria linha bem-sucedida, e preferimos começar pelo problema a enterrá-lo. Aquela linha preencheu cinco de dezessete campos - o endereço enviado, o endereço de novo, um preço, uma moeda e um nome - e deixou dez vazios. Não havia identificador, marca, descrição, valor de estoque nem imagem. E o nome não é um título de produto: é o slug da URL, em minúsculas e com hífens, idêntico ao final do endereço que enviamos. Uma linha que se batiza com a própria URL é uma linha que nunca encontrou um produto.

Verificamos por quê, e a explicação é limpa. Em 12 de agosto de 2026 aquele endereço não servia página de produto nenhuma. Ele respondia com um redirecionamento permanente para uma página de resultados de busca do mesmo slug - uma listagem de muitos produtos, meio megabyte de marcação, o termo de busca aparecendo dezenas de vezes. Isso explica cada estranheza da linha: uma página de busca não tem um único título, então o nome recaiu no slug; não tem um único identificador, marca, descrição, valor de estoque ou imagem, então essas colunas estão vazias. O número do preço aparece sim nessa página de busca. Mas uma página que lista muitos produtos não estabelece a qual deles um número pertence, então não o reproduzimos em lugar nenhum desta página como o preço da máquina que o slug nomeia. Se você levar uma única coisa desta página para o seu próprio importador, que seja a checagem: um name que parece um slug de URL significa que a execução não chegou a um produto.

Mais uma coisa merece ser dita e não suavizada. O robots.txt do site foi lido sem problemas e não traz nenhuma exclusão geral para rastreadores comuns - mas lido com um comparador de grupos correto ele permite o caminho de produto e proíbe o de busca, e a URL em formato de produto que enviamos redireciona para esse caminho de busca. Um endereço que você tem permissão de buscar pode, portanto, cair em outro que pediram que você não rastreie, o que é um bom motivo para resolver as URLs de entrada antes de enfileirá-las, e não depois de ler os resultados. O exemplo de entrada registrado no nosso próprio catálogo de serviços para este scraper é justamente essa URL de busca, que é precisamente por que sinalizamos a incoerência em vez de reproduzi-la como recomendação. A cobrança segue as linhas realmente devolvidas, então tanto as tentativas bloqueadas quanto as repetições não custam nada quando falham. Só páginas de acesso público, nenhum rastreador de terceiros na camada de dados, exportações apagadas automaticamente em 30 dias, e as suas primeiras 500 linhas grátis, sem cartão de crédito.