Scraper de Produtos da Customink

As páginas de produto da Customink,
como quinze colunas.

Cole uma URL de produto da Customink, ou uma página de categoria como customink.com/products/t-shirts/4, e os produtos voltam como linhas - nome, preço e moeda, disponibilidade, marca, as colunas de identificador, nota e número de avaliações, uma imagem, um link e uma descrição.

500 linhas grátis, uma única vezUS$ 0,002 por linha depois15 colunasCSV · XLSX · JSON
Como funciona

Cinco passos,
e nenhuma configuração.

Uma entrada e um controle. Aqui não há proxy a configurar, então o trabalho inteiro é uma lista de links e um número.

  1. PASSO 1Entre na plataforma.
  2. PASSO 2Abra o Scraper de Produtos da Customink.
  3. PASSO 3Cole URLs de produto da Customink ou URLs de categoria e busca, uma por linha - ou envie um arquivo CSV, XLSX ou TXT.
  4. PASSO 4Defina um limite por consulta, ou coloque zero para levar tudo, e clique em Get Data.
  5. PASSO 5Baixe o resultado como CSV, XLSX ou JSON.

O limite é por consulta: cinco URLs de categoria com limite de duzentos são duzentos produtos de cada uma - não duzentos no total.

Por que as equipes usam

Um catálogo que dá para ordenar,
não uma grade para rolar.

Uma URL de categoria já é um trabalho completo

Você não precisa juntar links de produto antes. Dê a ele uma página de categoria e ele percorre os produtos que há nela, uma linha cada - é assim que uma página de navegação vira algo que dá para ordenar por preço ou agrupar por marca.

Sem proxy necessário

Alguns varejistas deste pipeline compartilhado precisam de uma saída residencial própria - a ferramenta cita Lowes, Grainger, Zalando e Fastenal. A Customink não é um deles. A execução sai pelo nosso pool, e não há nada para você configurar.

Colunas de identificador, mantidas à parte

sku, mpn e gtin chegam como colunas próprias em vez de enterrados num título, e currency fica ao lado de price em vez de dentro dele. É isso que torna uma exportação combinável com um catálogo que não é o da Customink - onde a página declarar esses campos, claro.

O que esta página pode e não pode dizer

Os nomes estão confirmados.
Os conteúdos não.

Vale dizer com franqueza, porque muda o jeito de ler o dicionário abaixo.

Os quinze nomes de coluna são sólidos: estão confirmados em dobro, pelo array de colunas publicado para este serviço e pela linha de cabeçalho de toda pasta de trabalho que temos do pipeline compartilhado por trás dele - idêntica na preenchida e nas vazias. Construa um esquema em torno desses nomes com confiança.

O que não podemos fazer é dizer o que a Customink coloca neles, porque nunca rodamos isto contra a Customink. Nenhuma das exportações que temos é uma execução da Customink. Quase todas voltaram com um cabeçalho e sem linhas, e a única preenchida é de um varejista completamente diferente. Em vez de disfarçar, esta página não imprime valores de exemplo nem formatos - sem uma execução da Customink, estaríamos inventando.

Há uma pergunta específica da Customink que vamos sinalizar em vez de responder. A Customink vende roupa feita sob encomenda, em que o preço unitário costuma depender de quantas você pede. Não sabemos o que uma única célula de price contém nessa situação - se um preço inicial, um preço em alguma quantidade, ou outra coisa - e não vamos raciocinar até uma resposta. Rode uma categoria no plano gratuito e leia essa coluna antes de construir qualquer coisa que dependa dela.

Dicionário de dados

Quinze colunas,
e um teto honesto.

Os nomes são exatos e duplamente confirmados. As descrições dizem para que serve cada coluna - não o que ela vai conter, porque isso é decisão do varejista e não nossa, e a nota abaixo explica por quê.

query
A URL que você enviou para esta linha - a página de produto, categoria ou busca de onde ela veio. É escrita pelo scraper, então está em todas as linhas.
service
De qual varejista esta linha veio. Este scraper divide um pipeline com vários outros serviços de produto, e o que você escolheu fica carimbado em cada linha - útil se você mantém mais de um varejista na mesma tabela.
name
O nome do produto como a página o declara.
price
O preço que a página declara. Vale conferir primeiro neste varejista: a Customink vende roupa sob encomenda, em que o preço unitário costuma variar com a quantidade, e não vimos uma célula preenchida que diga qual número cai aqui.
currency
A moeda desse preço, como coluna separada - assim você não precisa extrair um símbolo do campo de preço.
availability
O status de estoque que a página declara.
brand
A marca que a página declara.
sku
O código de item do próprio varejista.
mpn
O número de peça do fabricante. Junto com gtin, é o que torna uma exportação combinável com um catálogo que não é o da Customink.
gtin
O número global de item comercial - o identificador do código de barras.
rating
A nota do produto, se a página publicar uma. Nenhuma escala é informada aqui; não vimos nenhum valor.
reviews
A contagem de avaliações. Um número, não o texto - não há corpo de avaliação nesta exportação.
image
A imagem do produto que a página declara.
url
O link do produto.
description
A descrição do produto que a página declara.

Duas coisas sobre as evidências por trás desta página. Primeiro, o mecanismo: os produtos são lidos do JSON-LD que uma página publica sobre si mesma - os dados estruturados que os varejistas embutem para os buscadores. Isso impõe um teto que esta página não vai fingir ultrapassar. Toda coluna depois de service só existe se a Customink declarar aquele campo, então um vazio significa não publicado, e não execução falhou. Segundo, a lacuna: nunca rodamos isto contra a Customink. Temos quarenta e cinco exportações do pipeline compartilhado por trás deste serviço e nenhuma é uma execução da Customink - quarenta e quatro voltaram vazias e a única preenchida é de outro varejista. Essa exportação vale um dado honesto sobre a ferramenta, e não sobre a Customink: query e service preencheram em toda linha, porque o scraper os escreve ele mesmo - e seis das quinze estavam vazias em todas e cada uma das linhas. Conte com lacunas aqui também, conte que elas caiam em outro lugar porque outro varejista publica dados estruturados diferentes, e deixe sua primeira execução gratuita dizer quais. É também por isso que esta página não imprime valores de exemplo nem formatos: sem uma execução da Customink, estaríamos inventando.

Controles da execução

Duas entradas,
e é esse o formulário inteiro.

Uma lista de URLs e um limite. Sem ordenação, sem filtro, sem campo de proxy - neste varejista não há mais nada para definir.

https://www.customink.com/products/t-shirts/4 Uma URL de produto, ou de categoria / busca Uma por linha Upload CSV · XLSX · TXT Limite por consulta, ou 0 para tudo Uma linha por produto Sem proxy residencial Lido do JSON-LD da página
De onde vêm os campos

A página declara,
nós reportamos.

Este scraper lê os dados estruturados que uma página de produto publica sobre si mesma - o bloco JSON-LD que os varejistas embutem para que os buscadores possam exibir preço e status de estoque. É por isso que as colunas são o que são: sku, mpn, gtin, brand, availability e currency são o vocabulário padrão para descrever um produto, e não nomes que inventamos.

A consequência prática é a que vale planejar. Uma coluna só vale o quanto valer a marcação do próprio varejista. Se um campo falta nos dados estruturados da página, ele volta vazio, e por mais que você rode de novo isso não muda - não é uma falha, é uma ausência. Na única exportação preenchida que temos desta ferramenta compartilhada, seis das quinze colunas estavam vazias em todas as linhas.

Se você precisa de algo que a marcação não carrega, isso é outro trabalho - o Scraper Universal com IA lê a própria página e devolve os atributos que você nomear, em vez de apenas o que foi declarado para os buscadores.

livescraper.app · o teto
Lido do JSON-LD da página
query e service: escritos por nós
Os outros treze: declarados pela página
Vazio = não publicado, não falhou!
Confira as lacunas na sua primeira execução
Dados estruturados são escolha do varejista, e ela varia entre eles.
Entregando a lista

Uploads somam
e não removem duplicatas.

Um arquivo enviado não limpa a caixa - as linhas são acrescentadas ao que você já tinha digitado, e duplicatas não são removidas. Envie o mesmo arquivo duas vezes e aquelas URLs serão de fato buscadas duas vezes, e cobradas duas vezes. Isso é próprio deste pipeline: alguns dos nossos outros scrapers deduplicam no upload e este não, então não traga o hábito de lá.

Para um CSV ou TXT a linha inteira é tomada como uma URL, então uma planilha com colunas extras não é o que você quer aqui. Só um XLSX é lido por coluna, e ali ele pega a coluna A.

O seletor lista Parquet ao lado de CSV, XLSX e TXT, mas na verdade não consegue ler um no navegador e vai lhe dizer isso - use um dos outros três.

livescraper.app · o upload
CSV · XLSX · TXT
Duplicatas NÃO são removidas!
CSV e TXT: a linha inteira
XLSX: coluna A
Acrescentado ao que você digitou
Confira a caixa antes de rodar - uma lista dobrada é uma conta dobrada.
Fluxos de trabalho comuns

Três trabalhos que as pessoas
mais rodam aqui.

Alguns exemplos do que um catálogo de roupa personalizável vale depois que vira uma tabela.

Sortimento

Ver uma categoria como lista, não como grade

Dê a ele uma página de categoria e você recebe cada produto dela como linha, com a marca e as colunas de identificador ao lado do nome. Ordenar uma página de navegação por algo que não seja o que o site oferece é justamente o objetivo.

Merchandising · Pesquisa
Comparação

Colocar um fornecedor ao lado dos outros que você acompanha

Como service vem carimbado em cada linha, uma mesma tabela pode ter a Customink ao lado dos outros varejistas deste pipeline e ainda assim se separar direitinho. Onde mpn ou gtin estiverem declarados, a mesma peça lisa pode ser casada entre fornecedores.

Sourcing · Compras
Monitoramento

Rodar uma categoria de novo e comparar

A mesma URL de categoria de forma programada dá dois arquivos comparáveis. O que apareceu, o que sumiu e o que mudou é um diff em vez de uma tarde de cliques - e sku é a chave para comparar, onde ela for publicada.

Análise · Relatórios
Preços

Pague só pelos produtos
que você realmente extrai.

Sem assinatura, sem mínimo, sem cobrança recorrente. Suas primeiras 500 linhas são por nossa conta - depois é pagamento conforme o uso, com a mesma tarifa fixa de qualquer outro scraper daqui.

Plano gratuito

500 linhas grátis - US$ 0

Em toda conta nova, uma única vez. Sem cartão de crédito. Limites por consulta, upload de arquivo e todos os formatos de exportação incluídos - e neste varejista, também não há proxy para pagar.

US$ 0 para sempre
Pague conforme o uso

US$ 0,002 por linha, após o plano gratuito

A mesma tarifa fixa de qualquer outro scraper da plataforma. O estimador prévio mostra a quantidade de linhas e o custo em créditos antes de começar - vale uma olhada aqui, porque o limite é por consulta e uma lista de URLs de categoria multiplica.

Mais popular
Volume

Sob medida · alto volume

Preço por volume, workers dedicados e um SLA para acompanhar um catálogo de forma programada. Conte seus números e enviamos uma proposta.

Fale conosco
10% de desconto na sua primeira execução paga.Use o código LIVESCRAPER10 no checkout.
Cadastre-se
Combina bem com

O mesmo pipeline,
e o caminho para além dele.

Dois irmãos que se comportam igual em outros varejistas, e uma ferramenta para quando os dados estruturados não trazem o que você precisa.

A parte jurídica

É legal fazer scraping
da Customink?

Resposta curta: isto são dados públicos de catálogo sem dados pessoais dentro - e os dados estruturados são publicados, de saída, para serem lidos por máquinas.

Tudo o que está nestas quinze colunas é mostrado numa página de produto pública da Customink a qualquer visitante, logado ou não. Nenhum login é usado, nenhum paywall é atravessado e nenhuma conta é tocada, e a execução sai pelo nosso pool de proxies em vez do seu próprio IP. O que é lido em concreto é o bloco JSON-LD - dados estruturados que um varejista embute justamente para que leitores automáticos peguem o nome, o preço e a disponibilidade.

Nenhuma pessoa é nomeada nesta exportação. Não há coluna de cliente, de quem avaliou nem de vendedor - reviews é uma contagem, não o texto das avaliações, então nem o corpo de uma avaliação volta. São produtos e preços, o que a coloca na ponta mais leve em termos de proteção de dados.

Os termos da própria Customink regem a coleta automatizada do site deles, então leia-os antes de escalar em vez de se apoiar no fato de as páginas serem públicas. E se você republicar descrições de produto ou imagens, lembre que são texto e fotografia de outra pessoa - coletá-los para análise é uma questão, publicá-los é outra. Não rodamos rastreadores de terceiros na camada de dados, e suas exportações se apagam sozinhas após 30 dias.

livescraper.app · princípios
Apenas páginas de produto públicas
Sem logins, sem tocar em contas
Dados estruturados, publicados para máquinas
Produtos e preços - ninguém é nomeado
As exportações se apagam (30 dias)
Confira os próprios termos da Customink antes de escalar.
Perguntas frequentes

O que as pessoas perguntam
antes de se cadastrar.

As perguntas que mais ouvimos. Mais alguma coisa? Fale com a gente - quem escreve as respostas são pessoas, não bots.

Como eu faço scraping dos produtos da Customink?+
Com o Scraper de Produtos da Customink: entre na plataforma, abra o Scraper de Produtos da Customink, cole URLs de produto da Customink ou URLs de categoria e busca uma por linha (ou envie um arquivo CSV, XLSX ou TXT), defina um limite por consulta ou coloque zero para levar tudo, e então clique em Get Data e baixe o resultado como CSV, XLSX ou JSON.
Preciso de um proxy residencial para este?+
Não. A execução sai pelo nosso pool compartilhado e não há nada para você configurar. Vale dizer porque não é verdade para todo varejista deste pipeline - a ferramenta cita Lowes, Grainger, Zalando e Fastenal como os que precisam de uma saída residencial própria. A Customink não está entre eles.
O que posso colar como entrada?+
Uma URL de produto da Customink, ou uma URL de categoria ou busca - as duas funcionam, uma por linha. O exemplo da própria plataforma para este serviço é uma página de categoria, https://www.customink.com/products/t-shirts/4. Uma URL de categoria devolve os produtos que há nela, uma linha cada, até o limite que você definir.
Quais colunas eu vou receber?+
Quinze, nesta ordem: query, service, name, price, currency, availability, brand, sku, mpn, gtin, rating, reviews, image, url e description. Esses nomes estão confirmados em dobro - pelo array de colunas publicado para este serviço e pela linha de cabeçalho de toda pasta de trabalho que temos do pipeline compartilhado por trás dele. O JSON acrescenta um décimo sexto campo, position; o CSV e o XLSX param em quinze.
Por que esta página não mostra valores de exemplo?+
Porque nunca rodamos isto contra a Customink, e preferimos dizer isso a inventá-los. Das quarenta e cinco exportações que temos do pipeline compartilhado por trás deste serviço, nenhuma é uma execução da Customink: quarenta e quatro voltaram com um cabeçalho e sem linhas, e a única preenchida é de outro varejista. Os nomes das colunas são sólidos; o conteúdo das células não é algo que possamos descrever com honestidade ainda.
Por que uma coluna pode voltar vazia?+
Porque a página nunca declarou aquele campo. Os produtos são lidos do JSON-LD que uma página publica sobre si mesma, então toda coluna depois de service só existe se o varejista a colocou nos dados estruturados dele - um vazio significa não publicado, e não execução falhou, e rodar de novo não muda isso. Na única exportação preenchida que temos desta ferramenta compartilhada, seis das quinze colunas estavam vazias em todas as linhas.
O que a coluna price contém em itens sob encomenda?+
Não sabemos, e esta é a única coisa específica da Customink que vamos sinalizar em vez de responder. A Customink vende roupa personalizável, em que o preço unitário costuma depender da quantidade pedida, e sem uma execução preenchida da Customink não podemos dizer se a célula traz um preço inicial, um preço em alguma quantidade, ou outra coisa. Rode uma categoria no plano gratuito e leia essa coluna antes de construir qualquer coisa que dependa dela.
Enviar um arquivo substitui o que eu digitei?+
Não - é acrescentado a isso, e duplicatas não são removidas. Envie o mesmo arquivo duas vezes e aquelas URLs serão buscadas duas vezes e cobradas duas vezes, então confira a caixa antes de rodar. Em CSV e TXT a linha inteira é tomada como uma URL; só o XLSX é lido por coluna, e ali ele pega a coluna A. Parquet aparece no seletor mas não pode ser lido no navegador.
Quanto custa?+
As primeiras 500 linhas são grátis e valem uma única vez, sem cartão de crédito. Depois disso são US$ 0,002 por linha - a mesma tarifa fixa de qualquer outro scraper da plataforma. O estimador mostra o custo de uma execução antes de ela começar, o que aqui vale uma olhada porque o limite é por consulta e uma lista de URLs de categoria multiplica.

Transforme uma página de categoria
em uma tabela que dá para ordenar.

Suas primeiras 500 linhas são grátis - sem cartão, sem assinatura. Depois são US$ 0,002 por linha, tarifa fixa.

Ativa na hora · sem cartão

Extrair as páginas de produto da Customink como linhas

O Scraper de Produtos da Customink transforma páginas de produto e de categoria do customink.com em linhas. Cole uma URL de produto, ou uma página de categoria como customink.com/products/t-shirts/4, uma por linha - ou envie um arquivo CSV, XLSX ou TXT -, defina um limite por consulta, e cada produto volta como um registro com a consulta de onde veio, o serviço que o produziu, o nome, preço e moeda, disponibilidade, marca, sku, mpn e gtin, uma nota e um número de avaliações, uma imagem, um link e uma descrição. Quinze colunas no arquivo e dezesseis no JSON, uma linha por produto. Ao contrário de alguns varejistas deste pipeline compartilhado - a ferramenta cita Lowes, Grainger, Zalando e Fastenal -, a Customink não precisa de um proxy residencial próprio, então não há nada a configurar além da lista e do limite.

Duas coisas vale entender antes de construir sobre esta exportação, e as duas se resumem a de onde vêm os dados. Os produtos são lidos do JSON-LD que uma página publica sobre si mesma - os dados estruturados que os varejistas embutem para que os buscadores possam exibir um preço e um status de estoque. É por isso que as colunas têm os nomes que têm: sku, mpn, gtin, brand, availability e currency são o vocabulário padrão para descrever um produto. Isso também impõe um teto: toda coluna depois de service só existe se o varejista declarou aquele campo, então uma célula vazia significa não publicado e não execução falhou, e rodar de novo não vai preenchê-la.

A segunda é que esta página não imprime valores de exemplo, porque nunca a rodamos contra a Customink. Das quarenta e cinco exportações que temos do pipeline compartilhado por trás deste serviço, nenhuma é uma execução da Customink - quarenta e quatro devolveram um cabeçalho e nenhuma linha, e a única preenchida é de outro varejista. Essa exportação vale exatamente uma observação honesta, e ela é sobre a ferramenta e não sobre a Customink: query e service preencheram em toda linha porque o scraper os escreve ele mesmo, e seis das quinze colunas estavam vazias em todas as linhas. Conte com lacunas aqui também, conte que elas caiam em outro lugar porque outro varejista publica dados estruturados diferentes, e deixe uma pequena execução gratuita dizer quais. Uma pergunta específica da Customink que sinalizamos em vez de responder: isto é roupa feita sob encomenda, em que o preço unitário costuma variar com a quantidade, e não podemos dizer qual número uma célula de price traz até que uma execução preenchida nos mostre.

No lado jurídico, esta está entre as exportações mais leves do nosso catálogo. Tudo o que é coletado é mostrado numa página de produto pública a qualquer visitante, não há login nem paywall envolvidos, e nenhuma pessoa é nomeada nas quinze colunas - reviews é uma contagem e não o texto das avaliações, então nem o corpo de uma avaliação volta. São produtos e preços. Os termos da própria Customink continuam regendo a coleta automatizada do site deles, então leia-os antes de escalar, e lembre que descrições de produto e imagens são texto e fotografia de outra pessoa se você pretende republicá-los. Comece grátis: suas primeiras 500 linhas não custam nada e não pedem cartão, e depois são US$ 0,002 por linha, tarifa fixa.