Scraper de Produits Zoro

Les fiches produit Zoro,
en quinze colonnes.

Collez une URL de produit Zoro, ou une URL de catégorie ou de recherche, et les produits reviennent en lignes - nom, prix et devise, disponibilité, marque, les colonnes d'identifiant, note et avis, une image, un lien et une description.

500 lignes gratuites, une seule fois0,002 $ par ligne ensuite15 colonnesCSV · XLSX · JSON
Comment ça marche

Cinq étapes,
et aucune configuration.

Une entrée et un réglage. Ici, aucun proxy à configurer : tout le job tient dans une liste de liens et un nombre.

  1. ÉTAPE 1Connectez-vous à la plateforme.
  2. ÉTAPE 2Ouvrez le Scraper de Produits Zoro.
  3. ÉTAPE 3Collez des URL de produit Zoro ou des URL de catégorie et de recherche, une par ligne - ou téléversez un fichier CSV, XLSX ou TXT.
  4. ÉTAPE 4Fixez une limite par requête, ou mettez-la à zéro pour tout prendre, puis cliquez sur Get Data.
  5. ÉTAPE 5Téléchargez le résultat en CSV, XLSX ou JSON.

La limite est par requête : cinq URL de catégorie avec une limite de deux cents donnent deux cents produits pour chacune - pas deux cents en tout.

Pourquoi les équipes l'utilisent

Un catalogue que l'on peut trier,
pas une grille que l'on fait défiler.

Un lien de produit ou une catégorie entière

Une ligne peut être une fiche produit isolée ou une URL de catégorie ou de recherche, et une catégorie revient dépliée en ses produits, une ligne chacun. C'est ainsi qu'une page de navigation devient quelque chose que vous pouvez trier par prix ou grouper par marque.

Aucun proxy nécessaire

Certains marchands de ce pipeline partagé exigent une sortie résidentielle à vous - l'outil désigne Lowes, Grainger, Zalando et Fastenal. Zoro n'en fait pas partie. L'exécution passe par notre pool, et vous n'avez rien à configurer.

Les colonnes d'identifiant, gardées à part

sku, mpn et gtin arrivent comme des colonnes à part plutôt qu'enfouis dans un intitulé, et currency se tient à côté de price au lieu d'être dedans. C'est ce qui rend un export joignable à un catalogue qui n'est pas celui de Zoro - là où la page déclare ces champs.

Ce que cette page peut et ne peut pas vous dire

Les noms sont confirmés.
Les contenus non.

Cela mérite d'être dit franchement, car cela change la façon dont il faut lire le dictionnaire ci-dessous.

Les quinze noms de colonnes sont solides : ils sont confirmés deux fois, par le tableau de colonnes publié pour ce service et par la ligne d'en-tête de chaque classeur que nous détenons du pipeline partagé qui l'alimente - identique sur celui qui est rempli comme sur les vides. Bâtissez un schéma autour de ces noms en confiance.

Ce que nous ne pouvons pas faire, c'est vous dire ce que Zoro y met, parce que nous ne l'avons jamais lancé contre Zoro. Pas un seul des exports que nous détenons n'est une exécution Zoro. Presque tous sont revenus avec un en-tête et aucune ligne, et le seul rempli concerne un tout autre marchand. Plutôt que d'habiller cela, cette page n'imprime aucune valeur d'exemple ni aucun format - sans exécution Zoro, nous les inventerions.

La bonne nouvelle, c'est le peu que cela coûte à trancher. Lesquelles des treize colonnes déclarées Zoro publie réellement est une question qu'une seule petite exécution règle une fois pour toutes, et les 500 premières lignes ne coûtent rien - pointez-la donc sur une seule catégorie, regardez ce qui est revenu, et vous en saurez plus sur cet export que ce qu'une page pourrait honnêtement vous dire à l'avance.

Dictionnaire de données

Quinze colonnes,
et un plafond assumé.

Les noms sont exacts et doublement confirmés. Les descriptions disent à quoi sert chaque colonne - pas ce qu'elle contiendra, car c'est la décision de l'enseigne et non la nôtre, et la note ci-dessous explique pourquoi.

query
L'URL que vous avez soumise pour cette ligne - la page produit, catégorie ou recherche d'où elle provient. Écrite par le scraper, elle est donc présente sur chaque ligne.
service
De quelle enseigne provient cette ligne. Ce scraper partage un pipeline avec plusieurs autres services produits, et celui que vous avez choisi est estampillé sur chaque ligne - pratique si vous conservez plusieurs enseignes dans la même table.
name
Le nom du produit tel que la page le déclare.
price
Le prix que la page déclare.
currency
La devise de ce prix, en colonne séparée - vous n'avez donc pas à extraire un symbole du champ prix.
availability
L'état de stock que la page déclare.
brand
La marque que la page déclare.
sku
Le code article propre à l'enseigne.
mpn
La référence fabricant. Avec gtin, c'est elle qui rend un export joignable à un catalogue qui n'est pas celui de Zoro.
gtin
Le numéro d'article commercial international - l'identifiant du code-barres.
rating
La note du produit, si la page en publie une. Aucune échelle n'est indiquée ici ; nous n'avons vu aucune valeur.
reviews
Le nombre d'avis. Un compteur, pas le texte - il n'y a aucun corps d'avis dans cet export.
image
L'image produit que la page déclare.
url
Le lien du produit.
description
La description produit que la page déclare.

Deux choses sur les preuves derrière cette page. D'abord le mécanisme : les produits sont lus dans le JSON-LD qu'une page publie sur elle-même - les données structurées que les marchands intègrent pour les moteurs de recherche. Cela pose un plafond que cette page ne fera pas semblant de dépasser. Chaque colonne après service n'existe que si Zoro déclare ce champ ; un vide signifie donc non publié et non exécution échouée. Ensuite le manque : nous ne l'avons jamais lancé contre Zoro. Nous détenons quarante-cinq exports du pipeline partagé qui alimente ce service et pas un n'est une exécution Zoro - quarante-quatre sont revenus vides et le seul rempli concerne un autre marchand. Cet export vaut un point de donnée honnête sur l'outil plutôt que sur Zoro : query et service étaient remplis sur chaque ligne, parce que le scraper les écrit lui-même - et six des quinze étaient vides sur chaque ligne. Attendez-vous ici aussi à des trous, attendez-vous à ce qu'ils tombent ailleurs parce qu'un autre marchand publie d'autres données structurées, et laissez votre première exécution gratuite vous dire lesquels. C'est aussi pourquoi cette page n'imprime aucune valeur d'exemple ni aucun format : sans exécution Zoro, nous les inventerions.

Réglages de l'exécution

Deux entrées,
et c'est tout le formulaire.

Une liste d'URL et une limite. Pas de tri, pas de filtre, pas de champ proxy - chez ce marchand il n'y a rien d'autre à régler.

https://www.zoro.com/…/i/G8596095/ Une URL de produit, ou de catégorie / recherche Une par ligne Téléversement CSV · XLSX · TXT Limite par requête, ou 0 pour tout Une ligne par produit Aucun proxy résidentiel requis Lu dans le JSON-LD de la page
D'où viennent les champs

La page le déclare,
nous le rapportons.

Ce scraper lit les données structurées qu'une fiche produit publie sur elle-même - le bloc JSON-LD que les enseignes intègrent pour que les moteurs de recherche puissent afficher un prix et un état de stock. C'est pourquoi les colonnes se lisent ainsi : sku, mpn, gtin, brand, availability et currency sont le vocabulaire standard de description d'un produit, et non des noms que nous aurions inventés.

La conséquence pratique est celle qu'il faut anticiper. Une colonne ne vaut que ce que vaut le balisage du marchand. Si un champ manque dans les données structurées de la page, il revient vide, et aucune relance n'y changera rien - ce n'est pas un échec, c'est une absence. Dans le seul export rempli que nous détenons de cet outil partagé, six des quinze colonnes étaient vides sur chaque ligne.

S'il vous faut quelque chose que le balisage ne porte pas, c'est un autre travail - le Scraper Universel IA lit la page elle-même et renvoie les attributs que vous nommez, plutôt que seulement ce qui a été déclaré pour les moteurs de recherche.

livescraper.app · le plafond
Lu dans le JSON-LD de la page
query et service : écrits par nous
Les treize autres : déclarés par la page
Vide = non publié, pas échoué!
Vérifiez les trous lors de votre première exécution
Les données structurées relèvent du choix de l'enseigne, et il varie.
Transmettre la liste

Les téléversements s'ajoutent
et ne dédupliquent pas.

Un fichier importé ne vide pas la zone de saisie - les lignes sont ajoutées à ce que vous aviez déjà tapé, et les doublons ne sont pas supprimés. Importez deux fois le même fichier et ces URL seront bel et bien récupérées deux fois, et facturées deux fois. C'est propre à ce pipeline : certains de nos autres scrapers dédoublonnent à l'import et pas celui-ci, n'y transposez donc pas l'habitude.

Pour un CSV ou un TXT, la ligne entière est prise comme une URL : un tableur avec des colonnes supplémentaires n'est donc pas ce qu'il vous faut ici. Seul un XLSX est lu colonne par colonne, et il y prend la colonne A.

Le sélecteur liste Parquet à côté de CSV, XLSX et TXT, mais il ne sait pas réellement en lire un dans le navigateur et vous le dira - utilisez l'un des trois autres.

livescraper.app · le téléversement
CSV · XLSX · TXT
Les doublons ne sont PAS supprimés!
CSV et TXT : la ligne entière
XLSX : colonne A
Ajouté à ce que vous avez tapé
Vérifiez le champ avant de lancer - une liste doublée est une facture doublée.
Usages courants

Trois travaux que l'on
lance le plus souvent ici.

Quelques exemples de ce que vaut un catalogue fournisseur une fois qu'il est un tableau.

Assortiment

Voir une catégorie comme une liste plutôt qu'une grille

Donnez-lui une page de catégorie et vous obtenez chaque produit qui s'y trouve en ligne, avec la marque et les colonnes d'identifiant à côté du nom. Trier une page de navigation autrement que selon ce que le site propose, c'est tout l'intérêt.

Merchandising · Recherche
Comparaison

Aligner un fournisseur sur les autres que vous suivez

Comme service est estampillé sur chaque ligne, un même tableau peut contenir Zoro à côté des autres marchands de ce pipeline et se redécouper proprement. Là où mpn ou gtin sont déclarés, le même article se rapproche d'un fournisseur à l'autre.

Sourcing · Achats
Suivi

Relancer une catégorie et comparer

La même URL de catégorie de façon planifiée vous donne deux fichiers comparables. Ce qui est apparu, ce qui a disparu et ce qui a changé est un diff plutôt qu'un après-midi de clics - et sku est la clé sur laquelle comparer, là où elle est publiée.

Analyse · Reporting
Tarifs

Ne payez que les produits
que vous tirez réellement.

Pas d'abonnement, pas de minimum, pas de facture récurrente. Vos 500 premières lignes sont offertes - ensuite, paiement à l'usage, au même tarif forfaitaire que tous les autres scrapers d'ici.

Offre gratuite

500 lignes gratuites - 0 $

Sur chaque nouveau compte, une seule fois. Aucune carte bancaire requise. Limites par requête, import de fichier et tous les formats d'export inclus - et chez ce marchand, pas de proxy à payer non plus.

0 $ pour toujours
Paiement à l'usage

0,002 $ par ligne, après l'offre gratuite

Le même tarif forfaitaire que tous les autres scrapers de la plateforme. L'estimateur affiche le nombre de lignes et le coût en crédits avant le démarrage - un coup d'œil s'impose ici, car la limite est par requête et une liste d'URL de catégorie multiplie.

Le plus populaire
Volume

Sur mesure · gros volumes

Tarifs au volume, workers dédiés et un SLA pour suivre un catalogue de façon planifiée. Dites-nous vos volumes et nous chiffrons.

Parlons-en
10 % de remise sur votre première exécution payante.Utilisez le code LIVESCRAPER10 au paiement.
S'inscrire
S'associe bien avec

Le même pipeline,
et le moyen d'aller au-delà.

Deux homologues sur le même outil partagé, et un pour quand les données structurées ne portent pas ce dont vous avez besoin.

Le volet juridique

Est-il légal de scraper
Zoro ?

Réponse courte : ce sont des données de catalogue publiques sans aucune donnée personnelle dedans - et les données structurées sont publiées, au départ, pour être lues par des machines.

Tout ce qui figure dans ces quinze colonnes est montré à n'importe quel visiteur sur une fiche produit publique de Zoro, connecté ou non. Aucun identifiant n'est utilisé, aucun paywall n'est franchi et aucun compte n'est touché, et l'exécution passe par notre pool de proxys plutôt que par votre propre IP. Ce qui est lu précisément, c'est le bloc JSON-LD - des données structurées qu'un marchand intègre justement pour que des lecteurs automatisés puissent relever le nom, le prix et la disponibilité.

Aucune personne n'est nommée dans cet export. Il n'y a ni colonne client, ni auteur d'avis, ni vendeur - reviews est un décompte et non le texte des avis, si bien qu'aucun corps d'avis ne revient. Ce sont des produits et des prix, ce qui le place au bout le plus léger de l'échelle en matière de protection des données.

Les conditions de Zoro régissent la collecte automatisée depuis leur site : lisez-les avant de passer à l'échelle plutôt que de vous fier au fait que les pages sont publiques. Et si vous republiez des descriptions de produit ou des images, souvenez-vous que ce sont les mots et la photographie de quelqu'un d'autre - les collecter pour analyse est une question, les publier en est une autre. Nous n'utilisons aucun traceur tiers sur la couche de données, et vos exports s'auto-suppriment au bout de 30 jours.

livescraper.app · principes
Uniquement des pages produit publiques
Aucune connexion, aucun compte touché
Données structurées, publiées pour les machines
Des produits et des prix - personne n'est nommé
Les exports s'effacent (30 jours)
Vérifiez les conditions de Zoro avant de passer à l'échelle.
Questions fréquentes

Ce que l'on demande
avant de s'inscrire.

Les questions que l'on nous pose le plus. Autre chose ? Parlez-nous - les réponses sont écrites par des humains, pas par des bots.

Comment scraper les produits Zoro ?+
Avec le Scraper de Produits Zoro : connectez-vous à la plateforme, ouvrez le Scraper de Produits Zoro, collez des URL de produit Zoro ou des URL de catégorie et de recherche une par ligne (ou téléversez un fichier CSV, XLSX ou TXT), fixez une limite par requête ou mettez-la à zéro pour tout prendre, puis cliquez sur Get Data et téléchargez le résultat en CSV, XLSX ou JSON.
Ai-je besoin d'un proxy résidentiel pour celui-ci ?+
Non. L'exécution passe par notre pool partagé et vous n'avez rien à configurer. Cela vaut la peine d'être dit car ce n'est pas vrai de tous les marchands de ce pipeline - l'outil désigne Lowes, Grainger, Zalando et Fastenal comme exigeant une sortie résidentielle à vous. Zoro n'en fait pas partie.
Que puis-je coller en entrée ?+
Une URL de produit Zoro, ou une URL de catégorie ou de recherche - les deux fonctionnent, une par ligne. L'exemple propre à la plateforme pour ce service est une fiche produit. Une URL de catégorie renvoie les produits qui s'y trouvent, une ligne chacun, jusqu'à la limite que vous fixez.
Quelles colonnes vais-je obtenir ?+
Quinze, dans cet ordre : query, service, name, price, currency, availability, brand, sku, mpn, gtin, rating, reviews, image, url et description. Ces noms sont confirmés deux fois - par le tableau de colonnes publié pour ce service et par la ligne d'en-tête de chaque classeur que nous détenons du pipeline partagé qui l'alimente. Le JSON ajoute un seizième champ, position ; le CSV et le XLSX s'arrêtent à quinze.
Pourquoi cette page n'affiche-t-elle pas de valeurs d'exemple ?+
Parce que nous ne l'avons jamais lancé contre Zoro, et que nous préférons le dire plutôt que de les inventer. Sur les quarante-cinq exports que nous détenons du pipeline partagé qui alimente ce service, pas un n'est une exécution Zoro : quarante-quatre sont revenus avec un en-tête et aucune ligne, et le seul rempli concerne un autre marchand. Les noms de colonnes sont solides ; les contenus des cellules ne sont pas quelque chose que nous puissions honnêtement décrire pour l'instant.
Pourquoi une colonne peut-elle revenir vide ?+
Parce que la page n'a jamais déclaré ce champ. Les produits sont lus dans le JSON-LD qu'une page publie sur elle-même : chaque colonne après service n'existe donc que si le marchand l'a mise dans ses données structurées - un vide signifie non publié et non exécution échouée, et relancer n'y changera rien. Dans le seul export rempli que nous détenons de cet outil partagé, six des quinze colonnes étaient vides sur chaque ligne.
Importer un fichier remplace-t-il ce que j'ai tapé ?+
Non - cela s'y ajoute, et les doublons ne sont pas supprimés. Importez deux fois le même fichier et ces URL seront récupérées deux fois et facturées deux fois : vérifiez donc la zone de saisie avant de lancer. Pour un CSV ou un TXT, la ligne entière est prise comme une URL ; seul le XLSX est lu colonne par colonne, et il y prend la colonne A. Parquet figure dans le sélecteur mais ne peut pas être lu dans le navigateur.
Combien ça coûte ?+
Les 500 premières lignes sont gratuites et offertes une seule fois, sans carte bancaire. Ensuite, c'est 0,002 $ par ligne - le même tarif forfaitaire que tous les autres scrapers de la plateforme. L'estimateur affiche le coût d'une exécution avant qu'elle ne démarre, ce qui mérite un coup d'œil ici car la limite est par requête et une liste d'URL de catégorie multiplie.

Transformez une page de catégorie
en un tableau que l'on peut trier.

Vos 500 premières lignes sont gratuites - pas de carte, pas d'abonnement. Ensuite, c'est 0,002 $ par ligne, tarif unique.

Actif immédiatement · sans carte bancaire

Scraper les fiches produit Zoro en lignes

Le Scraper de Produits Zoro transforme les fiches produit et les pages de catégorie de zoro.com en lignes. Collez une URL de produit, ou une URL de catégorie ou de recherche, une par ligne - ou téléversez un fichier CSV, XLSX ou TXT -, fixez une limite par requête, et chaque produit revient sous forme d'enregistrement avec la requête dont il provient, le service qui l'a produit, le nom, le prix et la devise, la disponibilité, la marque, sku, mpn et gtin, une note et un nombre d'avis, une image, un lien et une description. Quinze colonnes dans le fichier et seize dans le JSON, une ligne par produit. Contrairement à certains marchands de ce pipeline partagé - l'outil désigne Lowes, Grainger, Zalando et Fastenal - Zoro n'exige aucun proxy résidentiel à vous, il n'y a donc rien à configurer au-delà de la liste et de la limite.

Deux choses méritent d'être comprises avant de bâtir sur cet export, et toutes deux tiennent à l'origine des données. Les produits sont lus dans le JSON-LD qu'une page publie sur elle-même - les données structurées que les marchands intègrent pour que les moteurs de recherche puissent afficher un prix et un état de stock. C'est pourquoi les colonnes portent les noms qu'elles portent : sku, mpn, gtin, brand, availability et currency sont le vocabulaire standard pour décrire un produit. Cela pose aussi un plafond : chaque colonne après service n'existe que si le marchand a déclaré ce champ, si bien qu'une cellule vide signifie non publié plutôt qu'exécution échouée, et relancer ne la remplira pas.

La seconde, c'est que cette page n'imprime pas de valeurs d'exemple, parce que nous ne l'avons jamais lancée contre Zoro. Sur les quarante-cinq exports que nous détenons du pipeline partagé qui alimente ce service, pas un n'est une exécution Zoro - quarante-quatre ont renvoyé un en-tête et aucune ligne, et le seul rempli concerne un autre marchand. Cet export vaut exactement une observation honnête, et elle porte sur l'outil et non sur Zoro : query et service étaient remplis sur chaque ligne parce que le scraper les écrit lui-même, et six des quinze colonnes étaient vides sur chaque ligne. Attendez-vous à des trous ici aussi, attendez-vous à ce qu'ils tombent ailleurs parce qu'un autre marchand publie d'autres données structurées, et laissez une petite exécution gratuite vous dire lesquels - c'est une question que 500 lignes gratuites tranchent définitivement.

Sur le plan juridique, c'est l'un des exports les plus légers de notre catalogue. Tout ce qui est collecté est montré à n'importe quel visiteur sur une fiche produit publique, aucun identifiant ni paywall n'entre en jeu, et aucune personne n'est nommée nulle part dans les quinze colonnes - reviews est un compteur et non du texte d'avis, donc pas même un corps d'avis ne revient. Ce sont des produits et des prix. Les conditions de Zoro régissent toujours la collecte automatisée depuis leur site, lisez-les donc avant de passer à l'échelle, et souvenez-vous que les descriptions de produit et les images sont les mots et la photographie de quelqu'un d'autre si vous comptez les republier. Commencez gratuitement : vos 500 premières lignes ne coûtent rien et ne demandent pas de carte, et ensuite c'est 0,002 $ par ligne, forfaitaire.