Scraper les fiches produit Zoro en lignes
Le Scraper de Produits Zoro transforme les fiches produit et les pages de catégorie de zoro.com en lignes. Collez une URL de produit, ou une URL de catégorie ou de recherche, une par ligne - ou téléversez un fichier CSV, XLSX ou TXT -, fixez une limite par requête, et chaque produit revient sous forme d'enregistrement avec la requête dont il provient, le service qui l'a produit, le nom, le prix et la devise, la disponibilité, la marque, sku, mpn et gtin, une note et un nombre d'avis, une image, un lien et une description. Quinze colonnes dans le fichier et seize dans le JSON, une ligne par produit. Contrairement à certains marchands de ce pipeline partagé - l'outil désigne Lowes, Grainger, Zalando et Fastenal - Zoro n'exige aucun proxy résidentiel à vous, il n'y a donc rien à configurer au-delà de la liste et de la limite.
Deux choses méritent d'être comprises avant de bâtir sur cet export, et toutes deux tiennent à l'origine des données. Les produits sont lus dans le JSON-LD qu'une page publie sur elle-même - les données structurées que les marchands intègrent pour que les moteurs de recherche puissent afficher un prix et un état de stock. C'est pourquoi les colonnes portent les noms qu'elles portent : sku, mpn, gtin, brand, availability et currency sont le vocabulaire standard pour décrire un produit. Cela pose aussi un plafond : chaque colonne après service n'existe que si le marchand a déclaré ce champ, si bien qu'une cellule vide signifie non publié plutôt qu'exécution échouée, et relancer ne la remplira pas.
La seconde, c'est que cette page n'imprime pas de valeurs d'exemple, parce que nous ne l'avons jamais lancée contre Zoro. Sur les quarante-cinq exports que nous détenons du pipeline partagé qui alimente ce service, pas un n'est une exécution Zoro - quarante-quatre ont renvoyé un en-tête et aucune ligne, et le seul rempli concerne un autre marchand. Cet export vaut exactement une observation honnête, et elle porte sur l'outil et non sur Zoro : query et service étaient remplis sur chaque ligne parce que le scraper les écrit lui-même, et six des quinze colonnes étaient vides sur chaque ligne. Attendez-vous à des trous ici aussi, attendez-vous à ce qu'ils tombent ailleurs parce qu'un autre marchand publie d'autres données structurées, et laissez une petite exécution gratuite vous dire lesquels - c'est une question que 500 lignes gratuites tranchent définitivement.
Sur le plan juridique, c'est l'un des exports les plus légers de notre catalogue. Tout ce qui est collecté est montré à n'importe quel visiteur sur une fiche produit publique, aucun identifiant ni paywall n'entre en jeu, et aucune personne n'est nommée nulle part dans les quinze colonnes - reviews est un compteur et non du texte d'avis, donc pas même un corps d'avis ne revient. Ce sont des produits et des prix. Les conditions de Zoro régissent toujours la collecte automatisée depuis leur site, lisez-les donc avant de passer à l'échelle, et souvenez-vous que les descriptions de produit et les images sont les mots et la photographie de quelqu'un d'autre si vous comptez les republier. Commencez gratuitement : vos 500 premières lignes ne coûtent rien et ne demandent pas de carte, et ensuite c'est 0,002 $ par ligne, forfaitaire.