Scraper de produits Quill

Les pages produit de Quill,
en quinze colonnes.

Collez une URL de produit Quill, ou une page de catégorie comme quill.com/office-supplies/cbu/2.html, et les produits reviennent en lignes - nom, prix et devise, disponibilité, marque, les colonnes d'identifiant, note et nombre d'avis, une image, un lien et une description.

500 lignes gratuites, une seule fois0,002 $ par ligne ensuite15 colonnesCSV · XLSX · JSON
Comment ça marche

Cinq étapes,
et aucune configuration.

Une entrée et un réglage. Ici, aucun proxy à configurer : tout le job tient dans une liste de liens et un nombre.

  1. ÉTAPE 1Connectez-vous à la plateforme.
  2. ÉTAPE 2Ouvrez le Scraper de produits Quill.
  3. ÉTAPE 3Collez des URL de produit Quill ou des URL de catégorie et de recherche, une par ligne - ou importez un fichier CSV, XLSX ou TXT.
  4. ÉTAPE 4Fixez une limite par requête, ou mettez-la à zéro pour tout prendre, puis cliquez sur Get Data.
  5. ÉTAPE 5Téléchargez le résultat en CSV, XLSX ou JSON.

La limite est par requête : cinq URL de catégorie avec une limite de deux cents donnent deux cents produits pour chacune - pas deux cents en tout.

Pourquoi les équipes l'utilisent

Un catalogue que l'on peut trier,
pas une grille que l'on fait défiler.

Une URL de catégorie est un travail complet

Vous n'avez pas à rassembler les liens produit d'abord. Donnez-lui une page de catégorie et il parcourt les produits qui s'y trouvent, une ligne chacun - c'est ainsi qu'une page de navigation devient quelque chose que l'on peut trier par prix ou regrouper par marque.

Aucun proxy nécessaire

Certains marchands de ce pipeline partagé ont besoin d'une sortie résidentielle à vous - l'outil nomme Lowes, Grainger, Zalando et Fastenal. Quill n'en fait pas partie. L'exécution passe par notre pool, et il n'y a rien à configurer de votre côté.

Les colonnes d'identifiant, gardées à part

sku, mpn et gtin arrivent en colonnes propres plutôt qu'enfouis dans un titre, et currency se tient à côté de price au lieu d'être dedans. C'est ce qui rend un export joignable à un catalogue qui n'est pas celui de Quill - là où la page déclare ces champs, bien sûr.

Ce que cette page peut et ne peut pas vous dire

Les noms sont confirmés.
Les contenus non.

Cela mérite d'être dit franchement, car cela change la façon dont il faut lire le dictionnaire ci-dessous.

Les quinze noms de colonnes sont solides : ils sont confirmés deux fois, par le tableau de colonnes publié pour ce service et par la ligne d'en-tête de chaque classeur que nous détenons du pipeline partagé qui l'alimente - identique sur celui qui est rempli comme sur les vides. Bâtissez un schéma autour de ces noms en confiance.

Ce que nous ne pouvons pas faire, c'est vous dire ce que Quill y met, parce que nous n'avons jamais lancé ceci contre Quill. Aucun des exports que nous détenons n'est une exécution Quill. Presque tous sont revenus avec un en-tête et aucune ligne, et le seul rempli concerne un tout autre marchand. Plutôt que de l'enjoliver, cette page n'imprime ni valeurs d'exemple ni formats - sans exécution Quill, nous les inventerions.

La bonne nouvelle, c'est le peu que cela coûte à trancher. Lesquelles des treize colonnes déclarées Quill publie réellement est une question qu'une seule petite exécution règle une fois pour toutes, et les 500 premières lignes ne coûtent rien - pointez-la donc sur une seule catégorie, regardez ce qui est revenu, et vous en saurez plus sur cet export que ce qu'une page pourrait honnêtement vous dire à l'avance.

Dictionnaire de données

Quinze colonnes,
et un plafond assumé.

Les noms sont exacts et doublement confirmés. Les descriptions disent à quoi sert chaque colonne - pas ce qu'elle contiendra, car c'est la décision de l'enseigne et non la nôtre, et la note ci-dessous explique pourquoi.

query
L'URL que vous avez soumise pour cette ligne - la page produit, catégorie ou recherche d'où elle provient. Écrite par le scraper, elle est donc présente sur chaque ligne.
service
De quelle enseigne provient cette ligne. Ce scraper partage un pipeline avec plusieurs autres services produits, et celui que vous avez choisi est estampillé sur chaque ligne - pratique si vous conservez plusieurs enseignes dans la même table.
name
Le nom du produit tel que la page le déclare.
price
Le prix que la page déclare.
currency
La devise de ce prix, en colonne séparée - vous n'avez donc pas à extraire un symbole du champ prix.
availability
L'état de stock que la page déclare.
brand
La marque que la page déclare.
sku
Le code article propre à l'enseigne.
mpn
La référence fabricant. Avec gtin, c'est elle qui rend un export joignable à un catalogue qui n'est pas celui de Quill.
gtin
Le numéro d'article commercial international - l'identifiant du code-barres.
rating
La note du produit, si la page en publie une. Aucune échelle n'est indiquée ici ; nous n'avons vu aucune valeur.
reviews
Le nombre d'avis. Un compteur, pas le texte - il n'y a aucun corps d'avis dans cet export.
image
L'image produit que la page déclare.
url
Le lien du produit.
description
La description produit que la page déclare.

Deux choses sur les preuves derrière cette page. D'abord le mécanisme : les produits sont lus dans le JSON-LD qu'une page publie sur elle-même - les données structurées que les marchands intègrent pour les moteurs de recherche. Cela pose un plafond que cette page ne fera pas semblant de dépasser. Chaque colonne après service n'existe que si Quill déclare ce champ ; un vide signifie donc non publié, pas exécution échouée. Ensuite, la lacune : nous n'avons jamais lancé ceci contre Quill. Nous détenons quarante-cinq exports du pipeline partagé qui alimente ce service et pas un n'est une exécution Quill - quarante-quatre sont revenus vides et le seul rempli concerne un autre marchand. Cet export vaut un point de donnée honnête sur l'outil plutôt que sur Quill : query et service étaient remplis sur chaque ligne, parce que le scraper les écrit lui-même - et six des quinze étaient vides sur chacune des lignes. Attendez-vous à des trous ici aussi, attendez-vous à ce qu'ils tombent ailleurs parce qu'un autre marchand publie d'autres données structurées, et laissez votre première exécution gratuite vous dire lesquels. C'est aussi pourquoi cette page n'imprime ni valeurs d'exemple ni formats : sans exécution Quill, nous les inventerions.

Contrôles de l'exécution

Deux entrées,
et c'est tout le formulaire.

Une liste d'URL et une limite. Pas de tri, pas de filtre, pas de champ proxy - chez ce marchand il n'y a rien d'autre à régler.

https://www.quill.com/office-supplies/cbu/2.html Une URL de produit, ou de catégorie / recherche Une par ligne Import CSV · XLSX · TXT Limite par requête, ou 0 pour tout Une ligne par produit Aucun proxy résidentiel nécessaire Lu dans le JSON-LD de la page
D'où viennent les champs

La page le déclare,
nous le rapportons.

Ce scraper lit les données structurées qu'une fiche produit publie sur elle-même - le bloc JSON-LD que les enseignes intègrent pour que les moteurs de recherche puissent afficher un prix et un état de stock. C'est pourquoi les colonnes se lisent ainsi : sku, mpn, gtin, brand, availability et currency sont le vocabulaire standard de description d'un produit, et non des noms que nous aurions inventés.

La conséquence pratique est celle qu'il faut anticiper. Une colonne ne vaut que ce que vaut le balisage du marchand. Si un champ manque dans les données structurées de la page, il revient vide, et aucune relance n'y changera rien - ce n'est pas un échec, c'est une absence. Dans le seul export rempli que nous détenons de cet outil partagé, six des quinze colonnes étaient vides sur chaque ligne.

S'il vous faut quelque chose que le balisage ne porte pas, c'est un autre travail - le Scraper Universel IA lit la page elle-même et renvoie les attributs que vous nommez, plutôt que seulement ce qui a été déclaré pour les moteurs de recherche.

livescraper.app · le plafond
Lu dans le JSON-LD de la page
query et service : écrits par nous
Les treize autres : déclarés par la page
Vide = non publié, pas échoué!
Vérifiez les trous lors de votre première exécution
Les données structurées relèvent du choix de l'enseigne, et il varie.
Transmettre la liste

Les téléversements s'ajoutent
et ne dédupliquent pas.

Un fichier importé ne vide pas la zone de saisie - les lignes sont ajoutées à ce que vous aviez déjà tapé, et les doublons ne sont pas supprimés. Importez deux fois le même fichier et ces URL seront bel et bien récupérées deux fois, et facturées deux fois. C'est propre à ce pipeline : certains de nos autres scrapers dédoublonnent à l'import et pas celui-ci, n'y transposez donc pas l'habitude.

Pour un CSV ou un TXT, la ligne entière est prise comme une URL : un tableur avec des colonnes supplémentaires n'est donc pas ce qu'il vous faut ici. Seul un XLSX est lu colonne par colonne, et il y prend la colonne A.

Le sélecteur liste Parquet à côté de CSV, XLSX et TXT, mais il ne sait pas réellement en lire un dans le navigateur et vous le dira - utilisez l'un des trois autres.

livescraper.app · le téléversement
CSV · XLSX · TXT
Les doublons ne sont PAS supprimés!
CSV et TXT : la ligne entière
XLSX : colonne A
Ajouté à ce que vous avez tapé
Vérifiez le champ avant de lancer - une liste doublée est une facture doublée.
Usages courants

Trois travaux que l'on
lance le plus souvent ici.

Quelques exemples de ce que vaut un catalogue fournisseur une fois qu'il est un tableau.

Assortiment

Voir une catégorie comme une liste plutôt qu'une grille

Donnez-lui une page de catégorie et vous obtenez chaque produit qui s'y trouve en ligne, avec la marque et les colonnes d'identifiant à côté du nom. Trier une page de navigation autrement que selon ce que le site propose, c'est tout l'intérêt.

Merchandising · Recherche
Comparaison

Aligner un fournisseur sur les autres que vous suivez

Comme service est estampillé sur chaque ligne, un même tableau peut contenir Quill à côté des autres marchands de ce pipeline et se redécouper proprement. Là où mpn ou gtin sont déclarés, le même article se rapproche d'un fournisseur à l'autre.

Sourcing · Achats
Suivi

Relancer une catégorie et comparer

La même URL de catégorie de façon planifiée vous donne deux fichiers comparables. Ce qui est apparu, ce qui a disparu et ce qui a changé est un diff plutôt qu'un après-midi de clics - et sku est la clé sur laquelle comparer, là où elle est publiée.

Analyse · Reporting
Tarifs

Ne payez que les produits
que vous tirez réellement.

Pas d'abonnement, pas de minimum, pas de facture récurrente. Vos 500 premières lignes sont offertes - ensuite, paiement à l'usage, au même tarif forfaitaire que tous les autres scrapers d'ici.

Offre gratuite

500 lignes gratuites - 0 $

Sur chaque nouveau compte, une seule fois. Aucune carte bancaire requise. Limites par requête, import de fichier et tous les formats d'export inclus - et chez ce marchand, pas de proxy à payer non plus.

0 $ pour toujours
Paiement à l'usage

0,002 $ par ligne, après l'offre gratuite

Le même tarif forfaitaire que tous les autres scrapers de la plateforme. L'estimateur affiche le nombre de lignes et le coût en crédits avant le démarrage - un coup d'œil s'impose ici, car la limite est par requête et une liste d'URL de catégorie multiplie.

Le plus populaire
Volume

Sur mesure · gros volumes

Tarifs au volume, workers dédiés et un SLA pour suivre un catalogue de façon planifiée. Dites-nous vos volumes et nous chiffrons.

Parlons-en
10 % de remise sur votre première exécution payante.Utilisez le code LIVESCRAPER10 au paiement.
S'inscrire
S'associe bien avec

Le même pipeline,
et le moyen d'aller au-delà.

Deux frères qui se comportent à l'identique chez d'autres marchands, et un outil pour quand les données structurées ne portent pas ce qu'il vous faut.

Le volet juridique

Est-il légal de scraper
Quill ?

Réponse courte : ce sont des données de catalogue publiques sans aucune donnée personnelle dedans - et les données structurées sont publiées, au départ, pour être lues par des machines.

Tout ce qui figure dans ces quinze colonnes est affiché sur une page produit Quill publique, à tout visiteur, connecté ou non. Aucune connexion n'est utilisée, aucun paywall n'est franchi, aucun compte n'est touché, et l'exécution passe par notre pool de proxys plutôt que par votre propre IP. Ce qui est lu précisément, c'est le bloc JSON-LD - des données structurées qu'un marchand intègre justement pour que des lecteurs automatiques récupèrent le nom, le prix et la disponibilité.

Aucune personne n'est nommée dans cet export. Il n'y a ni colonne client, ni auteur d'avis, ni vendeur - reviews est un décompte et non le texte des avis, si bien qu'aucun corps d'avis ne revient. Ce sont des produits et des prix, ce qui le place au bout le plus léger de l'échelle en matière de protection des données.

Les conditions propres à Quill régissent la collecte automatisée depuis leur site : lisez-les avant de monter en charge plutôt que de vous fier au caractère public des pages. Et si vous republiez des descriptions produit ou des images, rappelez-vous que ce sont le texte et les photographies de quelqu'un d'autre - les collecter pour analyse est une question, les publier en est une autre. Nous n'exécutons aucun traceur tiers sur la couche de données, et vos exports s'effacent d'eux-mêmes au bout de 30 jours.

livescraper.app · principes
Uniquement des pages produit publiques
Aucune connexion, aucun compte touché
Données structurées, publiées pour les machines
Des produits et des prix - personne n'est nommé
Les exports s'effacent (30 jours)
Vérifiez les conditions de Quill avant de monter en charge.
Questions fréquentes

Ce que l'on demande
avant de s'inscrire.

Les questions que l'on nous pose le plus. Autre chose ? Parlez-nous - les réponses sont écrites par des humains, pas par des bots.

Comment scraper les produits Quill ?+
Avec le Scraper de produits Quill : connectez-vous à la plateforme, ouvrez le Scraper de produits Quill, collez des URL de produit Quill ou des URL de catégorie et de recherche une par ligne (ou importez un fichier CSV, XLSX ou TXT), fixez une limite par requête ou mettez-la à zéro pour tout prendre, puis cliquez sur Get Data et téléchargez le résultat en CSV, XLSX ou JSON.
Ai-je besoin d'un proxy résidentiel pour celui-ci ?+
Non. L'exécution passe par notre pool partagé et il n'y a rien à configurer de votre côté. Cela mérite d'être dit car ce n'est pas vrai de tous les marchands de ce pipeline - l'outil nomme Lowes, Grainger, Zalando et Fastenal comme nécessitant une sortie résidentielle à vous. Quill n'en fait pas partie.
Que puis-je coller en entrée ?+
Une URL de produit Quill, ou une URL de catégorie ou de recherche - les deux fonctionnent, une par ligne. L'exemple propre à la plateforme pour ce service est une page de catégorie de fournitures de bureau, https://www.quill.com/office-supplies/cbu/2.html. Une URL de catégorie renvoie les produits qui s'y trouvent, une ligne chacun, jusqu'à la limite que vous fixez.
Quelles colonnes vais-je obtenir ?+
Quinze, dans cet ordre : query, service, name, price, currency, availability, brand, sku, mpn, gtin, rating, reviews, image, url et description. Ces noms sont confirmés deux fois - par le tableau de colonnes publié pour ce service et par la ligne d'en-tête de chaque classeur que nous détenons du pipeline partagé qui l'alimente. Le JSON ajoute un seizième champ, position ; le CSV et le XLSX s'arrêtent à quinze.
Pourquoi cette page n'affiche-t-elle pas de valeurs d'exemple ?+
Parce que nous n'avons jamais lancé ceci contre Quill, et que nous préférons le dire plutôt que les inventer. Sur les quarante-cinq exports que nous détenons du pipeline partagé qui alimente ce service, pas un n'est une exécution Quill : quarante-quatre sont revenus avec un en-tête et aucune ligne, et le seul rempli concerne un autre marchand. Les noms de colonnes sont solides ; le contenu des cellules n'est pas quelque chose que nous puissions décrire honnêtement pour l'instant.
Pourquoi une colonne peut-elle revenir vide ?+
Parce que la page n'a jamais déclaré ce champ. Les produits sont lus dans le JSON-LD qu'une page publie sur elle-même : chaque colonne après service n'existe donc que si le marchand l'a mise dans ses données structurées - un vide signifie non publié et non exécution échouée, et relancer n'y changera rien. Dans le seul export rempli que nous détenons de cet outil partagé, six des quinze colonnes étaient vides sur chaque ligne.
Et si une exécution ne renvoie aucun produit ?+
L'outil vous dit quoi vérifier. Son propre message nomme deux causes habituelles - un marchand qui bloque les IP de centre de données, ou un qui rend ses produits côté client au lieu de les déclarer dans la page - et rappelle que l'entrée doit être une URL de produit, de catégorie ou de recherche. Ce message est partagé par tous les marchands de ce pipeline, il mentionne donc des proxys résidentiels même là où, comme ici, aucun ne vous est demandé. Si une URL précise ne renvoie rien, essayez la page de catégorie au-dessus avant de conclure que l'exécution a échoué.
Importer un fichier remplace-t-il ce que j'ai tapé ?+
Non - cela s'y ajoute, et les doublons ne sont pas supprimés. Importez deux fois le même fichier et ces URL seront récupérées deux fois et facturées deux fois : vérifiez donc la zone de saisie avant de lancer. Pour un CSV ou un TXT, la ligne entière est prise comme une URL ; seul le XLSX est lu colonne par colonne, et il y prend la colonne A. Parquet figure dans le sélecteur mais ne peut pas être lu dans le navigateur.
Combien ça coûte ?+
Les 500 premières lignes sont gratuites et offertes une seule fois, sans carte bancaire. Ensuite, c'est 0,002 $ par ligne - le même tarif forfaitaire que tous les autres scrapers de la plateforme. L'estimateur affiche le coût d'une exécution avant qu'elle ne démarre, ce qui mérite un coup d'œil ici car la limite est par requête et une liste d'URL de catégorie multiplie.

Transformez une page de catégorie
en un tableau que l'on peut trier.

Vos 500 premières lignes sont gratuites - pas de carte, pas d'abonnement. Ensuite, c'est 0,002 $ par ligne, tarif unique.

Actif immédiatement · sans carte bancaire

Extraire les pages produit de Quill en lignes

Le Scraper de produits Quill transforme les pages produit et catégorie de quill.com en lignes. Collez une URL de produit, ou une page de catégorie telle que quill.com/office-supplies/cbu/2.html, une par ligne - ou importez un fichier CSV, XLSX ou TXT -, fixez une limite par requête, et chaque produit revient sous forme d'enregistrement avec la requête dont il provient, le service qui l'a produit, le nom, le prix et la devise, la disponibilité, la marque, sku, mpn et gtin, une note et un nombre d'avis, une image, un lien et une description. Quinze colonnes dans le fichier et seize dans le JSON, une ligne par produit. Contrairement à certains marchands de ce pipeline partagé - l'outil nomme Lowes, Grainger, Zalando et Fastenal -, Quill ne nécessite aucun proxy résidentiel à vous, il n'y a donc rien à configurer au-delà de la liste et de la limite.

Deux choses méritent d'être comprises avant de bâtir sur cet export, et toutes deux tiennent à l'origine des données. Les produits sont lus dans le JSON-LD qu'une page publie sur elle-même - les données structurées que les marchands intègrent pour que les moteurs de recherche puissent afficher un prix et un état de stock. C'est pourquoi les colonnes portent les noms qu'elles portent : sku, mpn, gtin, brand, availability et currency sont le vocabulaire standard pour décrire un produit. Cela pose aussi un plafond : chaque colonne après service n'existe que si le marchand a déclaré ce champ, si bien qu'une cellule vide signifie non publié plutôt qu'exécution échouée, et relancer ne la remplira pas.

La seconde, c'est que cette page n'imprime pas de valeurs d'exemple, parce que nous ne l'avons jamais lancée contre Quill. Sur les quarante-cinq exports que nous détenons du pipeline partagé qui alimente ce service, pas un n'est une exécution Quill - quarante-quatre ont renvoyé un en-tête et aucune ligne, et le seul rempli concerne un autre marchand. Cet export vaut exactement une observation honnête, et elle porte sur l'outil et non sur Quill : query et service étaient remplis sur chaque ligne parce que le scraper les écrit lui-même, et six des quinze colonnes étaient vides sur chaque ligne. Attendez-vous à des trous ici aussi, attendez-vous à ce qu'ils tombent ailleurs parce qu'un autre marchand publie d'autres données structurées, et laissez une petite exécution gratuite vous dire lesquels - c'est une question que 500 lignes gratuites tranchent définitivement.

Côté juridique, celui-ci compte parmi les exports les plus légers de notre catalogue. Tout ce qui est collecté est affiché sur une page produit publique à tout visiteur, aucune connexion ni paywall n'est en jeu, et aucune personne n'est nommée dans les quinze colonnes - reviews est un décompte plutôt que le texte des avis, si bien qu'aucun corps d'avis ne revient. Ce sont des produits et des prix. Les conditions propres à Quill régissent toujours la collecte automatisée depuis leur site : lisez-les avant de monter en charge, et rappelez-vous que les descriptions produit et les images sont le texte et les photographies de quelqu'un d'autre si vous comptez les republier. Commencez gratuitement : vos 500 premières lignes ne coûtent rien et ne demandent aucune carte bancaire, ensuite c'est 0,002 $ par ligne, tarif unique.