Extracteur de produits BiggestBook

Un catalogue de bureau qui
s'affiche en JavaScript.

BiggestBook est le catalogue en ligne d'Essendant destiné à ses clients revendeurs - fournitures de bureau, mobilier, technologie, salle de pause et entretien. Demandez-le avec un client HTTP ordinaire et vous obtenez une coquille applicative de 6,9 Ko sans un seul produit à l'intérieur. Ce service charge la page comme le ferait un navigateur et renvoie dix-sept colonnes par produit.

500 lignes gratuites, une seule foispuis 0,002 $ par lignedix-sept colonnes par produitCSV · JSON · Excel
Comment ça marche

Une liste d'URL entre, un tableur sort.

  1. ÉTAPE 1Connectez-vous à la plateforme.
  2. ÉTAPE 2Ouvrez le BiggestBook Products Scraper.
  3. ÉTAPE 3Collez les URL produit BiggestBook voulues, une par ligne.
  4. ÉTAPE 4Choisissez votre format de sortie (CSV / JSON / XLSX).
  5. ÉTAPE 5Lancez la tâche.
  6. ÉTAPE 6Téléchargez les résultats - une ligne par URL, dix-sept colonnes.
Pourquoi ce catalogue est délicat

Ce qui le rend difficile à lire.

La page est une application, pas un document

Demandez https://www.biggestbook.com avec curl et vous obtenez un HTTP 200 et environ 6,9 Ko : une coquille Angular avec <base href="/ui">, le titre « Biggestbook Web » et pas une seule occurrence d'un prix, d'un SKU ou d'un bouton d'ajout au panier. Le catalogue arrive ensuite, depuis JavaScript. Tout ce qui repose sur une bibliothèque HTTP et un analyseur HTML lit cette coquille et en conclut que la page est vide.

Dix-sept colonnes, dont certaines par paires

L'export contient price et parsed_price, sku et sku_code, image et images, url et product_url. Ce n'est pas de la redondance gratuite : dans chaque paire, l'une sert à lire et l'autre à calculer, et savoir laquelle est laquelle avant d'écrire l'importateur évite une réécriture.

Un catalogue de distributeur, pas une boutique

BiggestBook existe pour servir des revendeurs et non des acheteurs particuliers : les champs qui comptent sont donc ceux dont un système d'achat a besoin - identifiant, marque, disponibilité, devise - et non ceux sur lesquels s'appuie une page marketing. Le schéma le reflète : deux colonnes d'identifiant, et une note et un nombre d'avis présents mais jamais tenus pour acquis.

La même forme que le reste de la famille approvisionnement

Livescraper applique ce schéma à toute une série de sources B2B et d'approvisionnement - CDW, AutoZone, Brady, Decathlon et d'autres. Les dix-sept noms et leur ordre sont identiques : un seul importateur les lit toutes, et ajouter une deuxième source relève de la configuration, pas du projet.

Chaque ligne dit si ça a fonctionné

La dernière colonne est status, écrite par notre exportateur et non par le site. Une ligne qui n'a pas pu être récupérée arrive quand même, avec le motif. Vous rapprochez de la liste d'entrée au lieu de découvrir un trou silencieux trois semaines plus tard.

Nous disons ce que nous n'avons pas mesuré

Les deux exécutions derrière cette page ont toutes deux soumis une URL fictive qui a renvoyé un 404 : nous n'avons donc aucune donnée produit BiggestBook. La liste de colonnes ci-dessous est réelle - c'est la ligne d'en-tête de ces exports. Les valeurs ne sont pas décrites, parce que nous n'en avons vu aucune.

Ce que vous récupérez

Dix-sept colonnes, par produit.

Lues dans la ligne d'en-tête d'un véritable export de ce service, dans l'ordre de la feuille. Les deux exécutions dont nous disposons n'ont renvoyé aucune donnée sous cet en-tête - voyez la note sous le tableau -, chaque entrée dit donc à quoi sert la colonne, et s'arrête là.

query
L'URL BiggestBook que vous avez soumise, répétée sur chaque ligne pour qu'un export portant sur de nombreux produits reste séparable. Conservez-la : c'est le seul enregistrement de l'entrée à laquelle répond le reste de la ligne.
sku_code
Le code article tel que le catalogue l'imprime. Il forme une paire avec sku plus bas - vérifiez les deux avant de choisir une clé de jointure, car dans cette famille de schémas ils sont remplis indépendamment.
product_url
La page produit canonique. Distincte de url, qui indique l'adresse d'où la ligne a effectivement été produite ; les deux diffèrent dès qu'un lien soumis redirige.
name
Le titre du produit tel qu'il figure sur la page.
description
Le texte de description. Attendez-vous à un champ de texte libre long plutôt qu'à un libellé court, et donnez-lui une colonne large ou un type texte dans votre base.
parsed_price
Le prix sous forme de nombre brut, sans symbole ni séparateur de milliers - celui à utiliser pour l'arithmétique, le tri et les seuils.
price
Le prix tel qu'affiché. Prenez-le lorsque vous devez montrer à un client exactement ce que disait le catalogue ; prenez parsed_price lorsque vous devez calculer.
currency
La devise dans laquelle le prix est libellé. Lisez-la toujours plutôt que de la supposer : un catalogue de distributeur peut servir une devise différente à un autre compte ou à une autre région.
availability
L'état du stock tel qu'il est publié sur la page. Traitez-le comme l'affirmation du catalogue au moment de la collecte, et non comme un flux d'inventaire en temps réel.
rating
La note moyenne, lorsque la page en publie une. Un catalogue de distributeur ne le fait souvent pas : écrivez l'importateur pour qu'il accepte une cellule vide plutôt que d'échouer dessus.
reviews
Le nombre d'avis, avec la même réserve que rating. Là où les deux sont présents, ils vont ensemble ; une note sans effectif derrière ne vaut rien pour un classement.
images
Toutes les images que porte la page, dans un seul champ. Découpez-le avant l'enregistrement si vous avez besoin d'une ligne par ressource.
brand
Le fabricant ou la marque. C'est le champ sur lequel regrouper pour un travail d'assortiment : quels fabricants un distributeur référence, et avec quelle profondeur par gamme.
sku
La référence article. L'autre moitié de la paire d'identifiants avec sku_code.
url
L'adresse d'où la ligne a été produite. Comparez-la à query pour repérer les redirections, et à product_url pour repérer la canonisation.
image
L'image principale isolée, pour que le cas courant - une vignette par produit - n'exige aucun découpage de chaîne.
status
Un indicateur par ligne écrit par notre exportateur, pas par BiggestBook. Il signale si la ligne a été récupérée. Les deux exécutions derrière cette page portent ici http 404, parce que l'URL soumise est une adresse fictive qui n'existe pas.

Dix-sept colonnes par ligne · CSV, JSON ou Excel

Derrière cette page se trouvent deux exécutions, du 14 et du 15 juillet 2026, dont les charges utiles sont identiques octet pour octet. Toutes deux ont soumis https://www.example.com/product/123 - une adresse fictive, pas une adresse BiggestBook - et toutes deux ont renvoyé une seule ligne portant http 404, les quatorze colonnes de données vides. Nous pouvons donc vous donner le schéma avec certitude, et absolument rien sur les valeurs de BiggestBook, et cette page ne prétend pas le contraire. Les dix-sept noms apparaissent dans le même ordre dans nos exports CDW, AutoZone, Brady et Decathlon, et celui de Decathlon est rempli sur 66 lignes - c'est ainsi que nous savons que le schéma est vivant et non une ébauche.

Usages courants

À quoi sert un catalogue de distributeur.

Suivi des prix

Surveiller une gamme, pas un produit

Soumettez les URL des articles qui vous intéressent selon un calendrier et conservez parsed_price, currency et la date d'exécution. La valeur n'est pas dans un chiffre isolé mais dans la série : quand un fabricant bouge, il bouge en général une gamme entière d'un coup, et un tableau le montre là où un onglet de navigateur ne le montre pas.

Achats · Suivi des prix
Analyse d'assortiment

Voir quelles marques un distributeur porte réellement

Regroupez l'export par brand et comptez. La profondeur par fabricant vous dit où un distributeur s'est engagé et où il ne fait que tester - la même question qu'un acheteur se pose avant d'ajouter un fournisseur, répondue depuis le catalogue lui-même.

Achats catégorie · Assortiment
Enrichissement de catalogue

Remplir les champs qui manquent à vos fiches

Les bases produit des revendeurs sont en général solides sur les identifiants et pauvres en textes et en images. description, image et images comblent ce vide face à un sku que vous possédez déjà, sans rien re-photographier.

Ops e-commerce · Catalogue
Vérification de disponibilité

Savoir avant de chiffrer

Lisez availability sur les lignes d'un devis avant qu'il ne parte. C'est l'état publié du catalogue et non un flux en temps réel : traitez-le comme un système d'alerte - assez pour attraper la ligne en rupture depuis un mois.

Ventes · Devis
Tarifs

Ne payez que ce que vous utilisez réellement.

Offre gratuite

Les 500 premières lignes sont gratuites

Une seule fois, à l'inscription. Sans carte, et sans rien à résilier ensuite.

Une seule fois, à l'inscription
Tarif

puis 0,002 $ par ligne

Facturé sur les lignes réellement renvoyées. Une ligne qui revient avec un status autre qu'un succès n'est pas une ligne de données produit, et ne vous est pas facturée comme telle.

Facturé sur les lignes renvoyées
Sans abonnement

Rien de récurrent

Les crédits n'expirent pas au rythme mensuel. Lancez un balayage de catalogue en mars puis plus rien jusqu'en septembre si le travail a cette forme.

Aucune expiration mensuelle
10 % de remise sur votre première exécution payante.Utilisez le code LIVESCRAPER10 au paiement.
S'inscrire
S'associe bien avec

D'autres catalogues, les mêmes dix-sept colonnes.

Le volet juridique

Est-il légal de scraper BiggestBook ?

Des faits produit sur une page accessible au public relèvent de l'information concurrentielle ordinaire. Les réserves qui méritent d'être signalées portent sur l'accès et la réutilisation, pas sur les données elles-mêmes.

Un prix, un nom de produit, une marque et un état de stock sont des faits sur des biens mis en vente. Les lire sur une page servie à tout visiteur, c'est la même activité qu'un acheteur mène à la main, à une vitesse utile. Rien dans les dix-sept colonnes ne décrit une personne : ni nom, ni adresse e-mail, ni téléphone, ni compte - les questions de protection des données qui façonnent nos services portant sur des personnes ne se posent donc pas ici.

Deux réserves méritent d'être dites clairement. D'abord l'accès : BiggestBook est conçu pour les revendeurs d'Essendant, et une partie d'un catalogue de distributeur - les prix par compte au premier chef - se trouve derrière une connexion. Nous ne nous connectons pas, nous n'utilisons les identifiants de personne et nous ne contournons aucun mur payant : ce que ce service atteint est ce qu'atteint un visiteur anonyme. Si le chiffre dont vous avez besoin n'apparaît qu'une fois connecté en tant que revendeur donné, ce service ne le produira pas. Ensuite la réutilisation : les descriptions et les photographies produit sont l'œuvre protégée de quelqu'un. Les exploiter en interne pour du suivi de prix, de l'analyse d'assortiment ou du rapprochement avec vos propres fiches est une pratique courante ; les republier comme votre propre catalogue est une autre question, avec une autre réponse.

Nos propres conditions sont les mêmes que pour tous les autres services d'ici. Uniquement des pages accessibles au public, rien derrière une connexion, aucun traqueur tiers sur la couche de données, et les exports sont supprimés automatiquement au bout de 30 jours. Vos 500 premières lignes sont gratuites et n'exigent pas de carte.

livescraper.app · ce qui encadre une exécution
Une URL produit par ligne
La page est rendue, pas seulement téléchargée
Accès anonyme uniquement
Les prix par compte restent derrière la connexion!
Les exports sont supprimés au bout de 30 jours
Un catalogue de distributeur montre à un revendeur connecté des chiffres différents de ceux que voit un visiteur anonyme. Ce service est le visiteur anonyme.
Questions fréquentes

Ce que l'on demande avant de s'inscrire.

Quelles colonnes l'export contiendra-t-il ?+
Dix-sept, dans cet ordre : query, sku_code, product_url, name, description, parsed_price, price, currency, availability, rating, reviews, images, brand, sku, url, image et status. Une ligne par URL produit soumise.
Y a-t-il des données d'exemple BiggestBook sur cette page ?+
Non, et nous n'allons pas en inventer. Les deux exécutions derrière cette page ont soumis une URL fictive qui a renvoyé http 404 : toutes les colonnes de données sont revenues vides. Cela suffit à établir les dix-sept noms de colonnes, et rien de plus - c'est pourquoi cette page décrit à quoi sert chaque colonne et jamais à quoi ressemblent ses valeurs.
Pourquoi BiggestBook exige-t-il plus qu'une simple requête HTTP ?+
Parce que le catalogue est une application JavaScript. Demander https://www.biggestbook.com avec un client ordinaire renvoie un HTTP 200 et environ 6,9 Ko : une coquille applicative intitulée « Biggestbook Web » avec <base href="/ui">, sans aucun balisage de prix, de SKU ou de panier nulle part. Les produits sont demandés et affichés ensuite : un scraper reposant sur un simple analyseur HTML voit une page vide.
Pouvez-vous obtenir les prix par compte qu'affiche mon identifiant revendeur ?+
Non. Nous ne nous connectons pas, nous n'utilisons les identifiants de personne et nous ne contournons aucun mur payant : ce service voit ce que voit un visiteur anonyme. Si un chiffre n'apparaît qu'une fois connecté en tant que revendeur donné, il est hors périmètre.
Pourquoi y a-t-il deux colonnes de prix et deux colonnes d'identifiant ?+
Dans chaque paire, l'une sert à lire et l'autre à calculer. price est le prix tel qu'affiché et parsed_price le même chiffre sous forme de nombre brut ; sku et sku_code sont remplis indépendamment dans cette famille de schémas, vérifiez donc les deux avant de choisir une clé de jointure. La même duplication vaut pour image et images, et pour url et product_url.
Que signifie la colonne status ?+
Elle est écrite par notre exportateur, pas par BiggestBook, et signale si cette ligne a été récupérée. Une ligne en échec arrive quand même, avec le motif : vous pouvez rapprocher l'export de votre liste d'entrée au lieu de découvrir un trou silencieux plus tard. Les deux exécutions derrière cette page y lisent http 404.
Combien ça coûte ?+
Vos 500 premières lignes sont gratuites, une seule fois, sans carte. Ensuite c'est 0,002 $ par ligne, facturé sur les lignes réellement renvoyées, sans abonnement et sans expiration mensuelle des crédits.
Dans quels formats puis-je exporter ?+
CSV, JSON ou Excel. Les dix-sept colonnes et leur ordre sont identiques dans les trois.

Lisez le catalogue comme un tableau.

Dix-sept colonnes par produit, depuis une page qui ne les livre pas à une requête HTTP ordinaire. Vos 500 premières lignes sont gratuites, puis 0,002 $ l'unité.

Actif immédiatement · sans carte bancaire

Extraire les données produit de BiggestBook

BiggestBook est le catalogue en ligne qu'Essendant exploite pour ses clients revendeurs, couvrant fournitures de bureau, mobilier, informatique et technologie, salle de pause et entretien. C'est un catalogue de distributeur et non une boutique grand public : ses champs utiles penchent donc vers ce dont un système d'achat a besoin - identifiant, marque, devise, disponibilité - et non vers ce sur quoi s'appuie une page marketing.

L'obstacle pratique tient à la construction du site. Une requête vers https://www.biggestbook.com depuis un client HTTP ordinaire renvoie une réponse réussie d'environ 6,9 Ko contenant une coquille applicative Angular - <base href="/ui">, le titre « Biggestbook Web », une feuille de style - et aucun balisage produit : ni prix, ni SKU, ni bouton panier. Le catalogue est demandé et affiché par JavaScript après le chargement de cette coquille. Tout ce qui repose sur une bibliothèque HTTP et un analyseur HTML lira donc une page valide sans rien y trouver, ce qui est de loin la raison la plus fréquente pour laquelle un scraper BiggestBook fait maison semble fonctionner et renvoie des lignes vides. Ce service charge la page comme le ferait un navigateur : les produits sont là avant que quoi que ce soit ne soit lu.

L'export compte dix-sept colonnes par URL produit : query, sku_code, product_url, name, description, parsed_price, price, currency, availability, rating, reviews, images, brand, sku, url, image et status. Quatre d'entre elles fonctionnent par paires - prix affiché contre prix calculable, deux champs d'identifiant, image principale contre toutes les images, URL demandée contre URL canonique - et savoir quelle moitié utiliser avant d'écrire l'importateur fait la différence entre un chargement propre et une réécriture. Les mêmes dix-sept noms dans le même ordre portent nos exports CDW, AutoZone, Brady et Decathlon : un seul importateur sert donc toute la famille B2B et approvisionnement.

Nous sommes délibérément clairs sur les limites de ce que nous pouvons montrer. Les deux exécutions derrière cette page, du 14 et du 15 juillet 2026, ont toutes deux soumis une adresse fictive plutôt qu'une adresse BiggestBook, et toutes deux sont revenues avec un 404 et chaque colonne de données vide. Cela établit le schéma - une ligne d'en-tête est une véritable ligne d'en-tête même sans données en dessous - et n'établit rien sur les valeurs de BiggestBook : vous ne trouverez donc nulle part sur cette page de prix d'exemple, de nombre de produits ou de note. L'accès a lui aussi une limite réelle : une partie d'un catalogue de distributeur, les prix par compte notamment, se trouve derrière une connexion revendeur, et ce service ne se connecte pas - ce qu'il atteint est ce qu'atteint un visiteur anonyme. Uniquement des pages accessibles au public, aucun traqueur tiers sur la couche de données, et les exports sont supprimés automatiquement au bout de 30 jours. Vos 500 premières lignes sont gratuites et n'exigent pas de carte.