Ferguson Produkt-Scraper

Als blockiert vermerkt.
Nie wirklich versucht.

Unser eigener Servicekatalog führt diesen Dienst als blockiert. Unser Export enthält nichts, woran sich das prüfen ließe - beide Läufe übermittelten eine Platzhalteradresse statt einer Ferguson-URL. Und die robots.txt der Seite ließ sich für uns sauber lesen. Drei Informationen, kein Schluss, und wir veröffentlichen das lieber, als die ordentlichste davon auszuwählen.

2 Läufe, 0 gegen ferguson.comder Katalog sagt „Blocker“ - wir haben keinen Lauf, der das bestätigtrobots.txt sauber gelesen und erlaubt Produktpfadeabgerechnet nach gelieferten Zeilen
So würde es funktionieren

Die Form des Jobs, für den Fall, dass Sie ihn testen.

  1. SCHRITT 1Melden Sie sich auf der Plattform an.
  2. SCHRITT 2Öffnen Sie den Ferguson Products Scraper.
  3. SCHRITT 3Fügen Sie die gewünschten Ferguson-URLs ein, eine pro Zeile.
  4. SCHRITT 4Wählen Sie Ihr Ausgabeformat (CSV / JSON / XLSX).
  5. SCHRITT 5Starten Sie den Job.
  6. SCHRITT 6Lesen Sie zuerst die Spalte status - bei diesem Dienst ist sie die einzige Spalte, in der wir je etwas gesehen haben.
Was wir tatsächlich gefunden haben

Alles hier unten stammt aus unseren eigenen Läufen und Prüfungen.

Kein Lauf hat je ferguson.com angesprochen

Beide Zeilen, die wir halten, übermittelten dieselbe Platzhalteradresse - die fiktive Beispiel-URL, die in dieser ganzen Familie von Exporten auftaucht - und beide gaben http 404 zurück, was eine fiktive Adresse eben liefert. Das bestätigt, dass der Exporter läuft. Über Ferguson sagt es überhaupt nichts.

Unser Katalog sagt blockiert. Wir können es nicht bestätigen

Der interne Eintrag zu diesem Scraper trägt den stärksten negativen Status jener Liste, mit dem Vermerk, es brauche einen Residential-Proxy. Wir berichten das, weil es ein echter Eintrag ist und wir ihn nicht zu verbergen haben. Aber es ist der Befund eines anderen, und unser eigener Export enthält keinen Versuch, ihn aufzuwiegen - diese Seite berichtet ihn also als Behauptung, statt ihn in eine Messung zu verwandeln.

Und die robots.txt der Seite ließ sich sauber lesen

Wir haben sie am 12. August 2026 selbst abgerufen: HTTP 200. Mit einem richtigen Gruppen-Matcher gelesen enthält sie eine Gruppe für einen Werbe-Crawler und eine allgemeine Gruppe mit 57 Regeln, ohne pauschalen Ausschluss, und ein Produktpfad ist erlaubt. Das heißt nicht, dass der Dienst funktioniert - eine robots-Datei ist eine erklärte Präferenz und keine Tür -, aber es heißt, dass das Hindernis, falls es eines gibt, nicht dieses ist.

Drei Quellen, und sie sind sich nicht einig

Eine Katalognotiz, die blockiert sagt, ein Export ohne jeden Versuch und eine offene robots-Datei. Das in einen einzigen selbstsicheren Satz aufzulösen, wäre der leichte und der unehrliche Weg. Anderswo in diesem Katalog veröffentlichen wir echte Abweisungen mit Zeitstempeln; hier veröffentlichen wir die Lücke, weil sie das ist, was wir haben.

Die Spaltenliste ist echt; die Zeilen sind es nicht

Die siebzehn Spalten unten stammen aus der Kopfzeile eines echten Ferguson-Exports - dieser Teil der Datei ist wohlgeformt, auch wenn der Lauf nichts liefert. Sie können heute einen Importer gegen das Schema schreiben. Was Sie nicht können, ist ihn gegen Ferguson-Daten zu prüfen, und das Datenverzeichnis sagt das Spalte für Spalte, statt Werte zu beschreiben, die wir nie gesehen haben.

Ein Test kostet also nichts außer fünf Minuten

Abgerechnet wird nach tatsächlich gelieferten Zeilen. Wenn diese Quelle für Ihre Arbeit zählt, klärt ein kleiner Job in einem Versuch, was drei Quellen untereinander nicht klären konnten - und kommt er blockiert zurück, haben Sie den mit Zeitstempel versehenen Beleg, den wir nicht haben.

Was das Schema sagt

Siebzehn Spalten, keine davon als gefüllt beobachtet.

Aus der Kopfzeile eines echten Ferguson-Exports gelesen, in Blattreihenfolge. Jede Beschreibung unten handelt davon, wofür die Spalte da ist. Wo unsere anderen Katalogseiten Füllzahlen aus einem Lauf nennen, kann diese es nicht: Kein Lauf von uns hat die Seite je erreicht.

query
Die Ferguson-URL, die Sie übermittelt haben. In unseren Läufen trugen nur diese Spalte und status überhaupt etwas - und was sie trugen, war die von uns gesendete Platzhalteradresse.
sku_code
Vorgesehen für Fergusons eigene Artikelnummer. Nicht beobachtet. Bei Nachbardiensten hält diese Spalte die Nummer des Verkäufers und ist oft ein Segment der Produkt-URL.
product_url
Vorgesehen für die kanonische Produktseite. Nicht beobachtet. Auf beiden Zeilen leer.
name
Vorgesehen für den Produkttitel, wie die Anzeige ihn angibt. Nicht beobachtet.
description
Vorgesehen für den längeren Produkttext. Nicht beobachtet. Bei Nachbarkatalogen reicht das von einem ganzen Absatz bis zu einer Kopie des Namens.
parsed_price
Vorgesehen für den Preis als nackte Zahl, zum Rechnen. Nicht beobachtet. Auf dieser Seite steht nirgends ein Ferguson-Preis, weil wir nie einen bekommen haben.
price
Vorgesehen für denselben Preis wie angezeigt, mit Symbol. Nicht beobachtet. Ein Fachgroßhändler zeigt einem Kontoinhaber oft eine andere Zahl als einem Besucher; falls Zeilen eintreffen, klären Sie also, welche davon diese Spalte hält, bevor Sie sie mit irgendetwas vergleichen.
currency
Vorgesehen für die Währung, in der der Preis angegeben ist. Nicht beobachtet.
availability
Vorgesehen für den Bestandsstatus. Nicht beobachtet. Ein Händler mit Niederlassungsbeständen veröffentlicht Verfügbarkeit je Standort, was dies zur Spalte mit dem größten Sorgfaltsbedarf machen würde, sobald sie eintrifft.
rating
Vorgesehen für eine durchschnittliche Kundenbewertung. Nicht beobachtet.
reviews
Vorgesehen für die Zahl der Rezensionen hinter dieser Bewertung. Nicht beobachtet.
images
Vorgesehen für alle Bilder der Anzeige, bei den Diensten, wo sie gefüllt ist, semikolongetrennt. Nicht beobachtet.
brand
Vorgesehen für den Hersteller. Nicht beobachtet. Ein Fachgroßhändler führt viele Fremdhersteller, diese Spalte wäre also wertvoll.
sku
Vorgesehen für einen zweiten Identifikator - auf unseren Reseller-Seiten die Teilenummer des Herstellers im Unterschied zu der des Verkäufers. Nicht beobachtet, wir können Ihnen also nicht sagen, ob Ferguson sie anders füllt als sku_code.
url
Die Adresse, aus der die Zeile entstanden ist. Auf beiden unserer Zeilen gefüllt, weil sie das ist, was wir übermittelt haben, und nicht etwas, das die Seite zurückgab.
image
Vorgesehen für das Hauptbild allein. Nicht beobachtet.
status
Ein Kennzeichen je Zeile, geschrieben von unserem Exporter, nicht von Ferguson. Über unsere zwei Läufe hinweg nahm es einen Wert an: http 404, auf beiden Zeilen, von einer Platzhalteradresse, die es nicht gibt. Gleichen Sie über diese Spalte ab - und bei diesem Dienst behandeln Sie sie als das Erste, was zu lesen ist.

Siebzehn Spalten je Zeile · CSV, JSON oder Excel

Diese Seite beruht auf einer Unterscheidung zwischen drei Arten von Aussagen, und es lohnt sich, deutlich zu sagen, welche welche ist. Erstens, was wir gemessen haben: zwei Läufe, zwei Zeilen, beide gegen eine fiktive Platzhalteradresse, beide mit einem 404, jede Inhaltsspalte leer. Das ist eine Tatsache über unseren Export und nicht über Ferguson. Zweitens, was jemand anderes vermerkt hat: Unser interner Servicekatalog markiert diesen Scraper mit seinem stärksten negativen Status und notiert, es brauche einen Residential-Proxy. Das ist ein echter Eintrag, und wir berichten ihn - als Behauptung, nicht als Ergebnis von uns. Drittens, was wir direkt geprüft haben: Die robots.txt der Seite beantwortete am 12. August 2026 eine gewöhnliche Anfrage, enthält keinen pauschalen Ausschluss für allgemeine Crawler und erlaubt Produktpfade. Diese drei ergeben zusammen keinen Schluss, und wir werden keinen herstellen. Die siebzehn Spalten selbst sind echt - sie stammen aus der Kopfzeile eines echten Exports und sind Byte für Byte identisch mit dem Schema, das unsere Dienste für Gemplers, Uline, CDW, Waxie, Otto, Newegg und Decathlon verwenden -, ein gegen einen davon geschriebener Importer nimmt eine Ferguson-Datei also unverändert an, falls und sobald Zeilen eintreffen.

Was Sie stattdessen tun können

Wo das Ihr Projekt hinstellt.

Selbst klären

Ein kleiner Lauf beantwortet, was drei Quellen nicht konnten

Dies ist die seltene Seite, auf der ein Fünf-Minuten-Test mehr wert ist als alles, was wir schreiben können. Übermitteln Sie ein paar Ferguson-URLs und lesen Sie status: Entweder Sie bekommen Zeilen, oder Sie bekommen eine Abweisung mit Zeitstempel - genau der Beleg, der unserem Export fehlt. Abgerechnet wird nach gelieferten Zeilen, ein gescheiterter Versuch kostet also nichts.

Überprüfung · Geringe Kosten
Benachbarte Quellen

Die Kategorie dort bepreisen, wo Zeilen dahinterstehen

Wenn die Frage lautet, was Sanitär-, Klima- und Gebäudebedarf kostet, und nicht, was Ferguson konkret verlangt, decken unsere Dienste für Gemplers, Uline und Fastenal dasselbe Feld auf denselben siebzehn Spalten ab - und jede dieser Seiten nennt echte Füllzahlen aus echten Läufen.

Beschaffung · Substitution
Den Importer jetzt schreiben

Gegen das Schema bauen, nicht gegen die Zeilen

Die Spaltenliste ist über diese ganze Dienstfamilie stabil. Schreiben und testen Sie Ihren Loader heute gegen einen Nachbarexport und richten Sie ihn später ohne Umbau auf Ferguson - die Kopfzeile sind dieselben siebzehn Namen in derselben Reihenfolge.

Technik · Planung
Den Beleg aufheben

Was auch passiert, heben Sie den Export auf

Kommt Ihr Test tatsächlich blockiert zurück, ist die Zeile, die das mit Zeitstempel sagt, ein besserer Nachweis als eine leere Datei - und ein besserer Beleg als die Katalognotiz, die diese Seite aus zweiter Hand berichten musste. Genau dafür ist die Statusspalte da.

Prüfung · Nachweise
Preise

Gelieferte Zeilen, nicht unternommene Versuche.

Gratis-Kontingent

Die ersten 500 Zeilen sind gratis

Einmalig, bei der Anmeldung. Keine Karte, und nichts, was danach gekündigt werden müsste.

Einmalig, bei der Anmeldung
Preis

danach 0,002 $ pro Zeile

Abgerechnet nach tatsächlich gelieferten Zeilen, und das macht das Klären dieser Frage billig: Kommt nichts zurück, wird nichts berechnet.

Abgerechnet nach gelieferten Zeilen
Kein Abo

Nichts Wiederkehrendes

Guthaben verfällt nicht im Monatsrhythmus, es rinnt also nichts weg, solange der Status einer Quelle ungeklärt ist.

Kein monatlicher Verfall
10 % Rabatt auf Ihren ersten bezahlten Lauf.Verwenden Sie beim Checkout den Code LIVESCRAPER10.
Registrieren
Probieren Sie stattdessen diese

Dieselben siebzehn Spalten, mit Zeilen darin.

Das Rechtliche

Ist es legal, Ferguson zu scrapen?

Hier wurde nichts erhoben, für uns ist die Frage also theoretisch. Das eine, was wir prüfen konnten, kam großzügig zurück - und das ist gerade deshalb erwähnenswert, weil es der Katalognotiz darüber widerspricht.

Preise, Produktnamen und Katalognummern auf einer öffentlich erreichbaren Anzeige sind gewöhnliche Geschäftstatsachen, und sie in angemessenem Tempo zu lesen, ist dieselbe Tätigkeit, die ein Käufer von Hand ausführt. Nichts in den siebzehn Spalten beschreibt eine Person: kein Name, keine E-Mail-Adresse, keine Telefonnummer, kein Konto - die datenschutzrechtlichen Fragen, die unsere personenbezogenen Dienste prägen, stellen sich hier also nicht.

Für Ferguson spezifisch ist, dass wir eine Behauptung haben und keinen Beleg. Unser interner Katalog markiert den Dienst mit seinem stärksten negativen Status und notiert, es brauche einen Residential-Proxy; unser Export enthält keine Anfrage gegen die Seite, die dagegen abzuwägen wäre; und die robots.txt der Seite beantwortete am 12. August 2026 eine gewöhnliche Anfrage mit HTTP 200, enthält keinen pauschalen Ausschluss für allgemeine Crawler und erlaubt, mit einem richtigen Gruppen-Matcher gelesen, Produktpfade. Eine offene robots-Datei ist kein Versprechen, dass ein Scraper gelingt - Bot-Schutz und eine robots-Datei sind verschiedene Schichten, und wir haben hier keine von beiden getestet -, aber sie bedeutet, dass die erklärte Präferenz nicht das Hindernis ist. Eine weitere Warnung, falls doch Zeilen eintreffen: Ein Fachgroßhändler zeigt einem Kontoinhaber oft einen anderen Preis als einem Besucher; klären Sie also, welche Zahl eine Preisspalte hält, bevor Sie sie mit irgendetwas vergleichen.

Unsere eigenen Bedingungen sind dieselben wie bei jedem anderen Dienst hier. Nur öffentlich zugängliche Seiten, nichts hinter einem Login, keine Tracker Dritter auf der Datenebene, und Exporte werden nach 30 Tagen automatisch gelöscht. Abgerechnet wird nach gelieferten Zeilen, ein abgewiesener Versuch ist also keine Rechnung.

livescraper.app · was unsere Läufe zurückgaben
2 Läufe, beide auf einer Platzhalteradresse
0 Anfragen jemals an ferguson.com gesendet
Unser Katalog markiert den Dienst als „Blocker“ - von uns nicht bestätigt
robots.txt sauber gelesen und erlaubt Produktpfade
Abgerechnet nach gelieferten Zeilen - Testen kostet nichts
Drei Quellen, kein Schluss. Wir veröffentlichen die Lücke, statt sie mit dem Wort eines anderen zu schließen.
Häufige Fragen

Was Leute fragen, bevor sie sich anmelden.

Liefert dieser Dienst heute Ferguson-Daten?+
Wir wissen es nicht. Beide Läufe, die wir halten, übermittelten eine fiktive Platzhalteradresse statt einer Ferguson-URL, und beide gaben http 404 zurück, was eine fiktive Adresse eben liefert. Wir haben in keine Richtung Belege über diesen Dienst.
Aber Ihr Katalog sagt, er sei blockiert.+
Das tut er, mit dem stärksten negativen Status jener Liste und dem Vermerk, es brauche einen Residential-Proxy. Wir berichten das, weil es ein echter Eintrag ist. Was wir nicht tun werden, ist ihn als unseren Befund auszugeben: Er kam von jemand anderem, unser Export enthält keinen Versuch, ihn aufzuwiegen, und eine Behauptung ist keine Messung.
Was ergab die direkte Prüfung?+
Dass die robots.txt der Seite am 12. August 2026 eine gewöhnliche Anfrage mit HTTP 200 beantwortete. Mit einem richtigen Gruppen-Matcher gelesen enthält sie eine Gruppe für einen Werbe-Crawler und eine allgemeine Gruppe mit 57 Regeln, ohne pauschalen Ausschluss, und ein Produktpfad ist erlaubt. Das ist eine erklärte Präferenz und kein Beweis, dass der Scraper funktioniert - Bot-Schutz ist eine eigene Schicht, die wir nicht getestet haben.
Ist er nun blockiert oder nicht?+
Ungeklärt, und diese Seite sagt das, statt sich zu entscheiden. Eine Katalognotiz, die blockiert sagt, ein Export ohne Versuch und eine offene robots-Datei ergeben keine Antwort. Ein kleiner eigener Lauf würde es klären - das ist hier die ehrliche Empfehlung.
Warum die Seite überhaupt veröffentlichen?+
Damit der Wissensstand auffindbar ist. Eine fehlende Seite sagt Ihnen nichts. Diese sagt Ihnen genau, was wir halten, genau, was jemand anderes vermerkt hat, und genau, was eine direkte Prüfung ergab - genug, um zu entscheiden, ob Sie fünf Minuten investieren.
Ist die Spaltenliste echt?+
Ja. Die siebzehn Spalten stammen aus der Kopfzeile eines echten Ferguson-Exports und sind identisch mit dem Schema unserer Dienste für Gemplers, Uline, CDW, Waxie, Otto, Newegg und Decathlon. Ein gegen einen davon geschriebener Importer liest eine Ferguson-Datei ohne Änderungen. Was er nicht finden wird, sind gefüllte Zeilen.
Warum zeigen Sie keine Beispielwerte?+
Weil wir für Ferguson keine haben und die Alternative wäre, sie von einem Nachbardienst auf demselben Schema zu borgen. Diese Dienste decken Landwirtschaftsbedarf, Verpackung, Industriebedarf und Technikhandel ab. Ihre Preise sind kein Beleg über einen Sanitär- und Klimagroßhändler, und sie hier zur Veranschaulichung zu zeigen, hieße Daten zu erfinden.
Kostet mich ein Lauf, der nichts liefert, etwas?+
Nein. Abgerechnet wird nach tatsächlich gelieferten Zeilen. Genau das macht das Klären dieser Frage billig.
In welchen Formaten kann ich exportieren?+
CSV, JSON oder Excel, wie bei jedem anderen Dienst hier. Die siebzehn Spalten und ihre Reihenfolge sind in allen dreien identisch.

Eine offene Frage, als solche benannt.

Unser Katalog sagt blockiert, unser Export sagt nichts, und die robots.txt der Seite sagt, der Pfad sei offen. Ein kleiner Lauf würde es klären, und ein leer zurückkommender Lauf kostet nichts.

Abgerechnet nach gelieferten Zeilen · ein abgewiesener Versuch ist keine Rechnung

Ferguson-Produktdaten scrapen

Ferguson ist ein großer Händler für Sanitär-, Klima- und Wasserwirtschaftsbedarf, und diese Seite erscheint in einem ungewöhnlichen Zustand, sogar gemessen an den negativen Ergebnissen anderswo in diesem Katalog: Wir haben eine Behauptung, der Dienst sei blockiert, und keinen eigenen Beleg in irgendeine Richtung. Unser Exportordner enthält zwei Läufe und zwei Zeilen. Beide übermittelten dieselbe fiktive Platzhalteradresse, die in dieser ganzen Familie von Exporten auftaucht, statt einer Ferguson-URL, und beide gaben einen 404 zurück - was eine fiktive Adresse eben liefert. Jede Inhaltsspalte ist auf beiden Zeilen leer. Diese Läufe bestätigen, dass der Exporter funktioniert, und bestätigen überhaupt nichts über die Seite.

Was wir haben, ist ein Eintrag von anderswo. Unser interner Servicekatalog markiert diesen Scraper mit seinem stärksten negativen Status und notiert, es brauche einen Residential-Proxy. Wir berichten das, weil es ein echter Eintrag ist und ihn zu verbergen eine eigene Art von Unehrlichkeit wäre. Aber wir sind sorgfältig darin, was er ist: eine Notiz von jemand anderem, die unser eigener Export durch keinen Versuch erhärtet oder widerlegt. Zwei andere Seiten in diesem Katalog berichten echte Abweisungen - Versuche gegen echte URLs, abgewiesen, mit Zeitstempeln und einem Statuswert, der jede einzelne festhält. Diese Seite kann das nicht, und eine Behauptung aus zweiter Hand in die Sprache erster Hand zu kleiden, wäre genau jene leise Übertreibung, zu deren Vermeidung der Rest dieser Seiten existiert.

Das eine, was wir selbst prüfen konnten, kam großzügig zurück, und es ist gerade deshalb erwähnenswert, weil es der Behauptung darüber widerspricht. Am 12. August 2026 beantwortete die robots.txt der Seite eine gewöhnliche Anfrage mit HTTP 200. Mit einem richtigen Gruppen-Matcher statt eines Präfixtests gelesen, enthält sie eine Gruppe für einen Werbe-Crawler und eine allgemeine Gruppe mit siebenundfünfzig Regeln, keinen pauschalen Ausschluss für allgemeine Crawler, und ein Produktpfad ist erlaubt. Das ist kein Beweis, dass der Scraper funktioniert. Eine robots-Datei erklärt eine Präferenz; Bot-Schutz ist eine andere Schicht vor derselben Seite, und wir haben keine von beiden getestet. Aber es bedeutet, dass das Hindernis, falls es eines gibt, keine Anweisung in dieser Datei ist.

Diese Seite endet also mit einer offenen Frage statt mit einem Schluss und mit einer Empfehlung, die wirklich Ihnen zu handeln überlässt. Abgerechnet wird nach tatsächlich gelieferten Zeilen, ein kleiner Job klärt also in einem einzigen Versuch, was drei Quellen untereinander nicht klären konnten: Entweder treffen Zeilen ein, oder Sie bekommen eine Abweisung mit Zeitstempel - genau der Beleg, der unserem Export fehlt. Falls sie eintreffen, lohnt sich eine Warnung: Ein Fachgroßhändler zeigt einem Kontoinhaber oft eine andere Zahl als einem anonymen Besucher; klären Sie also, welche eine Preisspalte hält, bevor Sie sie mit irgendetwas vergleichen. Und wenn Sie eigentlich Beschaffungspreise brauchen und nicht Ferguson im Besonderen, nennen unsere Seiten zu Gemplers, Uline und Fastenal jeweils echte Füllzahlen aus echten Läufen. Nur öffentlich zugängliche Seiten, keine Tracker Dritter auf der Datenebene, Exporte werden nach 30 Tagen automatisch gelöscht, und Ihre ersten 500 Zeilen sind gratis, ohne Kreditkarte.