GlobalIndustrial Produkt-Scraper

Um 03:43 blockiert.
Um 03:54 in Ordnung.

Dieselbe URL, elf Minuten Abstand, erst abgewiesen und dann ausgeliefert. Das ist hier der nützliche Befund: Das Blockieren ist zeitweilig, ein zweiter Versuch ist also mehr wert als ein Umweg. Der unbequemere Befund ist, dass die Zeile, die wir bekamen, keine Produktzeile ist - und diese Seite erklärt warum, bevor Sie darauf aufbauen.

4 Läufe: 1 ok, 3 blockiertdieselbe URL abgewiesen, dann 11 Minuten später ausgeliefertdie ok-Zeile ist eine Suchseite, kein Produktabgerechnet nach gelieferten Zeilen - ein blockierter Lauf kostet nichts
So funktioniert es

Eine Liste von URLs rein, eine Tabelle raus.

  1. SCHRITT 1Melden Sie sich auf der Plattform an.
  2. SCHRITT 2Öffnen Sie den GlobalIndustrial Products Scraper.
  3. SCHRITT 3Fügen Sie die gewünschten GlobalIndustrial-URLs ein, eine pro Zeile - und lesen Sie die Anmerkung unten dazu, welche Formen tatsächlich auf ein Produkt auflösen.
  4. SCHRITT 4Wählen Sie Ihr Ausgabeformat (CSV / JSON / XLSX).
  5. SCHRITT 5Starten Sie den Job.
  6. SCHRITT 6Lesen Sie zuerst die Spalte status und wiederholen Sie alles, was blockiert zurückkam.
Was wir tatsächlich gefunden haben

Alles hier unten stammt aus unseren eigenen Läufen und Prüfungen.

Dieselbe URL, abgewiesen und dann ausgeliefert

Das ist der Befund, der zählt. Am 3. Juli 2026 übermittelten wir eine Produkt-URL um 03:43 und bekamen blocked (needs residential proxy); wir übermittelten dieselbe URL um 03:54 und bekamen ok. Elf Minuten. Sonst änderte sich nichts. Wo eine Blockade in diesem Katalog sonst dauerhaft wirkt, ist sie es hier nachweislich nicht - und das macht einen zweiten Versuch zur richtigen Antwort, nicht eine Ersatzquelle.

Aber die erfolgreiche Zeile ist keine Produktzeile

Wir weisen lieber darauf hin, als es durchrutschen zu lassen. Diese ok-Zeile füllte fünf Felder und ließ zehn leer - kein Identifikator, keine Marke, keine Beschreibung, kein Bestand, kein Bild. Ihr name ist der URL-Slug, samt Bindestrichen, und kein Produkttitel. Eine Zeile, die sich nach ihrer eigenen Adresse benennt, ist eine Zeile, die kein Produkt gefunden hat, und diese Seite behandelt sie so.

Denn die URL leitet auf eine Suchseite weiter

Wir haben nachgesehen, und die Erklärung ist eindeutig. Diese Adresse liefert überhaupt keine Produktseite: Sie antwortet mit einer dauerhaften Weiterleitung auf eine Suchergebnisseite zum selben Slug. Das Ziel ist eine Auflistung vieler Produkte - deshalb hat die Zeile einen Slug als Namen und deshalb sind neun ihrer Spalten leer. Die Zahl in ihrer Preisspalte erscheint auf jener Suchseite; dass sie der Preis der vom Slug benannten Maschine ist, steht nicht fest, und wir stellen sie nicht so dar.

Und die Weiterleitung landet auf einem von der robots.txt ausgeschlossenen Pfad

Die robots.txt der Seite ließ sich für uns sauber lesen und enthält keinen pauschalen Ausschluss für allgemeine Crawler. Mit einem richtigen Matcher geprüft ist der Produktpfad jedoch erlaubt und der Suchpfad verboten - und die erlaubte URL leitet auf die verbotene weiter. Die in unserem eigenen Servicekatalog hinterlegte Beispieleingabe ist genau diese Such-URL. Wir weisen auf den Widerspruch hin, statt das Beispiel als Empfehlung zu wiederholen.

Die Statusspalte gibt Ihnen die Anweisung

Zwei unserer vier Zeilen kamen mit blocked (intermittent - retry) zurück - der Dienst sagt Ihnen, was zu tun ist, und nicht nur, was passiert ist. Zusammen mit dem Elf-Minuten-Versuch oben ergibt das ein stimmiges Bild: Eine Blockade ist hier ein Moment und kein Urteil. Zählen Sie blockierte Zeilen je Lauf, wiederholen Sie sie, und gleichen Sie über status ab statt über die Zeilenzahl.

Ein blockierter Lauf wird nicht berechnet

Abgerechnet wird nach tatsächlich gelieferten Zeilen, und das macht den Rat zum Wiederholen billig umzusetzen: Drei unserer vier Läufe brachten nichts hervor und hätten nichts gekostet. Das ist auch der Grund, warum diese Seite nicht mit einer Anmeldeschaltfläche beginnt. Eine Zeile, die sich als Beschreibung einer Suchseite herausstellt, ist kein Ergebnis, das wir verkaufen werden.

Was Sie zurückbekommen

Siebzehn Spalten, fünf davon einmal gefüllt.

Aus einem echten Export gelesen, in Blattreihenfolge. Wo hier steht, dass eine Spalte einen Wert trug, beschreibt das die einzige Zeile mit ok - eine Zeile, der wir aus dem in der Anmerkung unten dargelegten Grund misstrauen.

query
Die GlobalIndustrial-URL, die Sie übermittelt haben, zurückgegeben. Auf allen vier unserer Zeilen gefüllt, auch auf den drei blockierten - und genau das lässt Sie exakt die fehlgeschlagenen Eingaben wiederholen.
sku_code
Vorgesehen für GlobalIndustrials eigene Artikelnummer. Auf unserer ok-Zeile leer. Ihr Fehlen ist Teil des Grundes, warum wir diese Zeile als Suchseite und nicht als Produkt lesen.
product_url
Vorgesehen für die kanonische Produktseite. Auf unserer ok-Zeile leer - die Adresse blieb in url, und nichts löste auf ein Produkt auf.
name
Der Produkttitel. Auf unserer ok-Zeile ist das der URL-Slug, samt Bindestrichen, und kein Handelstitel. Behandeln Sie einen kleingeschriebenen Wert mit Bindestrichen hier als Signal, dass der Lauf keine Produktseite erreicht hat.
description
Vorgesehen für den Produkttext. Auf unserer ok-Zeile leer.
parsed_price
Der Preis als nackte Zahl. Auf unserer ok-Zeile gefüllt - aber lesen Sie die Anmerkung unten, bevor Sie ihn verwenden. Die Zahl erscheint auf der Suchseite, auf die die URL weiterleitet; dass sie der Preis des vom Slug benannten Artikels ist, steht nicht fest.
price
Dieselbe Zahl mit Währungssymbol. Auf unserer ok-Zeile gefüllt, mit demselben Vorbehalt.
currency
Die Währung, in der der Preis angegeben ist. Auf unserer ok-Zeile gefüllt als US-Dollar-Wert.
availability
Vorgesehen für den Bestandsstatus. Auf unserer ok-Zeile leer.
rating
Vorgesehen für eine Durchschnittsbewertung. Auf unserer ok-Zeile leer.
reviews
Vorgesehen für die Zahl der Rezensionen. Auf unserer ok-Zeile leer.
images
Vorgesehen für die Bilder der Anzeige. Auf unserer ok-Zeile leer - ein weiteres Zeichen dafür, dass keine Produktseite erreicht wurde.
brand
Vorgesehen für den Hersteller. Auf unserer ok-Zeile leer.
sku
Vorgesehen für einen zweiten Identifikator. Auf unserer ok-Zeile leer, wir können Ihnen also nicht sagen, ob diese Seite ihn anders füllt als sku_code.
url
Die Adresse, aus der die Zeile entstanden ist. Auf allen vier Zeilen gefüllt, weil sie das ist, was wir übermittelt haben.
image
Vorgesehen für das Hauptbild allein. Auf unserer ok-Zeile leer.
status
Ein Kennzeichen je Zeile, geschrieben von unserem Exporter, nicht von GlobalIndustrial - und die aufschlussreichste Spalte bei diesem Dienst. Über vier Läufe hinweg nahm es drei Werte an: einmal ok, einmal blocked (needs residential proxy) und zweimal blocked (intermittent - retry). Das letzte ist eine Anweisung, und der Elf-Minuten-Versuch oben sagt, dass es eine gute ist.

Siebzehn Spalten je Zeile · CSV, JSON oder Excel

Das Nützlichste auf dieser Seite ist eine Warnung vor ihren eigenen Daten. Unsere eine erfolgreiche Zeile trägt einen Namen, der der URL-Slug ist, einen Preis, eine Währung - und zehn leere Spalten. Wir haben geprüft, warum, und die Antwort lautet: Die übermittelte Adresse ist keine Produktseite, sie antwortet mit einer dauerhaften Weiterleitung auf eine Suchergebnisseite zum selben Slug. Eine Suchseite hat keinen einzelnen Produkttitel, deshalb fiel der Name auf den Slug zurück, und keinen einzelnen Identifikator, keine Beschreibung, keine Marke, keinen Bestandswert und kein Bild, deshalb sind jene Spalten leer. Die Preiszahl erscheint zwar auf jener Suchseite, aber eine Suchseite listet viele Produkte, nichts belegt sie also als Preis der vom Slug benannten Maschine - und diese Seite stellt sie deshalb nie als solchen dar. Es gibt eine zweite, verwandte Warnung: Die robots.txt der Seite erlaubt den Produktpfad und verbietet den Suchpfad, die URL, die Sie abrufen dürfen, leitet also auf eine weiter, die Sie nicht crawlen sollen. Die in unserem eigenen Servicekatalog hinterlegte Beispieleingabe ist genau diese Such-URL. Übermitteln Sie echte Produkt-URLs, lesen Sie zuerst status, und wiederholen Sie alles Blockierte.

Was Sie damit tun können

Wo das Ihr Projekt hinstellt.

Wiederholen, nicht ersetzen

Planen Sie einen zweiten Versuch ein, keinen Umweg

Das Elf-Minuten-Ergebnis ist die praktische Lehre. Eine Blockade ist hier ein Moment und kein Urteil, bauen Sie also einen zweiten Versuch in den Zeitplan ein und zählen Sie blockierte Zeilen je Lauf. Wiederholungen kosten nichts, wenn sie scheitern, denn abgerechnet wird nach gelieferten Zeilen.

Betrieb · Zeitplanung
Die Form prüfen

Produkt-URLs übermitteln und den Namen plausibilisieren

Wenn ein zurückgegebener name wie ein URL-Slug aussieht - klein geschrieben, mit Bindestrichen, passend zur Adresse -, hat der Lauf kein Produkt erreicht. Das ist eine einzeilige Prüfung, die in Ihren Importer gehört, und bei diesem Dienst hätte sie unsere eigene beste Zeile erwischt.

Datenqualität · Technik
Auf die Weiterleitung achten

Wissen, wo Ihre URL tatsächlich landet

Eine Adresse, die dauerhaft auf eine Suchseite weiterleitet, liefert Suchseiten-Daten, und die robots.txt der Seite bittet allgemeine Crawler, diesen Suchpfad zu meiden. Lösen Sie Ihre Eingabe-URLs auf, bevor Sie sie einreihen, statt danach die Ergebnisse zu deuten.

Compliance · Planung
Benachbarte Quellen

Die Kategorie dort bepreisen, wo Zeilen dahinterstehen

Wenn die Frage lautet, was Industrie- und Gebäudebedarf kostet, und nicht, was dieser Händler konkret verlangt, decken unsere Dienste für Uline, Gemplers und Fastenal dasselbe Feld auf denselben siebzehn Spalten ab, und jene Seiten nennen echte Füllzahlen aus echten Läufen.

Beschaffung · Substitution
Preise

Gelieferte Zeilen, nicht unternommene Versuche.

Gratis-Kontingent

Die ersten 500 Zeilen sind gratis

Einmalig, bei der Anmeldung. Keine Karte, und nichts, was danach gekündigt werden müsste.

Einmalig, bei der Anmeldung
Preis

danach 0,002 $ pro Zeile

Abgerechnet nach tatsächlich gelieferten Zeilen, und das macht den Rat zum Wiederholen auf dieser Seite billig: Drei unserer vier Läufe brachten nichts hervor und hätten nichts gekostet.

Abgerechnet nach gelieferten Zeilen
Kein Abo

Nichts Wiederkehrendes

Guthaben verfällt nicht im Monatsrhythmus, ein auf Wiederholungen gebauter Zeitplan lässt zwischen den Versuchen also nichts still versickern.

Kein monatlicher Verfall
10 % Rabatt auf Ihren ersten bezahlten Lauf.Verwenden Sie beim Checkout den Code LIVESCRAPER10.
Registrieren
Probieren Sie auch diese

Dieselben siebzehn Spalten, vollere Zeilen.

Das Rechtliche

Ist es legal, GlobalIndustrial zu scrapen?

Preise und Artikelnummern auf einer öffentlichen Katalogseite sind gewöhnliche Geschäftstatsachen. Sorgfalt verdient hier nicht die Erlaubnis im Allgemeinen, sondern ein bestimmter Pfad - und eine Weiterleitung, die ihn überschreitet.

Ein Preis, ein Produktname und eine Katalognummer sind Tatsachen über zum Verkauf angebotene Waren, gelesen von einer Seite, die jedem Besucher ausgeliefert wird. Nichts in den siebzehn Spalten beschreibt eine Person: kein Name, keine E-Mail-Adresse, keine Telefonnummer, kein Konto - die datenschutzrechtlichen Fragen, die unsere personenbezogenen Dienste prägen, stellen sich hier also nicht.

Zwei Dinge sind für diese Seite spezifisch. Erstens das Blockieren, das real und nachweislich zeitweilig ist: Dieselbe URL wurde abgewiesen und elf Minuten später ausgeliefert, und zwei unserer Zeilen tragen einen Status, der wörtlich zu einem zweiten Versuch rät. Wir machen eine Blockade in der Statusspalte sichtbar und hören dort auf, statt sie zu umgehen, und uns wäre lieber, Sie planten einen zweiten Versuch ein, als anzunehmen, die Quelle sei geschlossen. Zweitens, und heikler: Die robots.txt der Seite ließ sich für uns sauber lesen und enthält keinen pauschalen Ausschluss, ihre allgemeine Gruppe verbietet aber den Suchpfad, während sie Produktpfade erlaubt - und die von uns übermittelte Produkt-URL antwortet mit einer dauerhaften Weiterleitung auf ebendiesen Suchpfad. Eine Adresse, die Sie anfragen dürfen, kann also dort landen, wo Sie nicht crawlen sollen. Wir berichten das, statt die Weiterleitung als Erlaubnis zu behandeln, und würden empfehlen, Ihre Eingabe-URLs aufzulösen, bevor Sie sie einreihen. Die in unserem eigenen Servicekatalog hinterlegte Beispieleingabe ist genau diese Such-URL, und genau deshalb weisen wir darauf hin, statt sie zu wiederholen.

Unsere eigenen Bedingungen sind dieselben wie bei jedem anderen Dienst hier. Nur öffentlich zugängliche Seiten, nichts hinter einem Login, keine Tracker Dritter auf der Datenebene, und Exporte werden nach 30 Tagen automatisch gelöscht. Abgerechnet wird nach gelieferten Zeilen, ein blockierter Versuch ist also keine Rechnung.

livescraper.app · was unsere Läufe zurückgaben
Dieselbe URL: um 03:43 blockiert, um 03:54 ok
3 von 4 Zeilen blockiert; zwei davon raten zu einem zweiten Versuch
Die ok-Zeile ist eine Suchseite, kein Produkt
robots.txt erlaubt den Produktpfad, verbietet den Suchpfad
Abgerechnet nach gelieferten Zeilen - die blockierten Läufe kosteten nichts
Keine Zahl aus unserer einen ok-Zeile wird als Preis des Produkts dargestellt, das ihr Slug benennt.
Häufige Fragen

Was Leute fragen, bevor sie sich anmelden.

Ist GlobalIndustrial blockiert?+
Manchmal, und wir können das genau sagen. Von unseren vier Läufen kamen drei blockiert zurück und einer mit ok - und der blockierte und der erfolgreiche übermittelten dieselbe URL, elf Minuten auseinander, am 3. Juli 2026. Die Blockade ist also ein Moment und kein Urteil. Zwei der blockierten Zeilen tragen sogar einen Status, der blocked (intermittent - retry) lautet.
Der Dienst funktioniert also?+
Er lieferte eine Zeile, aber keine brauchbare, und das sagen wir lieber, als es als Erfolg zu zählen. Die erfolgreiche Zeile füllte fünf Felder und ließ zehn leer, und ihr name ist der URL-Slug statt eines Produkttitels. So sieht ein Lauf aus, der keine Produktseite erreicht.
Warum erreichte er keine Produktseite?+
Weil die URL keine ist. Wir haben es am 12. August 2026 geprüft: Diese Adresse antwortet mit einer dauerhaften Weiterleitung auf eine Suchergebnisseite zum selben Slug. Eine Suchseite listet viele Produkte, es gibt also keinen einzelnen Titel, Identifikator, keine Marke, Beschreibung, keinen Bestandswert und kein Bild zu erfassen - genau die Form der Zeile, die wir bekamen.
Und der Preis auf dieser Zeile?+
Die Zahl erscheint tatsächlich auf der Suchseite, auf die die URL weiterleitet. Aber diese Seite listet viele Produkte, nichts belegt sie also als Preis des vom Slug benannten Artikels - und wir drucken sie deshalb nirgends auf dieser Seite als dessen Preis. Behandeln Sie sie als von einer Listenseite gelesenen Wert und prüfen Sie ihn vor der Verwendung.
Welche URLs soll ich übermitteln?+
Echte Produkt-URLs, und lösen Sie sie vorher auf. Die robots.txt der Seite erlaubt Produktpfade und verbietet den Suchpfad, und die von uns verwendete URL in Produktform leitet auf ebendiesen Suchpfad weiter. Die in unserem eigenen Katalog für diesen Dienst hinterlegte Beispieleingabe ist die Such-URL, und deshalb weisen wir darauf hin, statt sie zu wiederholen.
Wie soll ich mit dem Blockieren umgehen?+
Wiederholen. Zählen Sie blockierte Zeilen je Lauf, reichen Sie sie erneut ein, und gleichen Sie über status ab statt über die Zeilenzahl. Abgerechnet wird nach tatsächlich gelieferten Zeilen, die gescheiterten Versuche kosten also nichts - und genau das macht einen Wiederholungsplan hier zur billigen Antwort.
Ist die Spaltenliste echt?+
Ja. Die siebzehn Spalten stammen aus der Kopfzeile eines echten Exports und sind identisch mit dem Schema unserer Dienste für Uline, Gemplers, CDW, Waxie, Otto, Newegg und Decathlon, ein gegen einen davon geschriebener Importer liest eine GlobalIndustrial-Datei also unverändert.
Kostet mich ein blockierter Lauf etwas?+
Nein. Abgerechnet wird nach tatsächlich gelieferten Zeilen. Drei unserer vier Läufe brachten keine brauchbaren Zeilen hervor und hätten nichts gekostet.
In welchen Formaten kann ich exportieren?+
CSV, JSON oder Excel. Die siebzehn Spalten und ihre Reihenfolge sind in allen dreien gleich.

Versuchen Sie es erneut. Und prüfen Sie den Namen.

Das Blockieren ist hier zeitweilig - dieselbe URL scheiterte und funktionierte elf Minuten später -, ein zweiter Versuch ist also mehr wert als ein Umweg. Stellen Sie nur sicher, dass die URL auf ein Produkt auflöst, denn unsere tat es nicht. Ein blockierter Lauf kostet nichts.

Abgerechnet nach gelieferten Zeilen · ein blockierter Versuch ist keine Rechnung

GlobalIndustrial-Produktdaten scrapen

GlobalIndustrial verkauft Industrie-, Fördertechnik- und Gebäudeausstattung, und unser Export dazu enthält vier Läufe - einen erfolgreichen und drei blockierte. Das Nützlichste in diesem kleinen Datensatz ist ein zeitlicher Zufall, der sich als keiner erweist. Am 3. Juli 2026 übermittelten wir um 03:43 eine URL in Produktform, und der Lauf kam blockiert zurück, mit dem Hinweis auf einen Residential-Proxy. Wir übermittelten dieselbe URL um 03:54, und sie kam erfolgreich zurück. Elf Minuten, sonst änderte sich nichts. Zwei unserer anderen Zeilen tragen einen Status, der wörtlich besagt, die Blockade sei zeitweilig und die Anfrage solle wiederholt werden. Zusammengenommen ergibt das ein stimmiges und umsetzbares Bild: Auf dieser Seite ist eine Blockade ein Moment und kein Urteil, und ein Wiederholungsplan schlägt einen Umweg.

Die unbequemere Hälfte der Geschichte ist die erfolgreiche Zeile selbst, und wir stellen das Problem lieber voran, als es zu begraben. Diese Zeile füllte fünf von siebzehn Feldern - die übermittelte Adresse, die Adresse noch einmal, einen Preis, eine Währung und einen Namen - und ließ zehn leer. Es gab keinen Identifikator, keine Marke, keine Beschreibung, keinen Bestandswert und kein Bild. Und der Name ist kein Produkttitel: Es ist der URL-Slug, klein geschrieben und mit Bindestrichen, identisch mit dem Ende der von uns übermittelten Adresse. Eine Zeile, die sich nach ihrer eigenen URL benennt, ist eine Zeile, die nie ein Produkt gefunden hat.

Wir haben geprüft, warum, und die Erklärung ist eindeutig. Am 12. August 2026 lieferte diese Adresse überhaupt keine Produktseite. Sie antwortete mit einer dauerhaften Weiterleitung auf eine Suchergebnisseite zum selben Slug - eine Auflistung vieler Produkte, ein halbes Megabyte Markup, der Suchbegriff dutzendfach vorhanden. Das erklärt jede Merkwürdigkeit der Zeile: Eine Suchseite hat keinen einzelnen Titel, deshalb fiel der Name auf den Slug zurück; keinen einzelnen Identifikator, keine Marke, Beschreibung, keinen Bestandswert und kein Bild, deshalb sind jene Spalten leer. Die Preiszahl erscheint tatsächlich auf jener Suchseite. Aber eine Seite, die viele Produkte listet, belegt nicht, zu welchem eine Zahl gehört, deshalb geben wir sie nirgends auf dieser Seite als Preis der vom Slug benannten Maschine wieder. Wenn Sie eines von dieser Seite in Ihren eigenen Importer mitnehmen, dann diese Prüfung: Ein name, der wie ein URL-Slug aussieht, bedeutet, dass der Lauf kein Produkt erreicht hat.

Eine Sache verdient es noch, ausgesprochen statt beschönigt zu werden. Die robots.txt der Seite ließ sich für uns sauber lesen und enthält keinen pauschalen Ausschluss für allgemeine Crawler - mit einem richtigen Gruppen-Matcher gelesen erlaubt sie aber den Produktpfad und verbietet den Suchpfad, und die von uns übermittelte URL in Produktform leitet auf ebendiesen Suchpfad weiter. Eine Adresse, die Sie abrufen dürfen, kann also auf einer landen, die Sie nicht crawlen sollen - ein guter Grund, Eingabe-URLs vor dem Einreihen aufzulösen statt erst nach dem Lesen der Ergebnisse. Die in unserem eigenen Servicekatalog für diesen Scraper hinterlegte Beispieleingabe ist zufällig genau diese Such-URL, und eben deshalb weisen wir auf den Widerspruch hin, statt sie als Empfehlung wiederzugeben. Abgerechnet wird nach tatsächlich gelieferten Zeilen, sowohl die blockierten Versuche als auch die Wiederholungen kosten also nichts, wenn sie scheitern. Nur öffentlich zugängliche Seiten, keine Tracker Dritter auf der Datenebene, Exporte werden nach 30 Tagen automatisch gelöscht, und Ihre ersten 500 Zeilen sind gratis, ohne Kreditkarte.