Gemplers Produkt-Scraper

Eine Produkt-URL rein,
fast die ganze Zeile raus.

Das ist das sauberste Ergebnis in unserem Lieferantenkatalog. Eine Produkt-URL kam mit fünfzehn von siebzehn gefüllten Spalten zurück - Name, Marke, Preis, Währung, Bestand, beide Identifikatoren, eine vollständige Beschreibung und Bilder - und wir haben jeden dieser Werte an der Live-Seite geprüft.

einmalig 500 Zeilen gratisdanach 0,002 $ pro Zeile15 von 17 Spalten in unserem LaufCSV · JSON · Excel
So funktioniert es

Eine Liste von URLs rein, eine Tabelle raus.

  1. SCHRITT 1Melden Sie sich auf der Plattform an.
  2. SCHRITT 2Öffnen Sie den Gemplers Products Scraper.
  3. SCHRITT 3Fügen Sie die gewünschten Gemplers-URLs ein, eine pro Zeile - eine /products/-Seite oder eine /collections/-Seite. Andere Formen werden abgewiesen, und die Statusspalte sagt das mit genau diesen Worten.
  4. SCHRITT 4Wählen Sie Ihr Ausgabeformat (CSV / JSON / XLSX).
  5. SCHRITT 5Starten Sie den Job.
  6. SCHRITT 6Laden Sie die Ergebnisse herunter - siebzehn Spalten je Zeile.
Was Sie erwartet

Was man wissen sollte, bevor man ihn laufen lässt.

Fünfzehn von siebzehn Spalten, an einem echten Produkt

Unser erfolgreicher Lauf lieferte einen vollständigen Handelstitel, den Hersteller in einer eigenen brand-Spalte, einen Preis als rechenbare Zahl, eine Währung, einen Bestandsstatus, beide Identifikatorspalten, einen Absatz Produkttext und eine Bild-URL. Nur rating und reviews kamen leer zurück. Unter den Lieferantenkatalogen auf diesem Schema ist das die vollste Zeile, die wir halten.

Wir haben jeden Wert an der Live-Seite geprüft

Ein Abruf derselben Produkt-URL liefert rund 620 KB HTML mit drei strukturierten Datenblöcken, davon einer ein vollständiger Produktdatensatz, dessen Angebotsknoten dieselbe Währung, denselben Preis und denselben Bestandsstatus nennt wie unser Export. Die Artikelnummer steht zwei Dutzend Mal im Markup, der Hersteller über hundert Mal. Nichts in der Zeile ist erschlossen - es steht alles auf der Seite.

Die Statusspalte sagt Ihnen, was sie annimmt

Unsere beiden anderen Läufe übermittelten eine Platzhalteradresse und kamen nicht mit einem bloßen Fehler zurück. Sie kamen mit unsupported URL (use a /collections/ or /products/ URL) zurück - der Dienst nennt die beiden Formen, die er annimmt. Das ist ungewöhnlich hilfreich, es deckt sich mit den vom Anbieter hinterlegten Beispieleingaben, und es bedeutet, dass eine vertippte Liste Ihnen sagt, was falsch ist, statt nichts zu liefern.

Der Preis kommt als nackte Zahl an

Wichtig, wenn Sie einen Importer für mehrere unserer Lieferantendienste schreiben. Hier hielten price und parsed_price denselben Wert ohne Währungssymbol - anders als auf unseren Uline-Seiten, wo price ein Dollarzeichen trägt und parsed_price nicht. Lesen Sie currency für die Denomination, statt sie aus der Zeichenkette zu parsen.

Die Spaltenreihenfolge hat sich zwischen unseren Exporten bewegt

Die Namen änderten sich nicht, ihre Reihenfolge schon: Unser Juli-Lauf listet die Spalten beginnend mit Name, Marke, Preis, die späteren Läufe beginnen mit dem Identifikator und der Produkt-URL. So oder so siebzehn Namen. Wenn Ihr Loader nach Position statt nach Kopfzeile liest, ordnet er eine Gemplers-Datei still falsch zu - lesen Sie also nach Namen.

Eine Artikelnummer, in beiden Identifikatorspalten

sku und sku_code hielten auf unserer Zeile denselben Wert, so wie auf unserer Uline-Seite und anders als in unseren Reseller-Katalogen, wo eine die Nummer des Verkäufers und die andere die des Herstellers ist. Die Spalte brand trägt den Hersteller separat, Sie bekommen also beide Tatsachen - nur nicht zwei Nummern.

Was Sie zurückbekommen

Siebzehn Spalten, fünfzehn davon gefüllt.

Aus einem echten Export gelesen, in Blattreihenfolge. Die Anmerkungen stammen aus unserem einen erfolgreichen Lauf und aus einem direkten Abruf derselben Anzeige; wo hier steht, dass eine Spalte einen Wert trug, beschreibt das eine Zeile, die wir tatsächlich halten.

query
Die Gemplers-URL, die Sie übermittelt haben, zurückgegeben. Auf allen drei unserer Zeilen gefüllt, auch auf den beiden, die der Dienst abgewiesen hat - und genau das lässt einen Ergebnissatz gegen Ihre Eingabeliste abgleichen.
sku_code
Die Gemplers-Artikelnummer. Gefüllt, und auf unserer Zeile identisch mit sku. Dieselbe Nummer steht zwei Dutzend Mal im Markup der Live-Seite, eine Zeile lässt sich also gegen die Anzeige prüfen, aus der sie stammt.
product_url
Die kanonische Produktseite. Gefüllt, und auf unserer Zeile gleich query wie url, weil wir eine Produktseite und keine Kollektion übermittelt haben.
name
Der Produkttitel, wie die Anzeige ihn angibt - Hersteller, Modell und Lieferumfang in einer Zeichenkette. Gefüllt, und er stimmt mit dem Seitentitel der Live-Anzeige überein.
description
Der Produkttext. Gefüllt, und ein echter Absatz statt einer Wiederholung des Namens - ein Spezifikationssatz mit Messbereichen und Merkmalen. Damit ist dies einer der wenigen Kataloge dieser Familie, in dem description den Import lohnt.
parsed_price
Der Preis als nackte Zahl. Gefüllt. Damit rechnen Sie, und auf unserer Zeile ist er Byte für Byte identisch mit price.
price
Derselbe Betrag - und hier kommt er ohne Währungssymbol an, was nicht für jeden Dienst auf diesem Schema gilt. Lesen Sie currency, statt die Denomination aus der Zeichenkette zu schließen.
currency
Die Währung, in der der Preis angegeben ist, auf unserer Zeile USD und vom Angebotsdatensatz der Live-Seite bestätigt.
availability
Der Bestandsstatus. Gefüllt auf unserer Zeile als Wert für „vorrätig“, und die strukturierten Daten der Live-Seite sagen dasselbe. Diese Spalte ist bei Lieferantenkatalogen nicht immer vorhanden, hier lohnt sie sich also.
rating
Auf unserer Zeile leer. Eine von nur zwei Spalten, die ohne Wert zurückkamen.
reviews
Auf unserer Zeile leer, mit demselben Vorbehalt wie rating. Planen Sie mit einer Lieferantenanzeige, die Spezifikationen statt Verbraucherbewertungs-Beiwerk führt.
images
Die Bilder der Anzeige. Gefüllt mit einer URL auf dem eigenen Bildhost des Shops. Unsere Zeile trug ein einzelnes Bild, es war also kein Zerlegen von Zeichenketten nötig.
brand
Der Hersteller, in einer eigenen Spalte. Gefüllt - und getrennt vom Händler, was hier zählt, weil Gemplers neben der eigenen Linie Fremdhersteller führt. Das ist die Spalte, die unsere Uline-Seite nicht hat.
sku
Wieder die Artikelnummer. Auf unserer Zeile derselbe Wert wie sku_code. Nehmen Sie eine davon; behalten Sie beide, wenn Sie einen Importer über mehrere unserer Katalogdienste schreiben, wo sie manchmal abweichen.
url
Die Adresse, aus der die Zeile entstanden ist. Auf unserer Zeile gleich product_url.
image
Das Hauptbild für sich, sodass der Normalfall ohne Zerlegen von Zeichenketten auskommt. Auf unserer Zeile identisch mit images.
status
Ein Kennzeichen je Zeile, geschrieben von unserem Exporter, nicht von Gemplers. Über unsere drei Läufe hinweg nahm es zwei Werte an: ok auf der echten Produkt-URL und unsupported URL (use a /collections/ or /products/ URL) auf den beiden Platzhalter-Übermittlungen. Lesen Sie es zuerst - es ist die Spalte, die Ihnen sagt, dass Ihre Eingabe die falsche Form hatte.

Siebzehn Spalten je Zeile · CSV, JSON oder Excel

Zwei praktische Anmerkungen und eine gute Nachricht. Zuerst die gute Nachricht: Das ist die vollste Zeile, die wir von irgendeinem Lieferantenkatalog auf diesem Schema halten. Fünfzehn von siebzehn Spalten trugen Werte, und ein direkter Abruf derselben Anzeige bestätigt jeden einzelnen - die Seite liefert drei strukturierte Datenblöcke, davon einer ein vollständiger Produktdatensatz, dessen Angebotsknoten denselben Preis, dieselbe Währung und denselben Bestandsstatus nennt wie unser Export. Nun die Vorbehalte. Erstens kommt price hier als nackte Zahl statt als formatierte Zeichenkette an; ein Importer, der ein Währungssymbol entfernt, entfernt nichts, und einer, der eines erwartet, findet keines - lesen Sie stattdessen currency. Zweitens, und leichter zu übersehen: die Spaltenreihenfolge ist zwischen Exporten nicht stabil. Unser Juli-Lauf und unsere späteren Läufe listen dieselben siebzehn Namen in unterschiedlicher Folge. Lesen Sie nach Kopfzeilennamen, nie nach Position, sonst lädt eine Gemplers-Datei sauber in die falschen Felder.

Häufige Arbeitsabläufe

Wofür eine volle Zeile gut ist.

Preisüberwachung

Einen Beschaffungspreis verfolgen, ohne Zeichenketten zu putzen

parsed_price ist eine nackte Zahl und currency sagt Ihnen, worin sie ausgedrückt ist; ein geplanter Lauf über die von Ihnen bezogenen Artikel erzeugt also eine Preisreihe ganz ohne Parsing-Schritt. Legen Sie sku und das Datum daneben, und eine Änderung meldet sich von selbst.

Beschaffung · Monitoring
Bestandswarnungen

Die Verfügbarkeit der Artikel beobachten, auf die es ankommt

Die Bestandsspalte kam gefüllt an, was nicht für jeden Lieferantenkatalog gilt, den wir abdecken. Kombiniert mit einem Wochenrhythmus haben Sie eine Nachschubwarnung für die Handvoll Teile, deren Fehlen die Arbeit tatsächlich stoppt.

Bestand · Betrieb
Katalogaufbau

Einen Feed mit Text und Bild bauen

Name, Marke, Beschreibung und eine Bild-URL kamen alle auf einer Zeile zurück. Das genügt, um einen internen Katalogeintrag zu füllen, ohne die Seite zu öffnen - und die Beschreibung ist echter Produkttext und keine Dublette des Titels.

Feeds · Inhalte
Markenanalyse

Ein Sortiment nach Hersteller gruppieren

brand ist hier eine eigene Spalte und nicht etwas, das man aus dem Titel parsen muss. Übermitteln Sie eine Kollektionsseite, und Sie sehen, aus welchen Herstellern eine Kategorie besteht und zu welchen Preisen - ohne eine einzige Zeichenkette zu normalisieren.

Sortiment · Beschaffung
Preise

Zahlen Sie nur, was Sie tatsächlich nutzen.

Gratis-Kontingent

Die ersten 500 Zeilen sind gratis

Einmalig, bei der Anmeldung. Keine Karte, und nichts, was danach gekündigt werden müsste.

Einmalig, bei der Anmeldung
Preis

danach 0,002 $ pro Zeile

Abgerechnet nach tatsächlich gelieferten Zeilen. Eine Kollektionsseite kann viele Zeilen erzeugen, wo eine Produktseite eine erzeugt; beginnen Sie also mit ein paar URLs und sehen Sie, was die Form Ihrer Liste kostet.

Abgerechnet nach gelieferten Zeilen
Kein Abo

Nichts Wiederkehrendes

Guthaben verfällt nicht im Monatsrhythmus. Prüfen Sie Ihre Beschaffungspreise zum Quartalsende und dazwischen nichts, wenn die Arbeit so aussieht.

Kein monatlicher Verfall
10 % Rabatt auf Ihren ersten bezahlten Lauf.Verwenden Sie beim Checkout den Code LIVESCRAPER10.
Registrieren
Passt gut zu

Andere Lieferanten, dieselben siebzehn Spalten.

Das Rechtliche

Ist es legal, Gemplers zu scrapen?

Listenpreise und Artikelnummern auf einer öffentlichen Katalogseite sind gewöhnliche Geschäftstatsachen. Dies ist eine der ruhigeren Seiten unseres Katalogs, und die Vorbehalte sind entsprechend klein.

Ein Preis, ein Produktname und eine Katalognummer sind Tatsachen über zum Verkauf angebotene Waren. Sie von einer Seite zu lesen, die jedem Besucher ausgeliefert wird, ist dieselbe Tätigkeit, die ein Käufer von Hand ausführt - nur in nützlichem Tempo. Nichts in den siebzehn Spalten beschreibt eine Person: kein Name, keine E-Mail-Adresse, keine Telefonnummer, kein Konto. Die datenschutzrechtlichen Fragen, die unsere personenbezogenen Dienste prägen, stellen sich hier also nicht. Preise stehen offen auf der Anzeige statt hinter einem Konto, und deshalb kommen die Geldspalten in diesem Export voll an.

Der Zugang war unkompliziert. Die robots.txt der Seite beantwortete am 12. August 2026 eine gewöhnliche Anfrage mit HTTP 200, und mit einem richtigen Gruppen-Matcher gelesen enthält ihre allgemeine Gruppe 40 Regeln, keinen pauschalen Ausschluss, und beide Pfadformen, die dieser Dienst annimmt - Produktseiten und Kollektionsseiten -, sind erlaubt. Nichts, was wir liefen, wurde blockiert, und die einzigen nicht erfolgreichen Zeilen in unserem Export sind der Dienst, der höflich eine Platzhalteradresse abweist, die keine der beiden Formen hat. Der einzige Vorbehalt ist gewöhnliches Tempo: Eine Kollektionsseite leistet mehr Arbeit je Anfrage als eine Produktseite, planen Sie also entsprechend, statt sie als Gratismultiplikator zu behandeln.

Unsere eigenen Bedingungen sind dieselben wie bei jedem anderen Dienst hier. Nur öffentlich zugängliche Seiten, nichts hinter einem Login, keine Tracker Dritter auf der Datenebene, und Exporte werden nach 30 Tagen automatisch gelöscht. Ihre ersten 500 Zeilen sind gratis und brauchen keine Kreditkarte.

livescraper.app · was einen Lauf prägt
Produktseiten und Kollektionsseiten, beide erlaubt
15 von 17 Spalten in unserem Lauf gefüllt
Jeder Wert an der Live-Anzeige bestätigt
Die Statusspalte nennt die URL-Formen, die sie annimmt
Exporte werden nach 30 Tagen automatisch gelöscht
Hier wurde nichts von uns blockiert, und die robots.txt der Seite ließ sich sauber lesen.
Häufige Fragen

Was Leute fragen, bevor sie sich anmelden.

Welche URLs nimmt der Dienst an?+
Produktseiten und Kollektionsseiten. Wir wissen das genau und nicht durch Schluss: Unsere beiden Platzhalterläufe kamen mit dem Status unsupported URL (use a /collections/ or /products/ URL) zurück, und die vom Anbieter hinterlegte Beispieleingabe für diesen Dienst besteht aus zwei URLs, je einer pro Form.
Wie vollständig ist eine Zeile?+
In unserem erfolgreichen Lauf trugen fünfzehn von siebzehn Spalten Werte - Name, Marke, Preis, geparster Preis, Währung, Bestand, beide Identifikatoren, Beschreibung, Bilder, Bild, URL, Produkt-URL, Query und Status. Nur rating und reviews waren leer. Das ist die vollste Zeile, die wir von einem Lieferantenkatalog auf diesem Schema halten.
Woher wissen Sie, dass die Werte stimmen?+
Wir haben dieselbe Anzeige am 12. August 2026 abgerufen. Sie liefert rund 620 KB HTML mit drei strukturierten Datenblöcken, davon einer ein vollständiger Produktdatensatz, dessen Angebotsknoten dieselbe Währung, denselben Preis und denselben Vorrätig-Status nennt wie unsere Zeile. Die Artikelnummer steht zwei Dutzend Mal im Markup, der Hersteller über hundert Mal.
Enthält der Preis ein Währungssymbol?+
Nein. price und parsed_price hielten auf unserer Zeile dieselbe nackte Zahl. Das unterscheidet sich von einigen unserer anderen Lieferantendienste, wo price die formatierte Zeichenkette ist. Lesen Sie currency für die Denomination, statt den Preistext zu parsen.
Warum halten sku und sku_code denselben Wert?+
Weil es hier eine Artikelnummer gibt. Auf unseren Reseller-Seiten tragen diese beiden Spalten absichtlich unterschiedliche Nummerierungen - die Artikelnummer des Verkäufers und die des Herstellers. Hier stimmen sie überein, und der Hersteller steht gesondert in brand, Sie haben also weiterhin beide Tatsachen.
Meine zwei Gemplers-Exporte haben die Spalten in anderer Reihenfolge. Warum?+
Weil sich die Reihenfolge zwischen unseren Läufen geändert hat, die Namen aber nicht. Ein Export listet Name und Marke weit vorn, ein anderer beginnt mit dem Identifikator und der Produkt-URL. So oder so siebzehn Namen - lesen Sie also nach Kopfzeilennamen und nie nach Position.
Wurde irgendetwas blockiert?+
Nein. Unsere drei Läufe erzeugten eine erfolgreiche Zeile und zwei höfliche Abweisungen einer Platzhalteradresse. Die robots.txt der Seite ließ sich für uns sauber lesen, ihre allgemeine Gruppe enthält keinen pauschalen Ausschluss, und beide angenommenen Pfadformen sind erlaubt.
Was kostet das?+
Ihre ersten 500 Zeilen sind gratis, einmalig, ohne Karte. Danach sind es 0,002 $ pro Zeile, abgerechnet nach tatsächlich gelieferten Zeilen. Eine Kollektionsseite kann viele Zeilen erzeugen, wo eine Produktseite eine erzeugt; testen Sie also ein paar URLs, bevor Sie eine Liste einreihen.
In welchen Formaten kann ich exportieren?+
CSV, JSON oder Excel. Die siebzehn Spalten sind in allen dreien gleich - lesen Sie sie nach Namen, denn die Reihenfolge hat sich zwischen unseren eigenen Exporten bewegt.

Eine volle Zeile, und wir haben sie geprüft.

Name, Marke, Preis, Währung, Bestand, Beschreibung und Bilder aus einer Produkt-URL - mit jedem Wert an der Live-Anzeige bestätigt. Ihre ersten 500 Zeilen sind gratis, danach je 0,002 $.

Sofort aktiv · keine Karte erforderlich

Gemplers-Produktdaten scrapen

Gemplers liefert Ausrüstung für Landwirtschaft, Grünflächenpflege und Arbeitskleidung, und von allen Lieferantenkatalogen, die wir auf diesem siebzehnspaltigen Schema abdecken, ist er derjenige, der die vollständigste Zeile lieferte. Unser erfolgreicher Lauf übermittelte eine einzige Produkt-URL und kam mit fünfzehn der siebzehn Spalten gefüllt zurück: ein vollständiger Handelstitel, der Hersteller in einer eigenen Markenspalte, der Preis sowohl als rechenbare Zahl als auch als angezeigter Wert, eine Währung, ein Bestandsstatus, beide Identifikatorspalten, ein Absatz echten Produkttexts und eine Bildadresse auf dem eigenen Host des Shops. Nur Bewertung und Rezensionen waren leer - und so sieht eine Lieferantenanzeige aus, die um Spezifikationen statt um Verbraucherbewertungen herum gebaut ist.

Wir haben das nicht auf Treu und Glauben übernommen. Ein Abruf derselben Anzeige am 12. August 2026 liefert rund sechshundertzwanzig Kilobyte HTML mit drei strukturierten Datenblöcken, davon einer ein vollständiger Produktdatensatz. Dessen Angebotsknoten nennt dieselbe Währung, denselben Preis und denselben Vorrätig-Status, die unser Export hält; die Artikelnummer steht zwei Dutzend Mal im Markup und der Name des Herstellers über hundert Mal. Damit ist dies die am besten belegte Zeile in der ganzen Familie der Katalogseiten dieser Website - jeder Wert darin ist auf der Seite sichtbar, aus der er stammt, statt erschlossen, clientseitig gerendert oder aus einer Nachbarquelle rekonstruiert zu sein.

Zwei Dinge an der Datei sollte man wissen, bevor man einen Importer schreibt. Der Preis kommt als nackte Zahl an: Sowohl die Preisspalte als auch die Spalte mit dem geparsten Preis hielten denselben Wert ohne Währungssymbol, was nicht für jeden Dienst mit diesem Schema gilt; lesen Sie also die Währungsspalte für die Denomination, statt Zeichen aus einer Zeichenkette zu entfernen. Und die Spaltenreihenfolge ist zwischen Exporten nicht stabil. Unser Juli-Lauf listet die siebzehn Namen in einer Folge und unsere späteren Läufe in einer anderen - die Namen sind identisch, die Positionen nicht. Ein Loader, der nach Position statt nach Kopfzeile liest, bildet eine Gemplers-Datei sauber auf die falschen Felder ab, und das ist die Sorte Fehler, die plausiblen Unsinn statt einer Fehlermeldung erzeugt.

Der Rest ist ungewöhnlich ruhig, und wir sagen das lieber, als Dramatik zu erfinden. Nichts von uns wurde blockiert. Die robots.txt der Seite beantwortete eine gewöhnliche Anfrage, enthält keinen pauschalen Ausschluss für allgemeine Crawler und erlaubt beide Pfadformen, die dieser Dienst annimmt. Diese Formen sind erwähnenswert, weil der Dienst sie selbst nennt: Unsere beiden anderen Läufe übermittelten eine Platzhalteradresse und kamen nicht mit einem bloßen Fehler zurück, sondern mit einem Status, der sagt, die URL werde nicht unterstützt und man solle eine Kollektions- oder Produkt-URL verwenden - dieselben zwei Formen, die die vom Anbieter hinterlegte Beispieleingabe verwendet. Drei Läufe sind eine viel zu kleine Stichprobe, um daraus eine Erfolgsquote zu nennen, und wir nennen keine. Nur öffentlich zugängliche Seiten, keine Tracker Dritter auf der Datenebene, Exporte werden nach 30 Tagen automatisch gelöscht, und Ihre ersten 500 Zeilen sind gratis, ohne Kreditkarte.