Shopify Produkt-Scraper

Ein ganzer Shop,
Variante für Variante.

Geben Sie einen Shopify-Shop-Link ein - die Domain oder eine einzelne Kollektion - und erhalten Sie den Katalog als Zeilen zurück: Produkt-ID, Titel, Handle, Beschreibung, Anbieter, Typ, Tags, Preis, SKU, Verfügbarkeit und die Variante selbst, dazu Zeitstempel und die Varianten-, Bild- und Optionsdaten des Shops. Zweiundzwanzig Spalten, gelesen aus dem öffentlichen Produkt-Feed des Shops.

einmalig 500 kostenlose Zeilendanach 0,002 $ je Zeile22 SpaltenCSV · XLSX · JSON
So funktioniert es

Ein Shop-Link hinein,
sein Katalog heraus.

Die Eingabe ist der Shop, nicht das Produkt - Sie benennen die Shops oder Kollektionen, die Sie wollen, und der Job liest, was jeder davon veröffentlicht.

  1. SCHRITT 1Melden Sie sich auf der Plattform an.
  2. SCHRITT 2Öffnen Sie den Shopify Products Scraper.
  3. SCHRITT 3Fügen Sie Links zu Shopify-Websites ein, eine pro Zeile - eine Shop-Domain oder eine Kollektions-URL. Oder laden Sie eine CSV-, XLSX-, TXT- oder Parquet-Datei hoch.
  4. SCHRITT 4Legen Sie ein Limit je Abfrage fest oder setzen Sie es auf null, um alles zu nehmen.
  5. SCHRITT 5Wählen Sie Ihr Ausgabeformat.
  6. SCHRITT 6Klicken Sie auf Get Data.

Eine Zeile pro Variante, jede mit der Abfrage gekennzeichnet, aus der sie stammt - so lässt sich ein Lauf über mehrere Shops weiterhin mit Ihrer Eingabeliste abgleichen.

Warum Teams ihn nutzen

Eine Zeile ist
eine Variante.

Jede Größe und Farbe bekommt eine eigene Zeile

Das sollten Sie wissen, bevor Sie irgendetwas zählen. Ein Produkt mit siebzehn Größen- und Farbkombinationen ergibt siebzehn Zeilen: ID, Titel, Handle und Beschreibung wiederholen sich, während sku und variant wechseln. Zeilen sind Varianten - behandeln Sie sie als Produkte, und Sie zählen einen Katalog um ein Vielfaches zu hoch.

Das Produktmodell des Shops, unversehrt

Weil die Zeilen aus dem öffentlichen Produkt-Feed des Shops stammen und nicht von einer Seite abgelesen werden, behält der Export Shopifys eigene Form: echte Zeitstempel, das Handle, den Anbieter und den Produkttyp - und die vollständigen Strukturen variants, images und options als JSON durchgereicht statt wegplattgemacht.

Daten, nach denen sich wirklich sortieren lässt

published_at, created_at und updated_at kommen als ISO-8601-Zeitstempel mit UTC-Offset an - unter Katalogexporten ungewöhnlich genug, um es zu erwähnen. Kein Anzeigeformat, das man erst zerlegen muss, und eine schlichte Sortierung zeigt, was ein Shop zuletzt hinzugefügt oder angefasst hat.

Was Sie zurückbekommen

Zweiundzwanzig Spalten,
eine Zeile pro Variante.

Jede Zeile ist eine kaufbare Variante, so wie der Shop sie veröffentlicht: was das Produkt ist, was genau diese Größe oder Farbe kostet, ob sie verfügbar ist, und die strukturierten Daten, die Shopify dahinter führt.

Die Spaltenliste unten ist die Kopfzeile echter Laufexporte und zugleich die von der Plattform veröffentlichte Liste; beide stimmen exakt überein. Lesen Sie die Anmerkung darunter, bevor Sie einen Parser schreiben - drei dieser Spalten enthalten JSON statt eines einfachen Werts, und die Zeile, die Sie ansehen, ist eine Variante und kein Produkt.

Datenwörterbuch

Zweiundzwanzig Spalten,
in Exportreihenfolge.

Die Kopfzeile des Exports, in ihrer Reihenfolge, abgeglichen mit der von der Plattform veröffentlichten Spaltenliste. Wo eine Wertform tatsächlich beobachtet wurde, ist sie beschrieben; wo nicht, sagt der Eintrag, wofür das Feld da ist, und hört auf.

query
Der von Ihnen eingereichte Shop- oder Kollektions-Link, wiederholt in jeder daraus entstandenen Zeile - so lässt sich ein Lauf über mehrere Shops weiterhin mit Ihrer Eingabeliste abgleichen.
id
Die Produkt-ID des Shops. Sie ist produktbezogen und wiederholt sich daher über alle Varianten desselben Produkts - genau deshalb ist sie die Spalte, nach der man gruppiert, wenn man Produkte statt Zeilen will.
title
Der Produkttitel. Produktbezogen und daher über die Varianten dieses Produkts wiederholt.
handle
Der URL-Slug des Produkts - der letzte Teil seiner Produktseitenadresse und ein stabiler Schlüssel, der eine Titeländerung übersteht.
body_html
Die Produktbeschreibung, so wie der Shop sie veröffentlicht, samt Markup.
published_at
Wann das Produkt im Shop veröffentlicht wurde, als ISO-8601-Zeitstempel mit UTC-Offset.
created_at
Wann der Produktdatensatz angelegt wurde, in derselben ISO-8601-Form.
updated_at
Wann er zuletzt geändert wurde, in derselben ISO-8601-Form. Die Spalte, nach der man sortiert, wenn man wissen will, woran ein Shop gerade arbeitet.
vendor
Der Anbieter, unter dem der Shop das Produkt führt - oft die eigene Marke des Shops statt eines Dritten.
product_type
Der Produkttyp, so wie der Shop ihn einordnet.
tags
Die Tags des Produkts, als eine kommagetrennte Zeichenkette statt als Liste.
variants
Die vollständige Variantenstruktur des Produkts, als JSON in einer einzigen Zelle durchgereicht. Parsen Sie sie, wenn Sie die übrigen Varianten brauchen; die Zeile, auf der Sie sind, ist bereits eine davon.
images
Die Bilddatensätze des Produkts, ebenfalls als JSON in einer Zelle durchgereicht.
options
Die Optionsdefinitionen - wie der Shop seine Größen-, Farb- oder Materialachsen nennt und welche Werte jede zulässt - ebenfalls als JSON.
price
Der Preis dieser Variante, als Text mit zwei Dezimalstellen und ohne Währungssymbol. Wandeln Sie ihn um, bevor Sie vergleichen oder summieren.
compare_at_price
Der Vorher-Preis, sofern der Shop einen setzt. Sein Vorhandensein ist es, was eine Variante als im Angebot kennzeichnet.
currency
Die Währung, in der der Preis angegeben ist.
sku
Der Lagercode des Shops für genau diese Variante. Er ist das, was dem Export am nächsten an einem Schlüssel je Zeile kommt.
available
Ob diese Variante gekauft werden kann, als das kleingeschriebene Wort yes oder no.
variant
Die Variante selbst, so wie der Shop sie bezeichnet - die zusammengesetzten Optionswerte, etwa eine Farbe und eine Größe.
url
Ein Link auf die Produktseite. Produktbezogen, wiederholt sich also über die Varianten des Produkts.
image
Ein Link auf das Produktbild, und die letzte Spalte in der Datei.

Zwei Dinge, die Sie wissen sollten, bevor Sie Code dagegen schreiben. Erstens: eine Zeile ist eine Variante, kein Produkt. id, title, handle, body_html, url und image wiederholen sich durch die Datei, während sku und variant wechseln - gruppieren Sie also nach id, wenn Sie Produkte wollen, und zählen Sie Zeilen nur, wenn Sie wirklich Varianten wollen. Zweitens enthalten variants, images und options jeweils JSON in einer einzigen Zelle - eine Tabellenkalkulation zeigt sie als lange Zeichenkette, und Ihr Parser muss sie dekodieren statt an Kommas zu trennen. Alles Übrige ist einfacher Text, auch der Preis, der kein Währungssymbol trägt.

Laufsteuerung

Am Job eingestellt,
nicht in der Tabelle.

Eine Liste von Shop-Links und ein Limit. Die einzige echte Einschränkung ist, dass die Website auf Shopify laufen muss - dies liest den eigenen öffentlichen Produkt-Feed des Shops.

Shop-Domain Kollektions-URL Eine pro Zeile Limit je Abfrage Null für alles Muss eine Shopify-Website sein CSV-Upload XLSX-Upload TXT-Upload Parquet-Upload
Häufige Arbeitsabläufe

Drei Aufgaben, die hier
am häufigsten laufen.

Ein paar Beispiele, wie Teams Shop-Katalogdaten nutzen, um eine Frage zu beantworten, die sie tatsächlich haben.

Wettbewerb

Sehen, was tatsächlich vorrätig ist

Weil jede Variante ihre eigene Zeile mit eigener Verfügbarkeit hat, können Sie lesen, welche Größen oder Farben ein Shop abverkauft hat - und nicht bloß, welche Produkte er listet. Das ist ein weit besseres Signal dafür, was sich verkauft, als eine Produktseite je liefert.

Merchandising
Preise

Alles im Angebot auf einmal finden

Filtern Sie auf Zeilen mit gesetztem Vorher-Preis, und Sie haben das gesamte Rabattbild des Shops in einem Durchgang - welche Linien, welche Varianten und wie tief. Wöchentlich wiederholt, wird der Aktionsrhythmus eines Wettbewerbers offensichtlich.

Preise
Forschung

Beobachten, woran ein Shop gearbeitet hat

Sortieren Sie nach dem Aktualisierungszeitstempel, und die jüngste Aktivität zeigt sich von selbst: neue Launches, überarbeitete Beschreibungen, stille Preisänderungen. Das Anlage- und das Veröffentlichungsdatum daneben trennen wirklich neue Produkte von alten, die aufgefrischt wurden.

Strategie
Preise

Zahlen Sie nur für die Zeilen,
die Sie tatsächlich abrufen.

Kein Abonnement, kein Mindestumsatz, keine wiederkehrende Rechnung. Ihre ersten 500 Zeilen gehen auf uns - danach zahlen Sie nach Verbrauch, zum selben Pauschalpreis wie bei jedem anderen Scraper hier.

Kostenlose Stufe

500 kostenlose Zeilen - 0 $

Für jedes neue Konto, einmalig. Keine Kreditkarte erforderlich. Limits je Abfrage, Datei-Upload und jedes Exportformat inbegriffen.

0 $ für immer
Nach Verbrauch

0,002 $ je Zeile, nach der kostenlosen Stufe

Etwa 2 $ pro 1.000 Varianten. Denken Sie daran, dass ein einzelnes Produkt ein Dutzend Zeilen sein kann - der Vorab-Schätzer zeigt Zeilenzahl und Guthabenkosten, bevor ein Lauf startet.

Am beliebtesten
Volumen

Individuell · hohes Volumen

Volumenpreise, dedizierte Worker und ein SLA für laufende Überwachung oder sehr große Katalogabrufe. Nennen Sie uns Ihre Zahlen, und wir erstellen ein Angebot.

Sprechen Sie uns an
10 % Rabatt auf Ihren ersten bezahlten Lauf.Verwenden Sie den Code LIVESCRAPER10 an der Kasse.
Registrieren
Passt gut zusammen mit

Der Shop,
und was darauf läuft.

Das Rechtliche

Ist es legal,
einen Shopify-Shop zu scrapen?

Kurze Antwort: ja, für den öffentlichen Katalog - und dieser Export enthält keine Kunden-, Bestell- oder Bestandsdaten.

Jedes Feld hier stammt aus dem Produkt-Feed, den ein Shopify-Shop für jeden lesbar veröffentlicht - dieselben Daten, die auch die eigenen Seiten des Shops und seine Listungen anderswo füllen. Titel, Beschreibungen, Preise, Varianten und Bilder sind von Haus aus öffentlich. Öffentlich veröffentlichte Katalogdaten zu sammeln ist seit Langem gängige Praxis, und nichts hier berührt ein Login, einen Warenkorb, eine Kasse oder ein Händler-Backend.

In dieser Ausgabe stecken überhaupt keine personenbezogenen Daten - es ist eine Produkttabelle. Keine Kundennamen, keine Bestellungen, keine Lagermengen, weil nichts davon im öffentlichen Feed steht. Die Verfügbarkeitsspalte sagt, ob eine Variante gekauft werden kann, was nicht dasselbe ist wie wie viele noch da sind - und dieser Export hat keine Möglichkeit, Letzteres zu wissen.

Shopifys Bedingungen und die eigenen Bedingungen jedes Händlers können automatisierten Zugriff einschränken, dies ist also ebenso eine Vertrags- wie eine Rechtsfrage - wenn Sie eine Beziehung zum Shop haben, prüfen Sie sie. Wir betreiben keine Tracker Dritter auf der Datenebene, und Ihre Exporte werden nach 30 Tagen automatisch gelöscht.

livescraper.app · Grundsätze
Nur der öffentliche Produkt-Feed
Keine Logins, kein Händler-Backend
Keine Bestellungen oder Kundendaten
Keine Lagermengen
Exporte löschen sich automatisch (30 Tage)
Prüfen Sie vor dem Skalieren die eigenen Bedingungen des Händlers.
Häufige Fragen

Was Menschen fragen,
bevor sie sich anmelden.

Die Fragen, die wir am häufigsten hören. Noch etwas? Sprechen Sie uns an - die Antworten schreiben Menschen, keine Bots.

Wie scrape ich einen Shopify-Shop?+
Mit dem Shopify Products Scraper:
  1. Melden Sie sich auf der Plattform an.
  2. Öffnen Sie den Shopify Products Scraper.
  3. Fügen Sie Links zu Shopify-Websites ein, eine pro Zeile - eine Shop-Domain oder eine Kollektions-URL. Oder laden Sie eine CSV-, XLSX-, TXT- oder Parquet-Datei hoch.
  4. Legen Sie ein Limit je Abfrage fest oder setzen Sie es auf null, um alles zu nehmen.
  5. Wählen Sie Ihr Ausgabeformat.
  6. Klicken Sie auf Get Data.
Ist eine Zeile ein Produkt oder eine Variante?+
Eine Variante. Ein Produkt mit siebzehn Größen- und Farbkombinationen ergibt siebzehn Zeilen, wobei ID, Titel, Handle und Beschreibung sich wiederholen, während SKU und Variante wechseln. Gruppieren Sie nach der ID, wenn Sie Produkte wollen, und zählen Sie Zeilen nur, wenn Sie wirklich Varianten wollen.
Funktioniert das bei jedem Onlineshop?+
Nur bei Shops, die auf Shopify laufen. Dies liest den eigenen öffentlichen Produkt-Feed des Shops, eine Website auf einer anderen Basis hat also nichts, was gelesen werden könnte - das ist die eine echte Einschränkung dieses Scrapers, und es lohnt sich, das zu prüfen, bevor Sie eine lange Liste einreihen.
Kann ich statt eines ganzen Shops eine Kollektion angeben?+
Ja. Eine Shop-Domain nimmt den Katalog, eine Kollektions-URL nur diesen Bereich, in beiden Fällen ein Link pro Zeile. Die Abfragespalte wiederholt, was immer Sie eingereicht haben, sodass sich ein Lauf, der ganze Shops und einzelne Kollektionen mischt, weiterhin mit Ihrer Eingabe abgleichen lässt.
Was sind die Spalten variants, images und options?+
Sie reichen die strukturierten Daten des Shops als JSON in einer einzigen Zelle durch, statt sie plattzumachen. Eine Tabellenkalkulation zeigt sie als lange Zeichenkette - dekodieren Sie sie in Ihrem Parser, wenn Sie den Inhalt brauchen, und denken Sie daran, dass die Zeile, auf der Sie sind, bereits eine der Varianten ist.
In welchem Format sind die Daten?+
ISO-8601-Zeitstempel mit UTC-Offset, für die Spalten published, created und updated gleichermaßen. Das heißt: kein Anzeigeformat, das man zerlegen muss, und eine Sortierung nach der Aktualisierungsspalte zeigt, woran der Shop zuletzt gearbeitet hat.
Bekomme ich Lagerbestände?+
Nein. Die Verfügbarkeitsspalte sagt, ob eine Variante gekauft werden kann, als das kleingeschriebene Wort yes oder no - was nicht dasselbe ist wie wie viele noch da sind. Mengen stehen nicht im öffentlichen Feed, also kann kein Export sie Ihnen geben.
Was kostet das?+
Die ersten 500 Zeilen sind kostenlos und einmalig, ohne Kreditkarte. Danach sind es 0,002 $ je Zeile - etwa 2 $ pro 1.000 Varianten - derselbe Pauschalpreis wie bei jedem anderen Scraper auf der Plattform. Weil ein einzelnes Produkt viele Zeilen sein kann, lohnt sich hier ein Blick auf den Schätzer, der die Zahl vor dem Start zeigt.

Ihre ersten 500 Zeilen,
gehen aufs Haus.

500 einmalige kostenlose Zeilen für jedes neue Konto - ohne Ablaufdatum. Danach 0,002 $ je Zeile, nach Verbrauch - keine hinterlegte Karte, bis Sie es sagen.

Sofort aktiv · keine Karte erforderlich

Shopify-Shop-Kataloge im großen Stil scrapen

Der Shopify Products Scraper von Livescraper macht aus einem Shop-Link eine Katalogtabelle. Sie fügen Links zu Shopify-Websites eine pro Zeile ein - eine Shop-Domain für den ganzen Shop oder eine Kollektions-URL für einen Bereich - oder laden sie als CSV-, XLSX-, TXT- oder Parquet-Datei hoch, begrenzen die Zeilen je Abfrage und laden das Ergebnis als saubere CSV-, Excel- oder JSON-Datei herunter.

Jede Zeile ist eine kaufbare Variante: Produkt-ID, Titel, Handle und Beschreibung, Anbieter und Produkttyp, die Tags, der Preis und ein etwaiger Vorher-Preis, die SKU, ob sie verfügbar ist, und die Variantenbezeichnung selbst - daneben Veröffentlichungs-, Anlage- und Aktualisierungszeitstempel sowie die Varianten-, Bild- und Optionsdaten des Shops. Weil die Zeilen aus dem öffentlichen Produkt-Feed des Shops stammen und nicht von einer gerenderten Seite, behält der Export Shopifys eigene Struktur statt einer plattgemachten Annäherung daran.

Merchandising-Teams lesen die Verfügbarkeit auf Variantenebene, um zu sehen, welche Größen und Farben ein Shop tatsächlich abverkauft hat. Pricing-Teams filtern auf Zeilen mit Vorher-Preis und bekommen das gesamte Rabattbild eines Wettbewerbers in einem Durchgang. Strategieteams sortieren nach dem Aktualisierungszeitstempel, um zu sehen, woran ein Shop gearbeitet hat, wobei Anlage- und Veröffentlichungsdatum neue Launches von aufgefrischten Listungen trennen.

Zwei praktische Hinweise, bevor Sie einen Job planen. Eine Zeile ist eine Variante und kein Produkt, ein Katalog von ein paar hundert Produkten kann also mehrere tausend Zeilen sein - gruppieren Sie nach der Produkt-ID, wenn Sie Produkte wollen. Und die Spalten variants, images und options enthalten jeweils JSON in einer einzigen Zelle, dekodieren Sie sie also, statt an Kommas zu trennen. Starten Sie kostenlos: Ihre ersten 500 Zeilen kosten nichts und brauchen keine Kreditkarte, danach sind es pauschal 0,002 $ je Zeile.