Universeller KI-Scraper

Für die Seiten, die
keinen eigenen Scraper haben.

Fügen Sie eine beliebige Seiten-URL ein, benennen Sie die gewünschten Attribute - Preis, Beschreibung, Bewertung, was auch immer die Seite trägt - und erhalten Sie sie als Spalten zurück. Auf keinen seitenspezifischen Parser muss gewartet werden: Die Seite wird gelesen, und die Felder, nach denen Sie gefragt haben, kommen als Zeile heraus.

einmalig 500 Zeilen gratisdanach 0,002 $ pro ZeileSpalten nach Ihrer WahlCSV · XLSX · JSON
So funktioniert es

Geben Sie ihm eine Seite
und eine Liste von Feldern.

Zwei Eingaben und sonst nichts: wo geschaut werden soll und was zurückkommen soll. Das Zweite ist der Teil, der das auf einer Seite funktionieren lässt, für die niemand einen Parser geschrieben hat.

  1. SCHRITT 1Melden Sie sich auf der Plattform an.
  2. SCHRITT 2Öffnen Sie den Universellen KI-Scraper.
  3. SCHRITT 3Fügen Sie die Seiten-URLs ein, eine pro Zeile - oder laden Sie eine CSV-, XLSX-, TXT- oder Parquet-Datei hoch.
  4. SCHRITT 4Fügen Sie die Attribute hinzu, die extrahiert werden sollen. Wählen Sie aus den Vorschlägen oder tippen Sie eigene.
  5. SCHRITT 5Setzen Sie das Seitenlimit pro Abfrage - es startet bei 1, erhöhen Sie es also, sobald Sie zufrieden sind.
  6. SCHRITT 6Wählen Sie Ihr Ausgabeformat und klicken Sie auf Get Data.

Jede Seite wird über unseren Proxy-Pool geholt, niemals über Ihre echte IP, und von Claude gelesen, das die von Ihnen benannten Attribute herauszieht.

Warum Teams es nutzen

Ein Scraper für
den langen Schwanz.

Sie entscheiden über die Spalten

Die Attribute, die Sie tippen, sind das Schema. Fragen Sie nach einem Preis und einer Bewertung, bekommen Sie zwei Spalten; fügen Sie eine Beschreibung hinzu, sind es drei. Nichts hier hat eine feste Kopfzeile - genau deshalb passt es auf Seiten, die sich voneinander unterscheiden.

Kein Warten auf einen eigenen Parser

Die meisten Seiten werden nie populär genug sein, um einen eigens gebauten Scraper zu bekommen. Für die gibt es das hier: ein Lieferantenkatalog, ein Branchenverzeichnis, ein regionaler Marktplatz - alles, wo die Daten auf der Seite stehen und niemand einen Extraktor dafür pflegt.

Dasselbe Dateiformat wie alles andere

Wie immer Sie die Spalten definieren, die Ausgabe ist das gewohnte CSV, XLSX oder JSON, das der Rest der Plattform erzeugt. Sie fällt in dieselbe Pipeline wie ein Durchlauf aus einem unserer Scraper mit festem Schema.

Was Sie zurückbekommen

Es gibt keine Spaltenliste,
und genau das ist der Punkt.

Jede andere Seite dieser Website benennt einen festen Spaltensatz. Diese kann das nicht, weil Sie ihn schreiben.

Die Attribute, die Sie hinzufügen, sind die Ausgabe. Tippen Sie price und rating, und die Datei hat zwei Spalten mit diesen Namen. Der Auswahlhelfer schlägt ein paar gängige vor, um den Anfang zu machen - name, price, discount price, description, image, rating, reviews -, doch das Feld nimmt freien Text an, die Liste ist also eine Bequemlichkeit und keine Grenze. Fragen Sie nach dem, was die Seite tatsächlich trägt.

Diese Flexibilität ist das ganze Produkt, und sie hat eine offensichtliche Folge: Wir können Ihnen weder einen Beispiel-Export zeigen noch versprechen, was in einer bestimmten Zelle stehen wird, denn beides hängt von der Seite ab, auf die Sie zielen, und von den Wörtern, die Sie wählen. Benennen Sie Attribute so, wie die Seite sie selbst beschriftet, rechnen Sie mit einer leeren Zelle, wenn eine Seite etwas schlicht nicht trägt, und prüfen Sie die Formulierung an ein paar Seiten, bevor Sie sie auf eine Liste loslassen.

Ein praktischer Unterschied zum Rest der Plattform: Das Seitenlimit startet bei 1, nicht bei 100. Das ist ein sinnvoller Standard für ein Werkzeug, das Sie zuerst an einer Seite ausprobieren sollen, bedeutet aber, dass ein Durchlauf nach einer einzigen Seite endet, bis Sie es erhöhen.

Was akzeptiert wird

Jede Seite,
und die Felder, die Sie benennen.

Es gibt keine Liste unterstützter Seiten zum Abgleichen, weil es keinen Parser pro Seite gibt. Die beiden erforderlichen Eingaben sind die URLs und die Attribute, die Sie daraus haben wollen.

Beliebige Seiten-URL, eine pro Zeile Zu parsende Attribute (erforderlich) Vorschläge: name · price · description Oder eigenes Attribut tippen CSV · XLSX · TXT · Parquet-Upload Seitenlimit pro Abfrage (startet bei 1) Von Claude gelesen Niemals Ihre echte IP
Häufige Arbeitsabläufe

Drei Aufgaben, die hier
am häufigsten laufen.

Ein paar Beispiele dafür, wofür ein Scraper ohne festes Schema eigentlich da ist.

Langer Schwanz

Eine Seite ziehen, für die niemand einen Parser gebaut hat

Ein regionaler Marktplatz, ein Verbandsverzeichnis, der Katalog eines Herstellers. Die Daten stehen auf der Seite, und es gibt kein eigenes Werkzeug dafür - benennen Sie die Felder, die Sie brauchen, und nehmen Sie sie mit.

Recherche · Abdeckung
Prototyping

Eine Idee testen, bevor Sie sich festlegen

Zielen Sie mit einer groben Attributliste auf eine Handvoll Seiten und sehen Sie, ob die Daten, die Sie brauchen, überhaupt da sind. Das ist ein günstigerer erster Schritt, als einen maßgeschneiderten Extraktor für eine Quelle zu spezifizieren, die Sie noch nicht validiert haben.

Sondierung · Machbarkeit
Ungewöhnliche Formen

Das Feld holen, das der Standard-Export weglässt

Manchmal liefert ein eigener Scraper fast alles, was Sie wollen. Zielen Sie mit diesem hier auf dieselben Seiten, fragen Sie nur nach dem fehlenden Attribut und verknüpfen Sie das Ergebnis über die URL zurück.

Anreicherung · Lückenschluss
Preise

Zahlen Sie nur für die Zeilen,
die Sie tatsächlich ziehen.

Kein Abo, kein Mindestumsatz, keine wiederkehrende Rechnung. Ihre ersten 500 Zeilen gehen auf uns - danach nach Verbrauch, zum selben Pauschalpreis wie bei jedem anderen Scraper hier.

Kostenloser Tarif

500 Zeilen gratis - 0 $

Für jedes neue Konto, einmalig. Keine Kreditkarte erforderlich. Eigene Attributlisten, Datei-Upload und alle Exportformate inbegriffen.

0 $ für immer
Nach Verbrauch

0,002 $ pro Zeile, nach dem Gratiskontingent

Derselbe pauschale Satz wie im Rest der Plattform. Der Vorab-Schätzer zeigt Zeilenzahl und Guthabenkosten, bevor ein Durchlauf startet - keine überraschenden Rechnungen, keine Recheneinheiten zum Umrechnen.

Am beliebtesten
Volumen

Individuell · hohes Volumen

Mengenpreise, dedizierte Worker und ein SLA, um große Seitenlisten planmäßig laufen zu lassen. Nennen Sie uns Ihre Zahlen und wir erstellen ein Angebot.

Sprechen Sie uns an
10 % Rabatt auf Ihren ersten bezahlten Durchlauf.Verwenden Sie den Code LIVESCRAPER10 an der Kasse.
Registrieren
Nehmen Sie lieber diese, wenn sie passen

Ein eigener Scraper
schlägt einen allgemeinen.

Dieses Werkzeug gibt es für Seiten ohne eigens gebauten Extraktor. Wo einer existiert, ist er die bessere Wahl - er kennt die Eigenheiten der Seite und liefert einen dokumentierten Spaltensatz.

Das Rechtliche

Ist es legal,
jede Seite zu scrapen?

Kurze Antwort: Das hängt ganz von der Seite ab - was die ehrliche Antwort für ein Werkzeug ohne festes Ziel ist, und sie legt mehr Urteilsvermögen in Ihre Hände als unsere anderen Scraper.

Jeder andere Scraper hier zielt auf eine Seite, wir können Ihnen also sagen, was er erfasst und was die Bedingungen dieser Seite sagen. Dieser hier zielt dorthin, wohin Sie ihn schicken, diese Einschätzung können wir Ihnen also nicht abnehmen. Der Durchlauf holt die Seite so, wie es eine gewöhnliche Besucherin täte, über unseren Proxy-Pool und niemals über Ihre echte IP, und liest, was darauf steht - er meldet sich nicht an, umgeht keine Bezahlschranke und erreicht nichts, was Besuchende nicht sehen könnten. Darüber hinaus ist die Frage, ob von einer bestimmten Seite erhoben werden darf, eine Frage nach deren Bedingungen und nach Ihrem Zweck, und die zu beantworten liegt bei Ihnen, bevor Sie das Werkzeug darauf richten.

Gehen Sie bewusst mit den Attributen um, nach denen Sie fragen. Ein allgemeiner Extraktor liefert alles, was Sie benennen, auch Dinge, die personenbezogene Daten sind - den Namen einer Person, eine E-Mail-Adresse, eine Telefonnummer. Danach zu fragen macht aus einem gewöhnlichen Seitenabruf eine Verarbeitung personenbezogener Daten, und in der EU und im Vereinigten Königreich bringt das die DSGVO mit sich, mit Ihnen als Verantwortlichem: eine Rechtsgrundlage, Transparenz über die Herkunft der Daten sowie das Beachten von Widersprüchen und Löschverlangen. Das Werkzeug wird Sie nicht aufhalten; die Pflicht liegt bei Ihnen.

Wir betreiben keine Tracker Dritter auf der Datenebene, und Ihre Exporte löschen sich nach 30 Tagen automatisch. Wenn Sie sich bei einer Quelle oder einem Feld unsicher sind, holen Sie Rat ein, bevor Sie skalieren, nicht danach.

livescraper.app · Grundsätze
Holt Seiten so, wie es Besuchende täten
Keine Logins, keine Bezahlschranken, keine Konten berührt
Niemals Ihre echte IP
Exporte löschen sich automatisch (30 Tage)
Sie wählen das Ziel - und tragen dieses Urteil!
Prüfen Sie die Bedingungen der Quelle, bevor Sie skalieren.
Häufige Fragen

Was Menschen fragen,
bevor sie sich anmelden.

Die Fragen, die wir am häufigsten hören. Noch etwas? Sprechen Sie uns an - die Antworten schreiben Menschen, keine Bots.

Wie nutze ich den Universellen KI-Scraper?+
Melden Sie sich auf der Plattform an. Öffnen Sie den Universellen KI-Scraper. Fügen Sie die Seiten-URLs ein, eine pro Zeile - oder laden Sie eine CSV-, XLSX-, TXT- oder Parquet-Datei hoch. Fügen Sie die Attribute hinzu, die extrahiert werden sollen, indem Sie aus den Vorschlägen wählen oder eigene tippen. Setzen Sie das Seitenlimit pro Abfrage. Wählen Sie Ihr Ausgabeformat und klicken Sie auf Get Data.
Welche Spalten bekomme ich?+
Die, nach denen Sie fragen. Die Attribute, die Sie hinzufügen, sind das Ausgabeschema: Tippen Sie price und rating, und Ihre Datei hat zwei Spalten mit diesen Namen. Deshalb hat diese Seite kein Datenwörterbuch - anders als bei jedem anderen Scraper hier gibt es keinen festen Spaltensatz zu veröffentlichen, weil Sie ihn zur Laufzeit schreiben.
Nach welchen Attributen kann ich fragen?+
Nach allem, was die Seite trägt. Der Auswahlhelfer schlägt name, price, discount price, description, image, rating und reviews vor, um den Anfang zu machen, doch das Feld nimmt freien Text an - das sind also eine Bequemlichkeit und keine Grenze. Benennen Sie Attribute so, wie die Seite sie selbst beschriftet, und Sie bekommen bessere Ergebnisse als mit einem abstrakten Begriff.
Was passiert, wenn eine Seite das Attribut nicht hat, nach dem ich gefragt habe?+
Rechnen Sie mit einer leeren Zelle für diese Zeile. Das Werkzeug liest, was auf der Seite steht - es sucht nicht anderswo und leitet keinen Wert her, der nicht da ist. Das lohnt sich zu merken, wenn Sie eine Attributliste auf eine Liste von Seiten richten, die nicht alle dieselbe Form haben.
Welche Seiten werden unterstützt?+
Es gibt keine Liste unterstützter Seiten, weil es keinen Parser pro Seite gibt. Genau darum geht es: Das Werkzeug ist für den langen Schwanz an Seiten gebaut, die nie einen eigenen Scraper bekommen werden. Wo ein eigener existiert - Google Maps, Amazon und der Rest unseres Katalogs -, ist der die berechenbarere Wahl.
Warum startet das Seitenlimit bei 1?+
Weil das ein Werkzeug ist, das Sie zuerst an einer einzigen Seite ausprobieren sollen, hält der Standard einen ersten Durchlauf klein und günstig. Es bedeutet allerdings, dass ein Durchlauf nach einer Seite endet, bis Sie es erhöhen - was Leute überrascht, die von unseren anderen Scrapern den Standard 100 gewohnt sind.
Kann ich der Extraktion trauen, ohne sie zu prüfen?+
Prüfen Sie sie. Wir haben dafür nie eine Genauigkeitszahl veröffentlicht und werden auch keine erfinden - wie gut es funktioniert, hängt von der Seite ab und davon, wie Sie die Attribute formulieren. Lassen Sie es über zwei, drei repräsentative Seiten laufen, lesen Sie die Ausgabe neben der Seite, passen Sie die Formulierung an, und richten Sie es erst dann auf eine lange Liste. Das sind fünf Minuten, die einen schlechten Datensatz ersparen.
Was kostet das?+
Die ersten 500 Zeilen sind kostenlos und einmalig, ohne Kreditkarte. Danach sind es 0,002 $ je Zeile - derselbe Pauschalpreis wie bei jedem anderen Scraper der Plattform. Der Schätzer zeigt die Kosten eines Durchlaufs, bevor er startet.

Die Seite, die Sie brauchen,
hat keinen Scraper. Kein Problem.

Ihre ersten 500 Zeilen sind gratis - ohne Karte, ohne Abo. Danach sind es pauschal 0,002 $ pro Zeile.

Sofort aktiviert · keine Karte erforderlich

Jede Seite mit eigenem Schema scrapen

Die meisten Scraping-Werkzeuge werden Seite für Seite gebaut. Jemand studiert das Markup einer Seite, schreibt einen Extraktor und veröffentlicht einen festen Spaltensatz - was für die Handvoll Seiten wunderbar funktioniert, die groß genug sind, um den Aufwand zu rechtfertigen, und für alles andere überhaupt nicht. Der Universelle KI-Scraper ist für alles andere. Sie geben ihm Seiten-URLs und eine Liste der gewünschten Attribute, jede Seite wird über unseren Proxy-Pool geholt und von Claude gelesen, und die von Ihnen benannten Attribute kommen als Spalten einer gewöhnlichen CSV-, XLSX- oder JSON-Datei zurück.

Deshalb hat diese Seite kein Datenwörterbuch. Jede andere Produktseite hier veröffentlicht eine feste Kopfzeile; diese kann das nicht, weil Sie das Schema zur Laufzeit schreiben. Tippen Sie price und rating, und Ihre Datei hat zwei Spalten mit diesen Namen. Der Auswahlhelfer schlägt eine Handvoll gängiger Attribute vor - name, price, discount price, description, image, rating, reviews -, doch das Feld nimmt freien Text an: Fragen Sie nach dem, was die Seite tatsächlich trägt.

Die Flexibilität hat einen Preis, den man klar sagen sollte. Weil sowohl das Ziel als auch das Schema Ihnen gehören, können wir Ihnen weder einen Beispiel-Export zeigen noch versprechen, was in einer bestimmten Zelle steht, und wir veröffentlichen keine Genauigkeitszahl. Der praktische Rat ist derselbe, den man einer Kollegin geben würde: Benennen Sie Attribute so, wie die Seite sie beschriftet, rechnen Sie mit einer leeren Zelle, wo eine Seite schlicht nicht trägt, wonach Sie gefragt haben, und validieren Sie die Formulierung an zwei, drei repräsentativen Seiten, bevor Sie sie auf eine lange Liste richten. Beachten Sie außerdem, dass das Seitenlimit bei 1 startet statt bei den 100, die unsere anderen Scraper vorgeben.

Wo für Ihre Quelle bereits ein eigener Scraper existiert, nehmen Sie ihn - er kennt die Eigenheiten dieser Seite und liefert einen dokumentierten Spaltensatz. Dieser hier verdient seinen Platz auf den Seiten, für die niemand einen Parser gebaut hat und wohl auch nie bauen wird. Starten Sie kostenlos: Ihre ersten 500 Zeilen kosten nichts und brauchen keine Kreditkarte, danach sind es pauschal 0,002 $ pro Zeile.