KI-Scraper

Beschreiben Sie die Daten.
Erhalten Sie die Spalten.

Fügen Sie beliebige Seiten-URLs ein, eine pro Zeile, und sagen Sie dann, was Sie daraus haben möchten - entweder als Satz im Feld Prompt oder als Schema, das Sie Feld für Feld bauen. Claude liest jede Seite und liefert, was Sie verlangt haben. Die Felder, die Sie benennen, sind die Spalten; es gibt keinen Parser pro Website und kein festes Schema, um das man herumarbeiten müsste.

einmalig 500 Gratiszeilendanach 0,002 $ pro ZeileSie definieren die SpaltenCSV · JSON · Excel
So funktioniert es

Eine Liste von URLs
und eine Beschreibung.

Zwei Pflichteingaben, und die zweite können Sie in der Form geben, die Ihnen passt.

  1. SCHRITT 1Melden Sie sich auf der Plattform an.
  2. SCHRITT 2Öffnen Sie den KI-Scraper.
  3. SCHRITT 3Fügen Sie beliebige Seiten-URLs ein, eine pro Zeile - oder laden Sie eine CSV-, XLSX-, TXT- oder Parquet-Datei hoch.
  4. SCHRITT 4Sagen Sie, was Sie möchten. Entweder schreiben Sie es in das Feld Prompt - beschreiben Sie, welche Daten Sie extrahieren möchten - oder wechseln Sie zu Schema und fügen Sie Felder einzeln hinzu, jedes mit Name, Typ und einer optionalen Pflichtmarkierung.
  5. SCHRITT 5Setzen Sie bei Bedarf ein Zeilenlimit pro URL. Leer gelassen holt es alles.
  6. SCHRITT 6Klicken Sie auf Get Data und laden Sie als CSV, JSON oder Excel herunter.

Sie brauchen eines von beiden, nicht beide: Das Formular hält Sie nur auf, wenn der Prompt leer ist und kein Schemafeld definiert wurde. Schreiben Sie beides, geben Sie dem Modell die Anweisung und die Form.

Warum Teams es nutzen

Das Schema ist
das Ergebnis.

Feld eintippen, Spalte bekommen

Fügen Sie ein Feld namens price hinzu, und die Datei hat eine Spalte namens price. Es gibt keinen Zuordnungsschritt und keine Liste unterstützter Websites, weil hier nichts pro Website geschrieben ist. Genau deshalb lohnt es sich für die Seiten, die kein spezialisierter Scraper abdeckt - der Katalog eines Lieferanten, die Bekanntmachungen einer Behörde, das Changelog eines Mitbewerbers.

Ein Satz oder ein typisiertes Schema

Das Feld Prompt nimmt einfache Beschreibung und ist der schnellste Weg, etwas auszuprobieren. Den Schema-Builder nehmen Sie, wenn die Ausgabe vorhersagbar sein muss: Jedes Feld trägt einen Typ - String, Number, Boolean, Array oder Object - und kann als Pflichtfeld markiert werden. Ein JSON-Tab zeigt dasselbe Schema als JSON Schema, sodass Sie ein vorhandenes einfügen können.

Ihre Eingabe reist mit der Ausgabe

Wenn der Export eine Spalte query trägt, steht sie an erster Stelle, sodass jede Zeile sagt, welche URL sie erzeugt hat, und eine Datei über fünfzig Seiten gruppierbar bleibt. Ein leises Detail, das man kennen sollte: Ein interner Schlüssel position wird bewusst von den zusammengestellten Spalten ausgeschlossen und erscheint daher weder in der Tabelle noch in den Downloads.

Was Sie zurückbekommen

Es gibt keine Spaltenliste,
denn Sie schreiben sie.

Jede andere Produktseite hier nennt einen festen Satz von Spalten. Diese kann es nicht, und der Grund ist strukturell und kein Versäumnis.

Die Felder, die Sie beschreiben, sind die Datei. Dieser Dienst hat nirgends ein deklariertes Spalten-Array. Die Spaltenliste wird nach dem Lauf zusammengestellt, aus den Schlüsseln, die tatsächlich zurückkamen: query zuerst, wenn vorhanden, dann jeder weitere Schlüssel in der Reihenfolge, in der er zuerst gesehen wurde. Verlangen Sie sku, price und in_stock, dann sind das Ihre Spalten, in dieser Reihenfolge. Verlangen Sie etwas, das die Seite nicht führt, sollten Sie eine leere Zelle erwarten statt einer Erfindung - prüfen Sie das aber in Ihrem eigenen ersten Lauf, statt es einer Marketingseite zu glauben.

Prompt oder Schema ist eine echte Wahl, nicht zwei Wörter für dasselbe. Ein Prompt ist schneller und nachsichtiger und das richtige Werkzeug, solange Sie noch herausfinden, was eine Seite überhaupt enthält. Ein Schema wollen Sie in dem Moment, in dem die Ausgabe irgendetwas weiter unten speist: Die Felder und ihre Typen zu benennen ist die Art, wie Sie verhindern, dass die Form zwischen zwei Läufen driftet, und ein Feld als Pflicht zu markieren ist die Art zu sagen, dass es zählt. Builder und JSON-Ansicht sind dasselbe Schema, Sie können also klickend anfangen und einfügend aufhören.

Zwei praktische Unterschiede zum Rest der Plattform. Das Limit zählt hier Zeilen pro URL statt Seiten, und es ist standardmäßig leer, was alle bedeutet - das Gegenteil eines Werkzeugs, das nach einer Seite stoppt, wenn Sie nichts anderes sagen. Und jede Seite wird über den Proxy-Pool geholt statt von Ihrer eigenen Adresse: Ist eine bezahlte PROXY_URL oder PROXY_LIST konfiguriert, wird sie genutzt, sonst der kostenlose Pool - und in keinem Fall Ihre echte IP.

Was diese Seite Ihnen nicht sagt, ist, wie gut eine bestimmte Extraktion ausfällt. Wir haben keinen gefüllten Export dieses Dienstes, den wir beschreiben könnten, und die Qualität hängt hier von der Seite ab, auf die Sie zeigen, und von den Worten, die Sie wählen - es gibt also keine Genauigkeitszahl, keine Beispieldatei und kein Versprechen über eine bestimmte Zelle. Investieren Sie ein paar Gratiszeilen in eine Seite, lesen Sie die Spalten, und erweitern Sie dann die Liste.

Häufige Abläufe

Drei Aufgaben, für die
Menschen hierher greifen.

Alle betreffen Seiten, die kein spezialisierter Scraper abdeckt.

Long Tail

Die Website, für die niemand einen Parser gebaut hat

Die meiste Scraping-Arbeit betrifft nicht Amazon oder LinkedIn - sondern einen Fachgroßhändler, die Mitgliederliste eines Branchenverbands, das Lizenzregister einer Behörde. Richten Sie das auf solche Seiten, benennen Sie die vier Felder, die Sie wirklich brauchen, und Sie erhalten eine Tabelle, ohne dass jemand einen Parser für eine Website schreibt, die Sie zweimal nutzen werden.

Recherche · Betrieb
Prototyp

Das Schema erarbeiten, bevor Sie sich darauf festlegen

Beginnen Sie im Feld Prompt mit einer Handvoll Seiten, sehen Sie, was zurückkommt, und überführen Sie dann die Felder, die sich als nützlich erwiesen haben, in den Schema-Builder und geben Sie ihnen Typen. Dieser Weg - locker beschreiben, dann festzurren - ist der Grund, warum es beide Eingaben gibt.

Data · Engineering
Monitoring

Dieselben Felder aus Seiten ziehen, die sich ständig ändern

Eine Preisseite, eine AGB-Seite, eine Statusseite: Der Wortlaut wandert, das Markup wandert, und ein selektorbasierter Scraper bricht an beidem. Das Feld statt seiner Position zu beschreiben ist das, was ein Redesign überlebt, und macht dies zu einer vernünftigen Wahl für etwas, das Sie wiederholt laufen lassen wollen.

Wettbewerb · Compliance
Preise

Zahlen Sie pro Zeile,
sonst nichts.

Kein Abonnement, kein Mindestumsatz, keine Lizenz pro Person. Ihre ersten 500 Zeilen gehen auf uns - danach zahlen Sie nach Verbrauch.

Gratis-Tarif

500 Gratiszeilen - 0 $

Für jedes neue Konto, einmalig. Keine Kreditkarte. Alle Scraper freigeschaltet. Gerade bei diesem Dienst gehören Sie zuerst in den Gratis-Tarif: Es kostet nichts herauszufinden, ob Ihr Prompt oder Ihr Schema das zurückgibt, was Sie gemeint haben.

0 $ für immer
Nach Verbrauch

0,002 $ pro Zeile, nach dem Gratis-Tarif

Rund 2 $ pro 1.000 Zeilen, derselbe Pauschalpreis wie bei jedem anderen Scraper der Plattform - eine KI-gestützte Extraktion wird nicht anders abgerechnet als eine mit festem Schema. Das Limit zählt Zeilen pro URL und steht standardmäßig auf alle, es lohnt sich also, eine Zahl zu setzen, solange Sie noch Formulierungen testen.

Am beliebtesten
Enterprise

Individuell - viele Websites, nach Zeitplan

Mengenpreise, SLAs, dedizierte Worker und maßgeschneidertes Onboarding für Teams, die das über eine lange Liste von Quellen statt über eine Handvoll Seiten laufen lassen. Nennen Sie uns Ihre Zahlen, und wir erstellen ein Angebot.

Sprechen Sie uns an
10 % Rabatt auf Ihren ersten bezahlten Lauf.Verwenden Sie den Code LIVESCRAPER10 an der Kasse.
Registrieren
Passt gut zu

Wenn ein festes Schema
Ihnen besser dient.

Felder zu beschreiben ist das richtige Werkzeug für Seiten, die niemand geparst hat. Wo es einen spezialisierten Scraper gibt, nehmen Sie ihn - die Spalten sind dort schon bekannt.

Das Rechtliche

Ist es legal,
mit KI zu extrahieren?

Kurze Antwort: Es gelten die Regeln, die für Scraping ohnehin galten - dass ein Modell die Seite liest, ändert nichts daran, was Sie erheben dürfen.

Öffentlich sichtbare Informationen für Recherche und Analyse zu sammeln, ist seit Langem gefestigte Praxis, und genau das passiert hier: Die Seite wird so abgerufen, wie sie auch gewöhnliche Besucherinnen und Besucher sehen, und ein Modell liest sie. Solange die Daten öffentlich verfügbar sind und der Vorgang den Dienst nicht stört, gibt es keine Bundesgesetze dagegen. Was das Modell nicht tut, ist Sie an irgendetwas vorbeizubringen - nichts hinter einem Login, einer Bezahlschranke oder einer Einwilligungsabfrage fällt in den Rahmen.

Dieser Dienst ist offener als der Rest der Plattform, und das legt die Verantwortung für den Umfang zu der Person, die den Prompt schreibt. Ein Schema, das nach Namen, E-Mail-Adressen oder anderem Personenbezogenen fragt, bedeutet, dass Sie personenbezogene Daten verarbeiten, und die DSGVO und ähnliche Regelwerke gelten für Sie, ganz gleich woher Sie sie haben. Fragen Sie nach dem, was Ihr Zweck tatsächlich braucht; ein Feld, das Sie nicht begründen können, ist ein Risiko und kein Bonus.

Die Nutzungsbedingungen jeder Website gelten weiterhin, und sie unterscheiden sich - prüfen Sie sie für die Seiten, die Sie laufen lassen wollen. Wir berühren nichts hinter einem Login, lesen nur, was gewöhnliche Besucherinnen und Besucher sehen, betreiben keine Tracker Dritter auf der Datenebene, und Ihre Exporte löschen sich nach 30 Tagen selbst.

livescraper.app · grundsätze
Nur öffentliche Seiten
Keine Logins, keine Bezahlschranken
Sie wählen die Felder - fragen Sie nur nach dem, was Sie begründen können!
DSGVO-konform von Haus aus
Exporte löschen sich selbst (30 Tage)
Über den Proxy-Pool geholt, nie über Ihre echte IP.
Häufige Fragen

Was Menschen vor der Registrierung fragen.

Die Fragen, die wir am häufigsten hören. Noch etwas? Sprechen Sie uns an - die Antworten schreiben Menschen, keine Bots.

Welche Spalten wird der Export enthalten?+
Die, nach denen Sie gefragt haben. Dieser Dienst hat nirgends einen festen Spaltensatz - die Liste wird nach dem Lauf aus den zurückgekommenen Schlüsseln zusammengestellt, mit query an erster Stelle, wenn vorhanden, und jedem weiteren Schlüssel in der Reihenfolge, in der er zuerst gesehen wurde. Deshalb hat diese Seite kein Datenlexikon: Es gibt nichts Festes zu tabellieren.
Schreibe ich einen Prompt oder baue ich ein Schema?+
Beides möglich, und Sie brauchen eines davon. Ein Prompt ist ein Satz, der beschreibt, was extrahiert werden soll, und der schnellste Weg, etwas auszuprobieren. Ein Schema ist eine Liste von Feldern, die Sie einzeln hinzufügen, jedes mit Name und Typ, optional als Pflicht markiert - nehmen Sie es, wenn die Ausgabe über Läufe hinweg dieselbe Form behalten muss. Das Formular hält Sie nur auf, wenn der Prompt leer ist und kein Schemafeld definiert wurde.
Welche Feldtypen kann ein Schema verwenden?+
Fünf: String, Number, Boolean, Array und Object. Jedes Feld hat außerdem einen Pflicht-Schalter. Ein JSON-Tab zeigt dasselbe als JSON Schema, sodass Sie ein vorhandenes Schema einfügen können - es braucht ein properties-Objekt mit mindestens einem Eintrag, und ungültiges JSON wird abgelehnt statt stillschweigend ignoriert.
Gibt es eine Liste unterstützter Websites?+
Nein, und das ist der Sinn dieses Dienstes. Hier ist nichts pro Website geschrieben, jede Seite, die Sie im Browser öffnen können, kommt also in Frage. Wo es für eine Website einen spezialisierten Scraper auf dieser Plattform gibt, ziehen Sie ihn vor - der liefert einen dokumentierten Spaltensatz statt eines, den Sie beschreiben müssen.
Was macht das Limit-Feld?+
Es begrenzt, wie viele Zeilen pro URL zurückkommen, und es ist standardmäßig leer, was alle bedeutet. Beachten Sie, dass es Zeilen zählt und nicht Seiten - das Limit des Universal AI Scraper zählt stattdessen Seiten pro Anfrage, die beiden sind also nicht austauschbar.
Worin unterscheidet sich das vom Universal AI Scraper?+
Andere Eingaben und ein anderes Limit. Dieser nimmt einen freien Prompt oder ein typisiertes Schema und begrenzt Zeilen pro URL. Der Universal AI Scraper nimmt eine Liste von Attributen, die Sie wählen oder eintippen, und begrenzt Seiten pro Anfrage. Nehmen Sie jenen, wenn eine Handvoll Attributnamen alles sagt; nehmen Sie diesen, wenn Sie Typen, Pflichtfelder oder einen Satz wollen.
Brauche ich einen Proxy?+
Sie müssen keinen einrichten. Jede Seite wird über den Proxy-Pool geholt: Ist eine bezahlte PROXY_URL oder PROXY_LIST gesetzt, wird sie genutzt, sonst der kostenlose Pool. In beiden Fällen kommt die Anfrage nicht von Ihrer echten IP.
Wie genau ist die Extraktion?+
Wir veröffentlichen keine Zahl und erklären lieber, warum, als eine zu erfinden. Die Qualität hängt von der Seite ab, auf die Sie zeigen, und davon, wie Sie das Feld formulieren, eine einzelne Zahl wäre über beides hinweg also bedeutungslos. Genau dafür gibt es den Gratis-Tarif - lassen Sie eine Seite laufen, lesen Sie die Spalten, passen Sie die Formulierung an, und erweitern Sie dann die Liste.
Was kostet das?+
Die ersten 500 Zeilen auf einem neuen Konto sind kostenlos und einmalig; danach sind es 0,002 $ pro Zeile - etwa 2 $ pro 1.000 - nach Verbrauch, ohne Abonnement. Es ist derselbe Pauschalpreis wie bei jedem anderen Scraper hier. Guthaben verfällt nicht, und es gibt keinen monatlichen Reset.

Benennen Sie die Felder.
Lesen Sie die Datei.

Fügen Sie eine URL ein, beschreiben Sie in einem Satz oder als Schema, was Sie möchten, und sehen Sie, was zurückkommt. Ihre ersten 500 Zeilen sind gratis.

Sofort aktiv · keine Karte nötig

Beliebige Seiten in die Spalten verwandeln, nach denen Sie gefragt haben

Die meisten Scraping-Werkzeuge beginnen mit einer Website und reichen Ihnen deren Schema. Dieses beginnt mit einem Schema und lässt Sie es auf eine Website richten. Fügen Sie beliebige Seiten-URLs ein, eine pro Zeile, beschreiben Sie, was Sie möchten - als Satz im Feld Prompt oder als Satz von Feldern im Schema-Builder - und jede Seite wird abgerufen und von Claude gelesen, das die von Ihnen benannten Felder zurückgibt. Es gibt hier keinen Parser pro Website, also auch keine Liste unterstützter Websites, an der Sie sich messen müssten.

Die beiden Arten zu fragen sind wirklich unterschiedliche Werkzeuge. Ein Prompt ist locker und schnell und das, was Sie wollen, solange Sie noch herausfinden, was eine Seite führt. Ein Schema zurrt die Ausgabe fest: Jedes Feld hat einen Namen und einen Typ - String, Number, Boolean, Array oder Object - und kann als Pflicht markiert werden, und genau so halten Sie die Form über wiederholte Läufe stabil. Builder und JSON-Ansicht sind dasselbe Schema in zwei Formen, ein vorhandenes Schema lässt sich also einfügen und ein zusammengeklicktes herauskopieren. Sie brauchen eines von beiden; beides zu geben, sagt dem Modell schlicht die Anweisung und die Form.

Weil Sie die Felder definieren, hat die Datei keine feste Spaltenliste, und diese Seite hat daher kein Datenlexikon. Die Spalten werden nach dem Lauf aus den tatsächlich zurückgekommenen Schlüsseln zusammengestellt - query zuerst, wenn vorhanden, sodass jede Zeile festhält, welche URL sie erzeugt hat, dann alles Weitere in der Reihenfolge des ersten Auftretens. Ein interner Schlüssel position ist von dieser Liste ausgeschlossen und taucht daher weder in der Tabelle noch in den Downloads auf. Zwei kleinere Unterschiede zum Rest der Plattform sollte man kennen: Das Limit zählt Zeilen pro URL statt Seiten und ist standardmäßig leer, also alle; und Seiten werden über den Proxy-Pool geholt - eine bezahlte PROXY_URL oder PROXY_LIST, falls konfiguriert, sonst der kostenlose Pool, und nie Ihre eigene Adresse.

Was diese Seite bewusst nicht tut, ist Ihnen zu sagen, wie gut die Extraktion ist. Die Qualität hängt von der Seite und von Ihrer Formulierung ab, was jede einzelne Genauigkeitszahl in beide Richtungen irreführend macht, und wir sagen das lieber, als eine Zahl zu veröffentlichen, für die wir nicht geradestehen können. Der ehrliche Rat ist der günstige: Lassen Sie eine einzelne Seite im Gratis-Tarif laufen, lesen Sie die zurückgekommenen Spalten, passen Sie die Feldnamen oder den Satz an, und richten Sie es erst dann auf eine Liste. Ihre ersten 500 Zeilen kosten nichts und brauchen keine Kreditkarte. Siehe Preise für aktuelle Tarife.