Reddit Such-Scraper

Reddit durchsuchen,
die Ergebnisse behalten.

Geben Sie einen Suchbegriff ein - oder fügen Sie eine reddit.com/search/?q=…-URL ein - und die Beiträge kommen als Tabelle zurück: der Titel, in welchem Subreddit er stand, wer ihn gepostet hat, sein Score, wie viele Kommentare er hat, wann er gepostet wurde, und ein Link. Neun Spalten, eine Zeile pro Beitrag, sortiert wie Sie wählen.

einmalig 500 Zeilen gratisdanach 0,002 $ pro Zeileeine Zeile pro BeitragCSV · JSON · Excel
So funktioniert es

Eine Suche,
und eine Sortierung.

Ein Pflichtfeld und zwei Steuerelemente. Die Sortierung entscheidet, welchen Ausschnitt von Reddit Sie bezahlen.

  1. SCHRITT 1Melden Sie sich auf der Plattform an.
  2. SCHRITT 2Öffnen Sie den Reddit Such-Scraper.
  3. SCHRITT 3Geben Sie Suchbegriffe ein, einen pro Zeile - oder fügen Sie reddit.com/search/?q=…-URLs ein oder laden Sie eine CSV-, XLSX-, TXT- oder Parquet-Datei hoch.
  4. SCHRITT 4Setzen Sie bei Bedarf ein Limit pro Anfrage. Das Feld nimmt mindestens 1 und steht standardmäßig auf 100.
  5. SCHRITT 5Wählen Sie eine Sortierung: Relevance, Hot, Top, New oder Comment count.
  6. SCHRITT 6Klicken Sie auf Get Data und laden Sie als CSV, JSON oder Excel herunter.

Das Limit gilt pro Anfrage, nicht pro Durchlauf: fünf Suchbegriffe mit einem Limit von hundert ergeben hundert Beiträge von jedem, nicht hundert insgesamt.

Warum es nützlich ist

Fünf Sortierungen,
und eine, die man selten bekommt.

Eine im Browser gelesene Suche ist das, was Reddit Ihnen zeigen wollte. Ein sortierter Export ist eine Stichprobe, die Sie gewählt haben.

Nach Kommentarzahl sortieren, nicht nur nach Score

Comment count ist die Sortierung, die Diskussionen findet. Ein Beitrag mit mäßigem Score und Hunderten Kommentaren ist ein Thread, in dem man sich uneinig war - und genau dort stecken meist die brauchbaren Details zu einem Produkt oder einer Entscheidung. Top fördert das nicht zutage.

Das Subreddit kommt als eigene Spalte

Dass subreddit vom title getrennt ist, macht eine seitenweite Suche erst nützlich. Eine Anfrage liefert Beiträge von überall dort, wo sie geschrieben wurden, und Sie können hinterher nach Community gruppieren, statt je Subreddit eine eigene Suche zu starten.

Zwei Wege, dasselbe zu fragen

Ein schlichter Suchbegriff und eine reddit.com/search/?q=…-URL funktionieren beide, im selben Feld. Wenn Sie eine Suche bereits im Browser zusammengebaut haben - mit welchen Filtern auch immer Sie sie ergänzt haben -, können Sie sie einfügen, statt sie nachzubauen.

Das zuerst lesen

Was comments ist
und was nicht.

Ein Spaltenname auf dieser Seite wird zuverlässig falsch verstanden, und es lohnt sich, dreißig Sekunden darauf zu verwenden, nicht am Falschen entlang zu planen.

Die Spalte comments ist eine Zahl: wie viele Kommentare ein Beitrag hat. Sie enthält nicht die Kommentare selbst. In diesem Export steht nirgends Kommentartext, und es gibt keine Möglichkeit, ihn erscheinen zu lassen - die neun Spalten sind das ganze Schema. Wenn Sie wissen wollen, was die Leute tatsächlich geschrieben haben, ist das ein anderer Dienst auf dieser Plattform mit eigenem Schema, und dieser hier wird es Ihnen nicht liefern, egal wie Sie sortieren.

Der Irrtum liegt nahe, weil das Steuerelement für die Sortierung dasselbe Wort verwendet: Comment count zu wählen sendet den Wert comments. Sortierung und Spalte hängen zusammen - die eine ordnet nach der anderen -, aber keine von beiden ist Kommentartext. Denken Sie an diesen Dienst als ein Verzeichnis von Threads und an den Kommentar-Dienst als das, was darin steht.

Für das Auffinden lesenswerter Threads ist die Zahl allerdings genau das Richtige. Nach Comment count zu sortieren fördert Beiträge zutage, auf die viele geantwortet haben, und das ist ein anderes und oft besseres Signal als Top: Ein hoher Score heißt, man stimmte dem Beitrag zu, eine hohe Kommentarzahl heißt, man hatte etwas zu sagen. Für Produktrecherche, Beschwerden und Vergleiche ist meist das Zweite das Nützlichere.

Eine Einschränkung gehört hierher und nicht ganz nach unten. Wir haben drei Exporte für diesen Dienst vorliegen, und keiner davon enthält einen Beitrag - jede Inhaltsspalte war auf allen vier Zeilen leer. Erwähnenswert ist das vor allem deshalb, weil die Durchläufe nicht danebengingen: Es wurden echte Anfragen eingereicht, in beiden Formen, nach denen das Formular fragt, und sie kamen trotzdem mit nur query und status befüllt zurück. Die Spaltennamen unten sind also verlässlich und nichts jenseits davon. Lassen Sie eine Suche auf der kostenlosen Stufe laufen und lesen Sie die Kopfzeile, bevor Sie darauf etwas aufbauen.

Was Sie bekommen

Neun Spalten,
und Namen, die wir belegen können.

Diese Namen sind doppelt bestätigt: Sie sind die Spaltenliste, die der Dienst selbst deklariert, und sie sind die Kopfzeile jedes Exports, den wir vorliegen haben. Wofür jede Spalte da ist, steht unten. Was jede enthalten wird, nicht - der Hinweis erklärt, warum.

query
Der Suchbegriff oder die Such-URL, aus der diese Zeile stammt, wiedergegeben. Der Scraper schreibt sie, sie steht also selbst dann auf der Zeile, wenn die Anfrage fehlschlug - gruppieren Sie danach, sobald eine Datei mehr als eine Suche umfasst.
title
Der Titel des Beitrags, so wie ihn die Person geschrieben hat, die ihn gepostet hat.
subreddit
Die Community, in der der Beitrag steht. Eine eigene Spalte, sodass Sie eine seitenweite Suche danach gruppieren können, woher die Beiträge kamen.
author
Der Reddit-Benutzername, dem der Beitrag zugeschrieben wird. Siehe den rechtlichen Hinweis unten - ein Benutzername ist pseudonym, nicht anonym.
score
Der Score des Beitrags. Reddits Score ist Up-Votes minus Down-Votes und keine reine Zahl der Upvotes, er kann also auch bei einem Beitrag niedrig sein, den viele gesehen haben.
comments
Wie viele Kommentare der Beitrag hat - eine Anzahl, nicht die Kommentare. In diesem Export steht kein Kommentartext. Lesen Sie den Hinweis oben; den Text liefert ein eigener Dienst mit eigenem Schema.
created
Wann der Beitrag verfasst wurde, so wie der Export es angibt.
url
Ein Link zum Beitrag.
status
Was mit dieser Anfrage geschah - diese zuerst lesen. Weil eine fehlgeschlagene Anfrage als ausgewiesene Zeile zurückkommt statt zu verschwinden, sehen Sie genau, welche Anfrage nicht funktioniert hat. Eine Zeile kann mit allen neun Feldern ankommen und trotzdem eine Fehlermeldung statt eines Beitrags sein.

Die Namen sind belastbar; alles jenseits davon ist Aufgabe Ihres ersten Durchlaufs. Wir haben drei Exporte für diesen Dienst vorliegen, und keiner davon enthält einen Beitrag. Jede Inhaltsspalte - title, subreddit, author, score, comments, created, url - war auf allen vier Zeilen leer; nur query und status trugen überhaupt etwas. Warum das hier besonders zählt, sei genau gesagt: die Anfragen waren echt. Sowohl ein schlichter Suchbegriff als auch eine reddit.com/search/?q=…-URL wurden eingereicht, genau die beiden Formen, nach denen das Formular fragt, und die Zeilen kamen trotzdem ohne Beitrag zurück. Diese Durchläufe bestätigen also die Form des Exports und sagen Ihnen überhaupt nichts über seine Inhalte. Was sie bestätigen, ist die Spaltenliste: Die Kopfzeile ist über alle drei Exporte identisch und entspricht exakt dem deklarierten Satz des Dienstes. Alles andere - wie ein Score aussieht, in welchem Format ein Datum ankommt, ob comments eine Zahl oder eine Zeichenkette ist - fehlt bewusst, statt geraten zu werden. Das Formular weist außerdem darauf hin, dass Seiten mit Bot-Schutz auf dem kostenlosen Pool einen blockierten Status liefern, der residential-only ist; das ist der eigene Hinweis der Plattform zur gemeinsamen Pipeline und einplanenswert. Lassen Sie die kostenlose Stufe über eine Suche laufen und lesen Sie die Kopfzeile und die ersten Werte, bevor Sie darauf bauen.

Anwendungsfälle

Drei Aufgaben, für die
man ihn einsetzt.

Alle beginnen mit etwas, das Sie in Reddits eigenes Suchfeld tippen würden.

Recherche

Herausfinden, wo über ein Thema tatsächlich gesprochen wird

Suchen Sie ein Produkt, ein Unternehmen oder ein Problem seitenweit und behalten Sie subreddit. Zurück kommt eine Karte davon, welche Communities sich dafür interessieren - das ist meist nützlicher als jeder einzelne Thread, und es ist genau das, was eine Suche im Browser einen mühsam zusammenscrollen lässt.

Recherche · Strategie
Beobachtung

Dieselbe Suche nach Zeitplan wiederholen

Dieselben Begriffe wöchentlich ausgeführt ergeben zwei vergleichbare Dateien. Neue Beiträge, Bewegung im score und steigende comments-Zahlen sind ein Diff statt eines Nachmittags voller Scrollen - und query hält jede Zeile an der Suche fest, aus der sie stammt.

Marke · Social Listening
Triage

Die lesenswerten Threads vorauswählen

Sortieren Sie nach Comment count, nehmen Sie den Anfang der Datei, und Sie haben die Threads, in denen diskutiert wurde, statt derer, in denen man sich einig war. Das ist die Auswahl zum Selberlesen - und die Eingabeliste für den Kommentar-Dienst, wenn Sie wissen wollen, was gesagt wurde.

Produkt · Support
Preise

Zahlen Sie pro Beitragszeile,
sonst nichts.

Kein Abo, kein Mindestumsatz, keine Lizenz pro Arbeitsplatz. Ihre ersten 500 Zeilen gehen auf uns - danach zahlen Sie nach Verbrauch.

Kostenlos

500 Zeilen

Für jedes neue Konto, einmalig. Keine Kreditkarte. Alle Scraper freigeschaltet. Da kein Durchlauf, den wir vorliegen haben, einen Beitrag geliefert hat, ist das hier der wichtigste Teil: Verwenden Sie ein paar Zeilen darauf, festzustellen, was dieser Export tatsächlich enthält, bevor Sie darauf planen.

Einmalig · Keine Karte
Nach Verbrauch

0,002 $ je Zeile

Etwa 2 $ je 1.000 Beiträge, derselbe pauschale Satz wie bei jedem anderen Scraper auf der Plattform. Das Limit gilt pro Anfrage, zehn Suchbegriffe mit einem Limit von hundert sind also tausend Zeilen - die Rechnung lohnt sich vorab.

Guthaben verfällt nie
Enterprise

Individuell - ganze Themen, nach Zeitplan

Mengenpreise, SLAs, dedizierte Worker und maßgeschneidertes Onboarding für Teams, die ein Thema über Communities hinweg verfolgen, statt gelegentlich eine Suche zu starten. Nennen Sie uns Ihre Zahlen, und wir machen ein Angebot.

Vertrieb kontaktieren
10 % Rabatt auf Ihren ersten kostenpflichtigen Lauf.Verwenden Sie den Code LIVESCRAPER10 an der Kasse.
Registrieren
Passt gut zu

Dieselbe Frage,
woanders.

Reddit ist ein Ort, an dem Menschen reden. Diese lesen die anderen, jeder mit eigenem Schema.

Rechtliches

Ist es legal,
Reddit-Suchergebnisse zu scrapen?

Kurze Antwort: Das sind öffentliche Beiträge auf einer öffentlichen Suchseite - aber ein Benutzername ist ein Mensch, und Reddits Bedingungen regeln den automatisierten Zugriff.

Alles in diesen Spalten wird jedem Besucher auf einer öffentlichen Suchergebnisseite gezeigt, angemeldet oder nicht. Es wird kein Login verwendet, keine Bezahlschranke überwunden und kein Konto angefasst, und der Durchlauf geht über unseren Proxy-Pool statt über Ihre eigene Adresse. Öffentlich sichtbare Informationen für Recherche zu erheben, ist seit Langem gängige Praxis.

Die Spalte author ist ein personenbezogenes Datum, und bei Reddit wiegt das schwerer als sonst. Benutzernamen sind pseudonym, nicht anonym: Viele sind langlebige Identitäten mit jahrelanger Beitragshistorie, und Menschen sagen unter ihnen Dinge gerade deshalb, weil sie nicht ihren echten Namen verwenden. Wenn Sie die Spalte speichern, verarbeiten Sie personenbezogene Daten, und die DSGVO und ähnliche Regelwerke gelten für Sie, ganz gleich, woher Sie sie haben. Zu zählen, wie oft ein Thema auftaucht, ist ein einfacher Fall; ein Profil dessen zusammenzustellen, was ein benannter Nutzer gepostet hat, ist es nicht, und dafür ist dieser Dienst nicht gedacht.

Reddits Bedingungen beschränken den automatisierten Zugriff, und die Inhalte sind Reddit von denen lizenziert, die sie geschrieben haben; es bleibt also eine Frage der Bedingungen und nicht dessen, was öffentlich erreichbar ist. Lesen Sie sie, bevor Sie hochskalieren. Wir betreiben auf der Datenebene keine Tracker von Dritten, und Ihre Exporte löschen sich nach 30 Tagen selbst.

livescraper.app · Grundsätze
Nur öffentliche Suchergebnisse
Keine Logins, keine Paywalls
Benutzernamen sind pseudonym, nicht anonym - als personenbezogene Daten behandeln!
Keine Tracker von Dritten auf der Datenebene
Exporte löschen sich selbst (30 Tage)
Dieselben Beiträge, die jeder Besucher in Reddits eigener Suche sieht.
FAQ

Was man vor der Registrierung fragt.

Die Fragen, die wir am häufigsten hören. Noch etwas? Sprechen Sie uns an - die Antworten schreiben Menschen, keine Bots.

Was übermittle ich?+
Entweder einen schlichten Suchbegriff oder eine Reddit-Such-URL der Form reddit.com/search/?q=…, eine pro Zeile, beliebig gemischt. Der eigene Platzhalter des Formulars zeigt beide Formen. Statt einzufügen können Sie eine CSV-, XLSX-, TXT- oder Parquet-Datei hochladen.
Welche Spalten enthält der Export?+
Neun: query, title, subreddit, author, score, comments, created, url und status. Das ist die Spaltenliste, die der Dienst selbst deklariert, und sie entspricht der Kopfzeile jedes Exports, den wir vorliegen haben.
Liefert das die Kommentare zu einem Beitrag?+
Nein. Die Spalte comments ist eine Anzahl, wie viele Kommentare ein Beitrag hat, nicht die Kommentare selbst, und in diesen neun Spalten steht nirgends Kommentartext. Das Abrufen dessen, was die Leute tatsächlich geschrieben haben, ist ein eigener Dienst auf der Plattform mit eigenem Schema. Nutzen Sie diesen, um die Threads zu finden, und jenen, um sie zu lesen.
Welche Sortieroptionen gibt es?+
Fünf: Relevance, Hot, Top, New und Comment count. Comment count ist die, die man anderswo selten bekommt, und sie ist oft die nützlichste - ein Beitrag mit mäßigem Score und vielen Kommentaren ist ein Thread, in dem man sich uneinig war, und dort stecken meist die Details.
Welches Format hat die Spalte created?+
Wir sagen es nicht, und das ist Absicht. Keiner der Durchläufe, die wir vorliegen haben, lieferte einen Beitrag, wir haben also nie einen Wert darin gesehen. Raten wäre schlimmer als nutzlos, denn eine Datumsspalte ist genau die Art von Feld, gegen die Menschen Parsing-Code schreiben. Lassen Sie die kostenlose Stufe über eine Suche laufen und sehen Sie es sich zuerst an.
Haben Sie ihn tatsächlich laufen lassen?+
Dreimal, und nicht ein Durchlauf lieferte einen Beitrag - jede Inhaltsspalte war auf allen vier Zeilen leer. Warum das zählt, sei genau gesagt: Die Anfragen waren echt, keine Platzhalter. Beide Formen, nach denen das Formular fragt, wurden eingereicht - ein schlichter Suchbegriff und eine reddit.com/search-URL -, und die Zeilen kamen trotzdem mit nur query und status befüllt zurück. Das sagt Ihnen die Form des Exports und überhaupt nichts über seine Inhalte, und wir sagen das lieber, als die Seite aufzuhübschen.
Braucht es einen Proxy?+
Das Formular weist darauf hin, dass Seiten mit Bot-Schutz auf dem kostenlosen Pool einen blockierten Status liefern, der residential-only ist. Das ist der eigene Hinweis der Plattform zur gemeinsamen Pipeline und keine Aussage über diese Website, und er ist einplanenswert. Was wir von unserer Seite sagen können, ist enger und nützlicher: Keiner der drei Exporte, die wir vorliegen haben, kam mit einem Beitrag darin zurück - lesen Sie also die Spalte status auf Ihrem eigenen ersten Durchlauf, bevor Sie auf dem Rest etwas aufbauen.
Was kostet das?+
Die ersten 500 Zeilen auf einem neuen Konto sind kostenlos und einmalig; danach sind es 0,002 $ pro Zeile - etwa 2 $ pro 1.000 - nach Verbrauch und ohne Abo. Guthaben verfällt nicht und es gibt keine monatliche Rücksetzung.

Erst die Threads finden.
Dann lesen.

Lassen Sie eine Suche laufen, sortieren Sie nach Kommentarzahl, und sehen Sie, welche Gespräche Ihren Nachmittag wert sind. Ihre ersten 500 Zeilen sind kostenlos.

Reddit-Suchergebnisse als Zeilen exportieren

Der Reddit Such-Scraper macht aus einer Suche eine Tabelle. Sie reichen Suchbegriffe oder reddit.com/search/?q=…-URLs ein - eine pro Zeile, beliebig gemischt, oder als CSV-, XLSX-, TXT- oder Parquet-Datei hochgeladen -, setzen ein Limit und wählen eine Sortierung, und jeder Beitrag kommt als Zeile zurück: der Titel, das Subreddit, in dem er gepostet wurde, der Verfasser, sein Score, wie viele Kommentare er hat, wann er verfasst wurde, und ein Link. Neun Spalten, eine Zeile pro Beitrag, herunterladbar als CSV, Excel oder JSON. Die Beschreibung des Dienstes selbst sagt es schlicht: Er liefert Suchergebnisse.

Die am häufigsten falsch gelesene Spalte ist comments, die eine Anzahl ist und nicht die Kommentare selbst. Nichts in diesen neun Spalten ist Kommentartext, und keine Sortierung lässt ihn erscheinen - das Abrufen des Geschriebenen ist ein eigener Dienst mit eigenem Schema. Das Wort leistet in der Oberfläche doppelte Arbeit, denn die Sortierung Comment count sendet den Wert comments, aber Sortierung wie Spalte drehen sich um das Wie-viele, nicht um das Was. Am besten hält man es so: Dieser Dienst ist ein Verzeichnis von Threads, der andere ist das, was darin steht.

Nach dieser Zahl zu sortieren lohnt sich. Fünf Reihenfolgen werden angeboten - Relevance, Hot, Top, New und Comment count -, und die letzte ist die, die anderswo selten auftaucht. Ein Beitrag mit hohem Score ist einer, dem man zustimmte; ein Beitrag mit vielen Kommentaren ist einer, über den gestritten wurde, und für Produktrecherche, Beschwerden und Vergleiche steckt das Detail meist im Streit. Dass subreddit als eigene Spalte ankommt, ist das andere, was eine seitenweite Suche lohnend macht: Eine Anfrage liefert Beiträge von überall dort, wo sie geschrieben wurden, und Sie gruppieren hinterher nach Community, statt jede einzeln zu durchsuchen. Das Limit gilt pro Anfrage, mehrere Begriffe multiplizieren sich also.

Eine Einschränkung wird deutlich benannt, weil sie ändert, was von dieser Seite zu erwarten ist. Wir haben drei Exporte vorliegen, und keiner davon enthält einen Beitrag: Jede Inhaltsspalte war auf allen vier Zeilen leer. Das gehört genau gesagt, denn die Durchläufe gingen nicht daneben - es wurden echte Anfragen eingereicht, in beiden Formen, die das Formular annimmt, und die Zeilen kamen trotzdem mit nur query und status befüllt zurück. Die neun Namen oben sind also verlässlich, und alles jenseits davon fehlt bewusst, statt erfunden zu werden. Das Formular weist außerdem darauf hin, dass Seiten mit Bot-Schutz auf dem kostenlosen Pool einen blockierten Status liefern, der residential-only ist; das ist der eigene Hinweis der Plattform zur gemeinsamen Pipeline und einplanenswert. Rechtlich gilt: Alles Erhobene ist öffentlich, aber author ist ein pseudonymer Benutzername, an dem die Beitragshistorie eines echten Menschen hängt - behandeln Sie ihn als personenbezogenes Datum und lesen Sie Reddits Bedingungen, bevor Sie hochskalieren. Fangen Sie kostenlos an: Ihre ersten 500 Zeilen kosten nichts und brauchen keine Kreditkarte, danach sind es 0,002 $ je Zeile, pauschal. Die aktuellen Sätze finden Sie unter Preise.