Yellow Pages Such-Scraper

Eine Kategorie und eine Stadt,
als Lead-Tabelle.

Tippen Sie ein, was Sie suchen und wo, und erhalten Sie die Einträge als Zeilen: den Namen, das Telefon, die Straße, die Kategorien, die Bewertung und die Zahl der Rezensionen, die Öffnungszeiten, die Website - und, wo die Anreicherung greift, Kontakt-E-Mail-Adressen mit Zustellbarkeitsurteil, Social-Profile und Details, die von der Website selbst gelesen wurden. Dreiundsechzig Spalten, eine Zeile je Eintrag.

einmalig 500 kostenlose Zeilendanach 0,002 $ je Zeile63 SpaltenCSV · XLSX · JSON
So funktioniert es

Zwei Felder hinein,
eine Lead-Tabelle heraus.

Die Eingabe sind dieselben zwei Dinge, die Sie auch auf der Website selbst eintippen würden - was Sie wollen und wo.

  1. SCHRITT 1Melden Sie sich auf der Plattform an.
  2. SCHRITT 2Öffnen Sie den Yellow Pages Search Scraper.
  3. SCHRITT 3Wählen Sie die Region.
  4. SCHRITT 4Tippen Sie den Suchbegriff und den Ort ein.
  5. SCHRITT 5Setzen Sie ein Datensatzlimit oder lassen Sie es leer, um alles Verfügbare zu holen.
  6. SCHRITT 6Klicken Sie auf Start scraping.

Beide Felder landen in jeder Zeile, zusammengefügt als ein query-Wert in der Form search, location - eine Datei, die mehrere Suchen mischt, bleibt dadurch nachträglich trennbar.

Warum Teams es nutzen

Ein Verzeichniseintrag,
bereits angereichert.

Der Eintrag, und dann alles danach

Die Verzeichnisfelder sind nur das erste Drittel der Zeile. Der Rest ist Anreicherung: E-Mail-Adressen mit Zustellbarkeitsurteil, Social-Profile und Details, die von der eigenen Website des Betriebs gelesen wurden.

E-Mail-Adressen, die mit einem Urteil kommen

Adressen kommen zusammen mit einem Status statt allein, eine Liste lässt sich also auf das eindampfen, was sich zu senden lohnt, bevor jemand sie in ein Versandtool lädt.

Öffnungszeiten in maschinenlesbarer Form

Öffnungszeiten kommen als Mo-Fr 09:00-18:00, Sa 09:00-15:00 statt als Fließtext an - eine Form, die Sie parsen können, statt eines Satzes, den Sie deuten müssen.

Was Sie zurückbekommen

Dreiundsechzig Spalten -
und eine Sache, die zuerst zu klären ist.

Dieser Export enthält echte Daten, diese Seite kann also konkret über Formate sprechen. Er hat außerdem eine Eigenschaft, die eine Pipeline still beschädigt, und die ist zwei Absätze vor der Tabelle wert.

Die Spaltenreihenfolge ist zwischen Läufen nicht stabil. Jeder Lauf, den wir haben, trägt dieselben dreiundsechzig Namen, aber sie kommen nicht immer in derselben Reihenfolge an - in einem Lauf saß hours an vorletzter statt an zwanzigster Stelle, und die Spalten danach verschoben sich um eins. Nichts wurde hinzugefügt, entfernt oder umbenannt; nur die Reihenfolge hat sich bewegt.

Das ist harmlos, wenn Sie nach Spaltennamen lesen, und zerstörerisch, wenn Sie nach Position lesen. Ein Loader, der Spalte 20 als amenities nimmt, weil sie letzte Woche amenities war, füllt dieses Feld mit Öffnungszeiten und meldet nie einen Fehler. Ordnen Sie die Kopfzeile bei jedem Import nach Namen zu - und wenn Ihr Werkzeug das umständlich macht, ist das die eine Sache, die sich vor dem ersten echten Lauf zu beheben lohnt und nicht danach.

Datenwörterbuch

Dreiundsechzig Spalten,
nach Namen gelesen.

Entnommen der Kopfzeile und den JSON-Schlüsseln echter Läufe, die übereinstimmen. Die Formate unten sind an befüllten Zellen gemessen - wo eine Spalte eine feste Form hat, steht sie da; wo nicht, wird keine erfunden.

name
Der Firmenname, wie der Eintrag ihn zeigt.
phone
Die Haupttelefonnummer, immer in der Form (212) 473-4444 - Klammern, ein Leerzeichen, dann ein Bindestrich.
category
Die Kategorien als eine Zeichenkette. Das ist exakt categories, verbunden mit Komma und Leerzeichen, die beiden sind also dieselbe Tatsache doppelt - nehmen Sie, was Ihnen passt, und ignorieren Sie das andere.
categories
Dieselben Kategorien als Array, und das ist die Form, nach der man filtert.
area
Die Straßenzeile der Adresse. Stadt, Bundesstaat und Postleitzahl haben eigene Spalten daneben.
city
Die Stadt.
state
Der Bundesstaat, immer zwei Großbuchstaben.
pincode
Die Postleitzahl, immer fünf Ziffern.
range
Die Preisspannen-Angabe, die der Eintrag tragen kann.
rating
Die Durchschnittsbewertung, als Zahl in einer Zeichenkette. Sie und reviews_count kommen immer gemeinsam - ein Eintrag hat beides oder keines.
reviews_count
Auf wie vielen Rezensionen dieser Durchschnitt beruht.
open_status
Ob der Betrieb in dem Moment, in dem diese Zeile erfasst wurde, geöffnet war - open now, closed now, opening soon, open 24 hours. Lesen Sie es gegen das scraped_at dieser Zeile, nicht gegen den Lauf; siehe die Notiz unten.
email
Das Feld für eine einzelne E-Mail-Adresse. Die Ausgabe der Anreicherung landet in email_1 bis email_3 und emails, das sind die Spalten für Kontaktadressen.
website
Die eigene Website des Betriebs. Jede von der Website abgeleitete Spalte unten bleibt leer, solange diese nicht gefüllt ist - auch wenn eine gefüllte Website nicht garantiert, dass sie sich auflösen ließen.
directions
Ein Link zur Wegbeschreibungsseite des Eintrags.
image
Ein Link zum Vorschaubild des Eintrags.
years_in_business
Wie lange der Eintrag angibt, dass der Betrieb tätig ist, als ganze Zahl.
description
Ein kurzer, gekürzter Ausschnitt. Behandeln Sie ihn als Vorschau, nicht als Über-uns-Text: manche Werte sind der eigene Klappentext des Betriebs, manche eine Kundenrezension - deshalb kann einer mitten im Satz oder an einem verirrten Anführungszeichen enden.
source_url
Die Eintragsseite, aus der die Zeile gelesen wurde. Die Spalte, die man behält, falls man je einen Wert von Hand prüfen muss.
hours
Öffnungszeiten in der kompakten Form Mo-Fr 09:00-18:00, Sa 09:00-15:00 - zweibuchstabige Tageskürzel, Bereiche durch Kommas verbunden.
amenities
Merkmale, mit denen der Eintrag wirbt. Zwei Merkmale können in einem Wert ankommen, getrennt durch einen Zeilenumbruch - trennen Sie also an Zeilenumbrüchen, statt ein einzelnes Label anzunehmen.
facebook
Link zur Facebook-Seite des Betriebs.
instagram
Link zum Instagram-Profil des Betriebs.
linkedin
Link zur LinkedIn-Seite des Betriebs.
tiktok
Link zum TikTok-Profil des Betriebs.
medium
Link zur Medium-Publikation des Betriebs.
reddit
Link zur Reddit-Präsenz des Betriebs.
skype
Der Skype-Name des Betriebs.
snapchat
Link zum Snapchat-Profil des Betriebs.
telegram
Link zur Telegram-Präsenz des Betriebs.
whatsapp
Der WhatsApp-Kontakt des Betriebs.
twitter
Link zum X-/Twitter-Profil des Betriebs.
vimeo
Link zum Vimeo-Kanal des Betriebs.
youtube
Link zur YouTube-Präsenz des Betriebs - ein Kanal, eine Nutzerseite oder ein einzelnes Video, nehmen Sie also keine Kanal-URL an.
github
Link zur GitHub-Organisation des Betriebs.
crunchbase
Link zum Crunchbase-Profil des Betriebs.
emails
Jede Adresse, die die Anreicherung gefunden hat, als Array.
emails_status
Ein Eintrag je Adresse in emails, jeweils zwei durch Komma verbundene Teile: ein Zustellbarkeitsurteil, dann ein Detail. Das Detail ist kein fester Wertevorrat - es kann die Art des Postfachs benennen oder eine Domain wiedergeben -, schalten Sie also auf den Teil vor dem Komma und behandeln Sie den Rest als Freitext.
website_title
Der <title> der Website des Betriebs.
website_description
Die Meta-Description der Website des Betriebs.
website_keywords
Die Meta-Keywords der Website des Betriebs.
website_generator
Womit die Website gebaut wurde, aus ihrem Generator-Tag gelesen - ein CMS, ein Page Builder oder ein SEO-Plugin, oft samt Versionsangabe.
website_has_fb_pixel
Ob auf der Website ein Facebook-Pixel gefunden wurde. Ein echter Boolean, keine Zeichenkette.
website_has_google_tag
Ob auf der Website ein Google-Tag gefunden wurde. Ebenfalls ein echter Boolean.
phones_extra
Weitere für den Betrieb gefundene Telefonnummern, als Array. Es kann die Nummer wiederholen, die bereits in phone steht - entdoppeln Sie also gegen diese Spalte, bevor Sie irgendetwas anrufen.
phones_extra_types
Der Anschlusstyp für jeden Eintrag in phones_extra, positionsgleich zugeordnet und immer gleich lang - aber ein Eintrag kann null sein, wo sich der Typ nicht bestimmen ließ, greifen Sie also defensiv darauf zu.
phone_type
Der Anschlusstyp der Haupttelefonnummer phone.
contact_name
Ein Kontaktname aus der Anreicherung. Nehmen Sie nicht an, dass dies eine Person ist - die Werte sind ebenso oft ein Praxis- oder Firmenname wie eine Einzelperson, ein Aufteilen in Vor- und Nachname ist also nicht sicher.
contact_title
Die Berufsbezeichnung, die zu contact_name gehört.
is_public
Ob das Unternehmen börsennotiert ist. Ein echter Boolean.
wp_name
Der Firmenname, wie der Telefondatenanbieter ihn führt.
wp_address
Die Adresse, wie der Telefondatenanbieter sie führt.
phones_extra_wp
Weitere Telefonnummern vom Telefondatenanbieter.
emails_persons
Die Personen, die die Anreicherung den gefundenen Adressen zugeordnet hat, als Array.
employees
Die Mitarbeiterzahl des Unternehmens, als Zahl.
scraped_at
Wann diese Zeile erfasst wurde, als 2026-07-06 09:16:41.954000. Das variiert innerhalb eines einzelnen Laufs - die Zeilen einer Datei wurden nicht alle im selben Augenblick gelesen, und genau das macht open_status zu einer Tatsache je Zeile.
query
Ihre beiden Eingaben, verbunden als search, location, wiederholt in jeder Zeile, die daraus stammt.
position
Der Platz des Eintrags in der Ergebnisreihenfolge, beginnend bei 1 und innerhalb eines Laufs eindeutig. Die Spalte, nach der man sortiert, um die Reihenfolge exakt so zu rekonstruieren, wie sie zurückkam.
email_1
Die erste angereicherte E-Mail-Adresse. Keine Zeile trägt email_2 ohne diese hier.
email_2
Die zweite angereicherte E-Mail-Adresse, sofern es eine gibt.
email_3
Die dritte angereicherte E-Mail-Adresse, sofern es eine gibt.
industry
Die Branche, die die unternehmensbezogene Anreicherung zuweist.
founded_year
Das Gründungsjahr des Unternehmens, als Zahl.

Lesen Sie diesen Export nach Spaltennamen, nie nach Position. Jeder Lauf trägt dieselben dreiundsechzig Namen, aber die Reihenfolge ist nicht fest - in einem unserer Läufe kam hours an vorletzter statt an zwanzigster Stelle an, und alles danach verschob sich um eins. Nichts wurde umbenannt oder weggelassen; ein positionsbasierter Loader hätte schlicht Öffnungszeiten in das Merkmalsfeld geschrieben und Erfolg gemeldet. Das Zweite, das Sie wissen sollten: scraped_at variiert innerhalb einer einzelnen Datei, weil die Zeilen nicht alle im selben Augenblick erfasst wurden - open_status beschreibt also den jeweils eigenen Moment einer Zeile und ist keine Eigenschaft des Laufs. Und drei kleinere Formen, die man behandeln sollte, bevor sie überraschen: category ist nur categories mit Komma verbunden, also dieselbe Tatsache doppelt; amenities kann zwei Werte durch einen Zeilenumbruch getrennt in eine Zeichenkette packen; und phones_extra_types deckt sich Index für Index mit phones_extra, kann aber ein null enthalten, wo der Typ nicht bestimmt wurde.

Laufsteuerung

Am Job eingestellt,
nicht in der Tabelle.

Vier Steuerelemente, und sie sind die gesamte Eingabe: wo gesucht wird, wonach, an welchem Ort und wie viel geholt wird. Die Sortier- und Filterschaltflächen neben den Ergebnissen sind Ansichtssteuerungen - sie formen, was Sie sehen, nicht das, was der Lauf holt.

Region Suchbegriff Ort Limit (Datensätze) Leeres Limit holt alles Eine Zeile je Eintrag CSV-Export XLSX-Export JSON-Export
Gängige Arbeitsabläufe

Drei Aufgaben, die hier
am häufigsten laufen.

Ein paar Beispiele, wie Teams Verzeichniseinträge nutzen, um eine Frage zu beantworten, die sie tatsächlich haben.

Leadgenerierung

In einem Durchgang eine kontaktierbare Liste bauen

Eine Kategorie und eine Stadt liefern die Einträge; die Anreicherungsspalten liefern den Weg, sie zu erreichen. Weil jede Adresse mit einem Zustellbarkeitsurteil ankommt, lässt sich die Liste filtern, bevor sie je ein Versandtool erreicht, statt erst, wenn die Bounces zurückkommen.

Leadgenerierung · Vertrieb
Marktbild

Ein lokales Gewerbe bemessen und sehen, wer etabliert ist

Bewertung, Rezensionszahl und Jahre im Geschäft stehen in derselben Zeile, und das reicht, um einen vollen Markt von einem dünnen und einen Neueinsteiger von einer festen Größe zu unterscheiden - ohne einen einzigen Eintrag von Hand zu öffnen.

Forschung
Tech-Stack

Betriebe mit einem bestimmten Setup finden

Die Website-Spalten sagen, womit jede Seite gebaut wurde und ob sie ein Facebook-Pixel oder ein Google-Tag trägt. Für alle, die an die Nutzer einer Plattform verkaufen, macht das aus einem Verzeichnis eine qualifizierte Liste.

Go-to-Market
Preise

Zahlen Sie nur für die Einträge,
die Sie tatsächlich ziehen.

Kein Abo, kein Mindestumsatz, keine wiederkehrende Rechnung. Ihre ersten 500 Zeilen gehen auf uns - danach zahlen Sie nach Verbrauch, zum selben Pauschalsatz wie bei jedem anderen Scraper hier.

Kostenlose Stufe

500 kostenlose Zeilen - 0 $

Für jedes neue Konto, einmalig. Keine Kreditkarte erforderlich. Das Datensatzlimit und alle Exportformate sind enthalten.

0 $ für immer
Nach Verbrauch

0,002 $ je Zeile, nach der kostenlosen Stufe

Ungefähr 2 $ je 1.000 Einträge, Anreicherungsspalten inbegriffen statt als zusätzlicher Schritt berechnet. Der Schätzer zeigt Zeilenzahl und Guthabenkosten, bevor ein Lauf startet.

Am beliebtesten
Volumen

Individuell · hohes Volumen

Volumenpreise, dedizierte Worker und ein SLA für laufendes Monitoring oder sehr große historische Abzüge. Nennen Sie uns Ihre Zahlen, und wir erstellen ein Angebot.

Sprechen Sie uns an
10 % Rabatt auf Ihren ersten bezahlten Lauf.Verwenden Sie den Code LIVESCRAPER10 an der Kasse.
Registrieren
Passt gut zu

Ein Verzeichnis,
und die daneben.

Das Rechtliche

Ist es legal,
Yellow Pages zu scrapen?

Kurze Antwort: ja für die Eintragsinhalte - aber dieser Export trägt Kontaktdaten und ein Zustellbarkeitsurteil, und genau das verdient Ihre Aufmerksamkeit.

Ein Yellow-Pages-Eintrag existiert, um gefunden zu werden. Name, Telefon, Adresse, Kategorien, Öffnungszeiten und Bewertung werden jedem angezeigt, der die Suche ausführt, angemeldet oder nicht, und öffentlich gelistete Geschäftsinformationen für Marktforschung zu sammeln, ist seit Langem gängige Praxis. Nichts hier berührt ein Login, ein Konto oder eine Bezahlschranke.

Die Anreicherung ist der Teil, dem Sorgfalt gebührt. Dieser Export hört nicht beim Verzeichnis auf: Er ergänzt E-Mail-Adressen, die ihnen zugeordneten Personen, weitere Telefonnummern samt Anschlusstyp und Social-Profile. Eine Geschäftsadresse auf einer Firmendomain ist nach den meisten Lesarten ein Geschäftskontakt - aber die Adresse einer namentlich genannten Einzelperson ist in der EU und im Vereinigten Königreich personenbezogenes Datum, ganz gleich wo sie veröffentlicht wurde, und emails_persons existiert gerade dazu, Einzelpersonen zu benennen. Wenn Sie Outreach betreiben, sind die Rechtsgrundlage und der Widerspruch Ihre Sache, und das Zustellbarkeitsurteil in emails_status sagt Ihnen, ob eine Nachricht ankommt, nicht, ob Sie sie senden dürfen. Die beiden haben nichts miteinander zu tun, und es lohnt sich, sie auch im eigenen Kopf getrennt zu halten.

Wenn Ihre Frage der Marktstruktur gilt und nicht dem Kontakt - wie viele, wie etabliert, wie gut bewertet -, verwerfen Sie die E-Mail-, Telefon- und Personenspalten beim Import, und das meiste hiervon gilt für Sie nicht mehr. Wir betreiben keine Tracker Dritter auf der Datenebene, und Ihre Exporte löschen sich nach 30 Tagen automatisch. Yellow Pages’ eigene Bedingungen schränken automatisierten Zugriff ein, prüfen Sie sie also, bevor Sie skalieren.

livescraper.app · Grundsätze
Nur öffentliche Geschäftseinträge
Keine Logins, keine Konten berührt
Angereicherte E-Mails und Personen sind personenbezogen
Zustellbar heißt nicht erlaubt
Exporte löschen sich automatisch (30 Tage)
Prüfen Sie Yellow Pages’ eigene Bedingungen, bevor Sie skalieren.
Häufige Fragen

Was Leute fragen,
bevor sie sich registrieren.

Die Fragen, die wir am häufigsten hören. Noch etwas? Sprechen Sie uns an - Menschen schreiben die Antworten, keine Bots.

Wie scrape ich Yellow Pages?+
Mit dem Yellow Pages Search Scraper:
  1. Melden Sie sich auf der Plattform an.
  2. Öffnen Sie den Yellow Pages Search Scraper.
  3. Wählen Sie die Region.
  4. Tippen Sie den Suchbegriff und den Ort ein.
  5. Setzen Sie ein Datensatzlimit oder lassen Sie es leer, um alles Verfügbare zu holen.
  6. Klicken Sie auf Start scraping.
Warum schreibt mein Loader die falschen Daten in eine Spalte?+
Weil er nach Position liest. Jeder Lauf trägt dieselben dreiundsechzig Spaltennamen, aber die Reihenfolge liegt zwischen Läufen nicht fest - in einem unserer Läufe kam die Spalte hours an vorletzter statt an zwanzigster Stelle an, und alles danach verschob sich um eins. Nichts wurde umbenannt oder weggelassen, ein positionsbasierter Loader ordnet also still falsch zu und meldet Erfolg. Ordnen Sie die Kopfzeile bei jedem Import nach Namen zu, und das Problem verschwindet.
Was kommt für jeden Eintrag zurück?+
Dreiundsechzig Spalten. Die Verzeichnisfelder sind Name, Telefon, Straße, Stadt, Bundesstaat, Postleitzahl, Kategorien, Bewertung und Rezensionszahl, Öffnungszeiten, Preisspanne, ein Beschreibungsausschnitt, ein Bild und ein Link zum Eintrag. Der Rest ist Anreicherung: E-Mail-Adressen mit Zustellbarkeitsurteil, die ihnen zugeordneten Personen, weitere Telefonnummern samt Anschlusstyp, Social-Profile und Details, die von der eigenen Website des Betriebs gelesen wurden, einschließlich dessen, womit sie gebaut wurde. All das steht in CSV und XLSX ebenso wie im JSON.
Ist open_status verlässlich?+
Es ist für den Moment zutreffend, in dem diese Zeile erfasst wurde, und das ist nicht derselbe Moment, in dem der Lauf endete. Die Spalte scraped_at variiert innerhalb einer einzelnen Datei, weil die Zeilen nicht alle im selben Augenblick gelesen wurden - open now und closed now sind also Tatsachen je Zeile. Lesen Sie open_status gegen das eigene scraped_at dieser Zeile, und wenn Sie Öffnungszeiten als Eigenschaft des Betriebs statt als Momentaufnahme brauchen, nehmen Sie stattdessen die Spalte hours.
In welchem Format kommen die E-Mail-Adressen und ihre Status?+
Die Adressen kommen in emails als Array und sind außerdem in email_1, email_2 und email_3 aufgeflacht. Die Staffel ist konsistent - keine Zeile hat eine zweite Adresse ohne eine erste oder eine dritte ohne eine zweite. Jeder Eintrag in emails_status besteht aus zwei durch Komma verbundenen Teilen: einem Zustellbarkeitsurteil, dann einem Detail. Das Detail ist kein fester Wertevorrat und kann die Art des Postfachs benennen oder eine Domain wiedergeben - schalten Sie also auf den Teil vor dem Komma und behandeln Sie den Rest als Freitext.
Kann ich contact_name in Vor- und Nachname aufteilen?+
Nicht sicher. Die Werte sind ebenso oft ein Praxis- oder Firmenname wie eine Einzelperson, ein Aufteilen an Leerzeichen erzeugt also für einen guten Teil jeder Liste Unsinn. Wenn Sie Felder auf Personenebene brauchen, lesen Sie stattdessen emails_persons und behandeln Sie contact_name als Bezeichnung statt als Namen.
Welche Regionen deckt es ab?+
Auf dem Formular gibt es eine Regionsauswahl, und sie markiert jeden Eintrag, den der Parser noch nicht behandelt - diese zeigen einen Hinweis, dass die Seite ein anderes Layout verwendet. Die Liste wird beim Öffnen der Seite geladen und ist nicht vorab festgelegt, prüfen Sie also die Auswahl darauf, was Ihnen zur Verfügung steht, statt eine Liste von dieser Seite zu übernehmen. Die Voreinstellung ist die US-Seite.
Was kostet das?+
Die ersten 500 Zeilen sind kostenlos und einmalig, ohne Kreditkarte. Danach sind es 0,002 $ je Zeile - etwa 2 $ je 1.000 Einträge - derselbe Pauschalsatz wie bei jedem anderen Scraper auf der Plattform, wobei die Anreicherungsspalten inbegriffen sind statt als eigener Schritt berechnet zu werden. Der Schätzer zeigt die Kosten eines Laufs, bevor er startet.

Ihre ersten 500 Einträge,
gehen aufs Haus.

500 einmalige kostenlose Zeilen auf jedem neuen Konto - ohne Ablaufdatum. Danach 0,002 $ je Zeile nach Verbrauch - keine hinterlegte Karte, bis Sie es sagen.

Sofort aktiv · keine Karte erforderlich

Yellow-Pages-Einträge im großen Stil scrapen

Livescrapers Yellow Pages Search Scraper macht aus einer Kategorie und einem Ort eine Lead-Tabelle. Sie wählen eine Region, tippen ein, was Sie suchen und wo, begrenzen bei Bedarf die Zahl der Datensätze und laden die Ergebnisse als saubere CSV-, Excel- oder JSON-Datei herunter. Es kommt eine Zeile je Eintrag zurück, und beide Ihrer Eingaben werden in jeder Zeile als ein einziger query-Wert mitgeführt, sodass eine Datei, die mehrere Suchen mischt, trennbar bleibt.

Jede Zeile trägt dreiundsechzig Spalten. Die Verzeichnisseite sind Firmenname, Telefon, Straße, Stadt, Bundesstaat und Postleitzahl, die Kategorien sowohl als Array als auch als verbundene Zeichenkette, die Bewertung und die Rezensionszahl, die Öffnungszeiten in kompakter maschinenlesbarer Form, ein Beschreibungsausschnitt, ein Bild und ein Link zurück zum Eintrag. Die Anreicherungsseite ergänzt E-Mail-Adressen mit Zustellbarkeitsurteil, die ihnen zugeordneten Personen, weitere Telefonnummern samt Anschlusstyp, Social-Profile und Details, die von der eigenen Website des Betriebs gelesen wurden - deren Titel, Beschreibung, Keywords, womit sie gebaut wurde und ob sie ein Facebook-Pixel oder ein Google-Tag trägt.

Vertriebsteams nutzen es, um in einem Durchgang eine kontaktierbare Liste zu bauen, und filtern auf das Zustellbarkeitsurteil, bevor irgendetwas ein Versandtool erreicht. Forschende stellen Bewertung, Rezensionszahl und Jahre im Geschäft nebeneinander, um einen vollen lokalen Markt von einem dünnen zu unterscheiden. Go-to-Market-Teams filtern auf die Website-Spalten, um Betriebe zu finden, die eine bestimmte Plattform einsetzen.

Eine Eigenschaft dieses Exports verdient Aufmerksamkeit, bevor Sie darauf aufbauen: Die Spaltenreihenfolge ist zwischen Läufen nicht stabil. Jeder Lauf trägt dieselben dreiundsechzig Namen, aber in einem unserer Läufe kam die Spalte hours an vorletzter statt an zwanzigster Stelle an, und die Spalten danach verschoben sich um eins. Nichts wurde umbenannt oder weggelassen, und genau deshalb ordnet ein Loader, der nach Position liest, still falsch zu und meldet Erfolg - ordnen Sie die Kopfzeile bei jedem Import nach Namen zu. Ebenfalls wissenswert: scraped_at variiert innerhalb einer einzelnen Datei, das Feld open_status beschreibt also den jeweils eigenen Moment einer Zeile und nicht den Lauf als Ganzes. Starten Sie kostenlos: Ihre ersten 500 Zeilen kosten nichts und brauchen keine Kreditkarte, danach sind es pauschal 0,002 $ je Zeile.