YouTube Transkript-Scraper

Was tatsächlich gesagt wurde,
als Tabelle.

Geben Sie eine YouTube-Video-ID oder -URL an und erhalten Sie das Transkript als Zeilen - eine Zeile pro Untertitelsegment, jeweils mit Text, Startzeit und Dauer, dazu das gesamte Transkript als einzelnes Feld. Acht Spalten. Kein YouTube-Konto, kein Residential-Proxy, kein Parser, den Sie am Leben halten müssen.

einmalig 500 kostenlose Zeilendanach 0,002 $ je Zeile8 SpaltenCSV · XLSX · JSON
So funktioniert es

Eine Videoliste hinein,
die gesprochenen Worte heraus.

Die Eingabe ist das Video. Fügen Sie ein, was Sie ohnehin haben - die blanke ID, einen Watch-Link oder einen kurzen youtu.be-Link - und der Auftrag holt die zugehörige Untertitelspur.

  1. SCHRITT 1Melden Sie sich auf der Plattform an.
  2. SCHRITT 2Öffnen Sie den YouTube Transkript-Scraper.
  3. SCHRITT 3Fügen Sie YouTube-Video-IDs oder -URLs ein, eine pro Zeile - oder laden Sie eine CSV-, XLSX-, TXT- oder Parquet-Datei hoch.
  4. SCHRITT 4Wählen Sie Ihr Ausgabeformat.
  5. SCHRITT 5Klicken Sie auf Get Data.
  6. SCHRITT 6Laden Sie das Transkript als CSV, XLSX oder JSON herunter.

Jede Zeile ist mit der Abfrage versehen, aus der sie stammt, und mit der Video-ID, zu der sie gehört - so lässt sich auch ein Durchlauf über eine ganze Playlist wieder mit Ihrer Eingabeliste abgleichen.

Warum Teams es nutzen

Gesprochenes, das sich
durchsuchen und zitieren lässt.

Eine ID, ein Watch-Link oder ein Kurzlink

Alle drei kommen in dasselbe Feld, eines pro Zeile. Eine Watch-URL mit zusätzlichen Parametern - einer Playlist, einem Radio-Flag - löst weiterhin auf das richtige Video auf, und die aufgelöste ID kommt in einer eigenen Spalte zurück, sodass Sie darüber verknüpfen können.

Auf die Sekunde getaktet

Jedes Segment trägt den Moment, in dem es beginnt, und seine Länge, beides als Dezimalsekunden. Genau das macht aus einer Textwand etwas, zu dem man springen kann - einen Deep-Link bauen, einen Ausschnitt schneiden oder ein Zitat mit dem Bild abgleichen, aus dem es stammt.

Segmente und das Ganze

Sie bekommen beide Formen in einer Datei: eine Zeile pro Segment für alles Zeitbezogene und das vollständige Transkript als einzelnes Feld für alles, was nur den Text braucht. Das Datenverzeichnis erklärt genau, wo dieses Volltextfeld steht - denn es steht nicht in jeder Zeile.

Was Sie zurückbekommen

Acht Spalten,
eine Zeile pro Segment.

Jede Zeile ist ein Untertitelsegment: was gesagt wurde, wann es beginnt und wie lange es dauert, versehen mit dem Video, zu dem es gehört, und der Abfrage, die Sie übermittelt haben.

Die Spaltenliste unten ist die Kopfzeile echter Run-Exporte, bestätigt durch das Spalten-Array, das die Run-Oberfläche rendert; beide stimmen exakt überein. Zwei der acht verhalten sich anders als der Rest - sie erscheinen einmal pro Video statt einmal pro Zeile - und das ist am ehesten das, was überrascht. Deshalb steht es in der Tabelle und noch einmal in der Anmerkung darunter.

Datenverzeichnis

Acht Spalten,
und zwei davon sind besonders.

Entnommen der Kopfzeile echter Durchläufe. Die Hinweise beschreiben, was jede Spalte enthält und wie sie sich wiederholt - nicht, wie viele Zeilen Sie bekommen, denn das ist eine Eigenschaft der Untertitelspur des Videos und nicht des Scrapers.

query
Die Video-ID oder URL, die Sie übermittelt haben, wiederholt in jeder Zeile, die daraus stammt - einschließlich der zusätzlichen URL-Parameter, genau wie Sie sie eingegeben haben.
video_id
Die YouTube-ID, auf die die Abfrage aufgelöst wurde, wiederholt in jeder Zeile dieses Videos. Über diese Spalte verknüpfen Sie: Eine Watch-URL mit angehängter Playlist und die blanke ID landen hier als derselbe Wert.
language
Der Sprachcode der Untertitelspur, wiederholt in jeder Zeile des Videos. Wir haben bislang nur englische Videos ausgeführt, daher ist en der einzige Wert, den wir gesehen haben - die Seite rät nicht, was die Spalte sonst enthalten kann.
segments
Nur in der ersten Zeile jedes Videos. In wie viele Segmente das Transkript dieses Videos zerlegt wurde - und damit zugleich, wie viele Zeilen das Video beisteuert. In jeder weiteren Zeile desselben Videos ist das Feld leer. Wo es gefüllt ist, eine Ganzzahl, kein String.
transcript
Nur in der ersten Zeile jedes Videos. Das gesamte Transkript als ein Textblock, mit zusammengefügten Segmenten. In jeder weiteren Zeile desselben Videos leer - ein naiver Blick auf diese Spalte liefert also eine gefüllte Zelle pro Video und Leerstellen dazwischen. Das ist so gedacht, keine Lücke.
text
Was in diesem Segment gesagt wurde. In jeder Zeile vorhanden - das ist die zeilenweise Hälfte des Exports.
start
Wann das Segment beginnt, in Sekunden ab Videostart, als Dezimalzahl. Steigt innerhalb eines Videos an und beginnt beim nächsten von vorn.
duration
Wie lange das Segment dauert, in Sekunden, als Dezimalzahl.

Drei Dinge, die Sie wissen sollten, bevor Sie Code dagegen schreiben. Eine Zeile ist ein Segment, kein Video - ein Video füllt so viele Zeilen, wie seine Untertitelspur Segmente hat, und query, video_id und language wiederholen sich über sie alle. segments und transcript brechen dieses Muster: Sie stehen nur in der ersten Zeile jedes Videos und sind im Rest leer - gruppieren Sie also nach video_id und nehmen Sie die erste Zeile, statt sie überall zu erwarten. Und start sowie duration kommen als echte Zahlen zurück, während alles andere Text ist - auch segments, das dort, wo es gefüllt ist, eine Ganzzahl und sonst ein leerer String ist. Ein strenger Parser muss beides vertragen.

Laufsteuerung

Ein Feld,
und nichts einzustellen.

Dieser Scraper hat kein Limit und keine Sortierung - das Transkript ist, was es ist. Sie entscheiden nur, wie Sie die Videos übergeben.

Blanke Video-ID watch?v=-URL youtu.be-Kurzlink Eine pro Zeile einfügen CSV-Upload XLSX-Upload TXT-Upload Parquet-Upload
Häufige Arbeitsabläufe

Drei Aufgaben, die Menschen
hier am häufigsten ausführen.

Ein paar Beispiele dafür, was Teams mit gesprochenen Worten anfangen, sobald sie in einer Tabelle stehen.

Research

Einen Backkatalog nach einer Formulierung durchsuchen

Ziehen Sie die Transkripte der Videos eines Kanals und filtern Sie die Textspalte. Jede Erwähnung eines Produkts, eines Wettbewerbers oder einer Behauptung zu finden, kostet einen Filter statt eines Nachmittags im Schnelldurchlauf.

Research · Comms
Content

Vorträge in geschriebenes Material verwandeln

Ein Transkript ist der erste Entwurf eines Blogbeitrags, einer Shownotes-Seite oder eines Untertitelsatzes. Das Volltextfeld liefert das Ganze in einer Zelle, und die getakteten Zeilen liefern die Zeitmarken zum Zurückverlinken.

Content
KI

Einem Modell etwas geben, das es belegen kann

Getaktete Segmente lassen sich sauber für Retrieval zerlegen, und jeder Abschnitt weiß bereits, aus welchem Video er stammt und an welcher Stelle. Das ist der Unterschied zwischen einer Antwort und einer Antwort mit Link auf die Sekunde, in der es gesagt wurde.

Data · ML
Preise

Zahlen Sie nur für die Segmente,
die Sie wirklich ziehen.

Kein Abo, kein Minimum, keine wiederkehrende Rechnung. Ihre ersten 500 Zeilen gehen auf uns - danach zahlen Sie nach Verbrauch, zum selben Pauschalpreis wie bei jedem anderen Scraper hier.

Kostenlose Stufe

500 kostenlose Zeilen - 0 $

Für jedes neue Konto, einmalig. Keine Kreditkarte erforderlich. Datei-Upload und jedes Exportformat inbegriffen. Genug, um die Form eines Transkripts zu sehen, bevor Sie darauf aufbauen.

0 $ für immer
Nach Verbrauch

0,002 $ je Zeile, nach der kostenlosen Stufe

Derselbe Pauschalpreis wie bei jedem anderen Scraper der Plattform. Der Schätzer zeigt vor dem Start die Zeilenzahl und die Credit-Kosten - keine bösen Überraschungen, keine Recheneinheiten zum Umrechnen.

Am beliebtesten
Volumen

Individuell · hohes Volumen

Volumenpreise, dedizierte Worker und ein SLA für laufendes Monitoring oder sehr große historische Abrufe. Nennen Sie uns Ihre Zahlen, wir erstellen ein Angebot.

Sprechen Sie uns an
10 % Rabatt auf Ihren ersten bezahlten Durchlauf.Nutzen Sie den Code LIVESCRAPER10 an der Kasse.
Registrieren
Passt gut zu

Was gesagt wurde,
und wo es gefunden wurde.

Das Rechtliche

Ist es legal,
YouTube-Transkripte zu scrapen?

Kurze Antwort: Untertitel werden zusammen mit dem Video ausgeliefert - und was Sie mit den Worten danach tun dürfen, ist eine Urheberrechts- und keine Scraping-Frage.

Eine Untertitelspur wird jedem ausgeliefert, der das Video öffnet, angemeldet oder nicht; genau so funktioniert die Untertitel-Schaltfläche. Dieselbe öffentliche Spur für Forschung zu lesen, ist seit Langem gängige Praxis, und nichts davon berührt ein Login oder eine Bezahlschranke. Ein Video ohne Untertitel hat kein Transkript, das gelesen werden könnte - deshalb braucht der Scraper eines und sagt das auch klar.

Der Punkt, um den Sie planen sollten, ist nicht der Zugang, sondern die Weiterverwendung. Ein Transkript sind die Worte der Urheberin oder des Urhebers, und das Video ist ihr urheberrechtlich geschütztes Werk - Zitieren, Indizieren, Durchsuchen und Analysieren stehen also auf ganz anderem Boden als das Wiederveröffentlichen eines Vortrags als eigener Artikel. Wenn Sie darauf trainieren oder es in großem Umfang reproduzieren, ist das eine Lizenzfrage, und sie zu beantworten liegt bei Ihnen, bevor Sie skalieren.

YouTubes Nutzungsbedingungen schränken automatisierten Zugriff ein, das ist also ebenso eine Vertrags- wie eine Rechtsfrage - wenn Sie in einer Vertragsbeziehung zur Plattform stehen, prüfen Sie sie. Wir betreiben keine Tracker Dritter auf der Datenebene, und Ihre Exporte werden nach 30 Tagen automatisch gelöscht.

livescraper.app · Grundsätze
Nur öffentliche Untertitelspuren
Keine Logins, keine Konten berührt
Die Worte bleiben die der Urheber!
Ihre IP wird nie genutzt - unsere rotieren
Exporte löschen sich automatisch (30 Tage)
Prüfen Sie YouTubes eigene Bedingungen, bevor Sie skalieren.
Häufige Fragen

Was Menschen
vor der Anmeldung fragen.

Die Fragen, die wir am häufigsten hören. Noch etwas? Sprechen Sie uns an - die Antworten schreiben Menschen, keine Bots.

Wie scrape ich ein YouTube-Transkript?+
Mit dem YouTube Transkript-Scraper:
  1. Melden Sie sich auf der Plattform an.
  2. Öffnen Sie den YouTube Transkript-Scraper.
  3. Fügen Sie YouTube-Video-IDs oder -URLs ein, eine pro Zeile - oder laden Sie eine CSV-, XLSX-, TXT- oder Parquet-Datei hoch.
  4. Wählen Sie Ihr Ausgabeformat.
  5. Klicken Sie auf Get Data.
  6. Laden Sie das Transkript als CSV, XLSX oder JSON herunter.
Wofür steht eine Zeile?+
Für ein Untertitelsegment, nicht für ein Video. Ein Video füllt so viele Zeilen, wie sein Transkript Segmente hat, und query, video_id und language wiederholen sich über sie alle. Wenn Sie stattdessen eine Zeile pro Video wollen, gruppieren Sie nach video_id und nehmen Sie die erste Zeile jeder Gruppe - dort steht das vollständige Transkript.
Warum sind die Spalten segments und transcript in den meisten Zeilen leer?+
Weil sie einmal pro Video geschrieben werden statt einmal pro Zeile. Beide stehen in der ersten Zeile jedes Videos und sind in dessen übrigen Zeilen leer - das galt ausnahmslos für jeden Durchlauf mit der aktuellen Form, den wir gemacht haben. Es ist eine Gruppierungskonvention, kein Fehler beim Abruf: segments sagt Ihnen, wie viele Zeilen das Video beisteuert, und transcript enthält das Ganze als einen Textblock.
Kann ich eine vollständige YouTube-URL einfügen, oder muss es die ID sein?+
Beides, und ein youtu.be-Kurzlink funktioniert ebenfalls. Eine Watch-URL mit zusätzlichen Parametern - einer Playlist, einem Radio-Flag - löst weiterhin korrekt auf, und die aufgelöste ID kommt in der Spalte video_id zurück, sodass Sie darüber verknüpfen können statt über das, was Sie zufällig eingefügt haben.
Was passiert, wenn ein Video keine Untertitel hat?+
Dann gibt es dafür kein Transkript. Untertitel sind die Quelle, die hier gelesen wird - ein Video mit deaktivierten Untertiteln liefert also nichts. Das ist die auf dem Tool selbst genannte Voraussetzung und kein Fehler auf Ihrer Seite. Prüfen Sie, ob das Video eine Untertitel-Schaltfläche hat, bevor Sie von einem fehlgeschlagenen Durchlauf ausgehen.
Lassen sich die Zeitmarken für Deep-Links nutzen?+
Ja. Jedes Segment trägt seine Startzeit in Sekunden ab Videobeginn und seine Dauer, beides als Dezimalzahlen. Das genügt, um einen Sprunglink zu bauen, einen Ausschnitt zu schneiden oder ein Zitat mit dem Moment abzugleichen, in dem es gesprochen wurde.
Hat sich die Ausgabe kürzlich geändert?+
Ja, am 03.07.2026. Durchläufe vor der Umstellung exportierten fünf Spalten mit einer Zeile pro Video und dem gesamten Transkript in einer einzigen Zelle. Durchläufe danach exportieren die hier beschriebenen acht Spalten mit einer Zeile pro Segment. Das ist eine Änderung dessen, was eine Zeile bedeutet, nicht nur zusätzliche Spalten - wenn Sie eine ältere Datei haben, hat sie eine andere Form, und keine der beiden ist falsch.
Was kostet das?+
Die ersten 500 Zeilen sind kostenlos und einmalig, ohne Kreditkarte. Danach sind es 0,002 $ je Zeile - derselbe Pauschalpreis wie bei jedem anderen Scraper der Plattform. Denken Sie daran, dass eine Zeile hier ein Segment ist: Ein langes Video kostet also mehr als ein kurzes. Der Schätzer zeigt die Kosten eines Durchlaufs, bevor er startet.

Ihre ersten 500 Segmente,
gehen aufs Haus.

500 einmalige kostenlose Zeilen für jedes neue Konto - ohne Verfallsdatum. Danach 0,002 $ je Zeile, nach Verbrauch - keine hinterlegte Karte, bis Sie es sagen.

Sofort aktiv · keine Karte erforderlich

YouTube-Transkripte im großen Maßstab scrapen

Livescrapers YouTube Transkript-Scraper macht aus einer Videoliste Text. Sie übermitteln YouTube-Video-IDs oder -URLs - eine pro Zeile getippt oder als CSV-, XLSX-, TXT- oder Parquet-Datei hochgeladen - und laden die Untertitelspur als saubere CSV-, Excel- oder JSON-Datei herunter. Blanke IDs, Watch-Links und youtu.be-Kurzlinks funktionieren alle, und eine Watch-URL mit Playlist-Parametern löst weiterhin auf das richtige Video auf.

Eine Zeile ist ein Untertitelsegment. Jede trägt, was gesagt wurde, die Sekunde, in der es beginnt, und wie lange es dauert, dazu die übermittelte Abfrage, die aufgelöste Video-ID und die Sprache der Spur. Zwei weitere Spalten arbeiten pro Video statt pro Zeile: segments, also wie viele Zeilen das Video beisteuert, und transcript, das Ganze als ein Textblock. Beide stehen in der ersten Zeile jedes Videos - das ist das Detail, das man kennen sollte, bevor man einen Parser schreibt.

Research-Teams ziehen den Backkatalog eines Kanals und durchsuchen den Text nach einer Formulierung, statt im Schnelldurchlauf durch die Wiedergabe zu scrollen. Content-Teams machen aus Vorträgen Beiträge, Shownotes und Untertitel. Teams, die Retrieval-Systeme bauen, nutzen die getakteten Segmente als Abschnitte, die bereits wissen, aus welchem Video sie stammen und von welcher Stelle - der Unterschied zwischen einer Antwort und einer Antwort, die sich auf die Sekunde verlinken lässt, in der sie gesagt wurde.

Zwei Dinge sollten Sie vor dem Start wissen. Ein Video mit deaktivierten Untertiteln hat kein Transkript, das zurückgegeben werden könnte - Untertitel sind also Voraussetzung und kein Bonus. Und weil eine Zeile ein Segment ist, kostet ein langes Video bei denselben pauschalen 0,002 $ je Zeile mehr als ein kurzes. Starten Sie kostenlos: Ihre ersten 500 Zeilen kosten nichts und brauchen keine Kreditkarte.