Scraper de transcriptions YouTube

Ce qui a réellement été dit,
en tableur.

Donnez-lui un identifiant ou une URL de vidéo YouTube et récupérez la transcription sous forme de lignes - une ligne par segment de sous-titre, chacune avec son texte, son instant de départ et sa durée, plus la transcription entière dans un champ unique. Huit colonnes. Pas de compte YouTube, pas de proxy résidentiel, pas de parser à maintenir en vie.

500 lignes gratuites, une seule fois0,002 $ par ligne ensuite8 colonnesCSV · XLSX · JSON
Comment ça marche

Une liste de vidéos en entrée,
les paroles en sortie.

L'entrée, c'est la vidéo. Collez ce que vous avez déjà - l'identifiant seul, un lien watch ou un lien court youtu.be - et le job récupère la piste de sous-titres correspondante.

  1. ÉTAPE 1Connectez-vous à la plateforme.
  2. ÉTAPE 2Ouvrez le Scraper de transcriptions YouTube.
  3. ÉTAPE 3Collez des identifiants ou des URL de vidéos YouTube, un par ligne - ou importez un fichier CSV, XLSX, TXT ou Parquet.
  4. ÉTAPE 4Choisissez votre format de sortie.
  5. ÉTAPE 5Cliquez sur Get Data.
  6. ÉTAPE 6Téléchargez la transcription en CSV, XLSX ou JSON.

Chaque ligne porte la requête dont elle provient et l'identifiant de la vidéo à laquelle elle appartient - de sorte qu'une exécution sur l'équivalent d'une playlist se rapproche encore de votre liste d'entrée.

Pourquoi les équipes l'utilisent

De la parole que l'on peut
chercher et citer.

Un identifiant, un lien watch ou un lien court

Les trois vont dans le même champ, un par ligne. Une URL watch portant des paramètres supplémentaires - une playlist, un indicateur radio - se résout toujours vers la bonne vidéo, et l'identifiant obtenu revient dans sa propre colonne pour que vous puissiez faire la jointure dessus.

Horodaté à la seconde

Chaque segment porte l'instant où il commence et sa durée, tous deux en secondes décimales. C'est ce qui transforme un mur de paroles en quelque chose vers quoi on peut sauter - construire un lien profond, découper un extrait, ou aligner une citation sur l'image dont elle provient.

Les segments et l'ensemble

Vous obtenez les deux formes dans un seul fichier : une ligne par segment pour tout ce qui est horodaté, et la transcription complète comme champ unique pour tout ce qui n'a besoin que du texte. Le dictionnaire de données explique exactement où se trouve ce champ de texte intégral, car il n'est pas sur toutes les lignes.

Ce que vous récupérez

Huit colonnes,
une ligne par segment.

Chaque ligne est un segment de sous-titre : ce qui a été dit, quand cela commence et combien de temps cela dure, marqué de la vidéo à laquelle il appartient et de la requête que vous avez soumise.

La liste de colonnes ci-dessous est la ligne d'en-tête d'exports réels, corroborée par le tableau de colonnes que l'interface d'exécution affiche ; les deux concordent exactement. Deux des huit se comportent différemment des autres - elles apparaissent une fois par vidéo et non une fois par ligne - et c'est ce qui risque le plus de vous surprendre : c'est donc détaillé dans le tableau, puis rappelé dans la note en dessous.

Dictionnaire de données

Huit colonnes,
et deux d'entre elles sont à part.

Repris de la ligne d'en-tête d'exécutions réelles. Les notes décrivent ce que contient chaque colonne et comment elle se répète - pas combien de lignes vous obtiendrez, car cela dépend de la piste de sous-titres de la vidéo et non du scraper.

query
L'identifiant ou l'URL de vidéo que vous avez soumis, répété sur chaque ligne qui en provient - y compris les paramètres supplémentaires de l'URL, exactement tels que vous les avez saisis.
video_id
L'identifiant YouTube vers lequel la requête s'est résolue, répété sur chaque ligne de cette vidéo. C'est la colonne sur laquelle faire la jointure : une URL watch avec une playlist et l'identifiant seul aboutissent ici à la même valeur.
language
Le code de langue de la piste de sous-titres, répété sur chaque ligne de la vidéo. Nous n'avons lancé que des vidéos en anglais, donc en est la seule valeur que nous ayons vue - la page ne devine pas ce que la colonne peut contenir d'autre.
segments
Première ligne de chaque vidéo uniquement. En combien de segments la transcription de cette vidéo a été découpée - c'est-à-dire aussi combien de lignes la vidéo occupe. Sur toutes les autres lignes de la même vidéo, le champ est vide. Un entier là où il est renseigné, pas une chaîne.
transcript
Première ligne de chaque vidéo uniquement. La transcription entière en un bloc de texte, segments assemblés. C'est voulu, ce n'est pas un trou.
text
Ce qui a été dit dans ce segment. Présent sur chaque ligne - c'est la moitié « par ligne » de l'export.
start
Quand le segment commence, en secondes depuis le début de la vidéo, sous forme de nombre décimal. Progresse au fil d'une vidéo et repart à zéro à la suivante.
duration
Combien de temps dure le segment, en secondes, sous forme de nombre décimal.

Trois choses à savoir avant d'écrire du code contre ces données. Une ligne est un segment, pas une vidéo - une vidéo occupe autant de lignes que sa piste de sous-titres compte de segments, et query, video_id et language se répètent sur toutes. segments et transcript rompent ce schéma : elles sont écrites sur la première ligne de chaque vidéo uniquement et vides sur le reste - regroupez donc par video_id et prenez la première ligne plutôt que de les attendre partout. Et start et duration reviennent en nombres réels alors que tout le reste est du texte - y compris segments, qui est un entier là où il est renseigné et une chaîne vide ailleurs : un parser strict doit tolérer les deux.

Contrôles d'exécution

Un champ,
et rien à régler.

Ce scraper n'a ni limite ni tri - la transcription est ce qu'elle est. La seule chose que vous décidez, c'est la façon de transmettre les vidéos.

Identifiant de vidéo seul URL watch?v= Lien court youtu.be Coller un par ligne Import CSV Import XLSX Import TXT Import Parquet
Cas d'usage courants

Trois tâches que l'on exécute
le plus souvent ici.

Quelques exemples de ce que les équipes font des paroles une fois qu'elles sont dans un tableur.

Recherche

Chercher une formule dans tout un catalogue

Extrayez les transcriptions des vidéos d'une chaîne et filtrez la colonne de texte. Trouver chaque mention d'un produit, d'un concurrent ou d'une affirmation demande un filtre plutôt qu'un après-midi d'avance rapide.

Research · Comms
Contenu

Transformer des interventions en écrits

Une transcription est le premier jet d'un article, d'une page de notes d'émission ou d'un jeu de sous-titres. Le champ de texte intégral vous donne l'ensemble dans une cellule, et les lignes horodatées vous donnent les repères pour renvoyer vers la vidéo.

Contenu
IA

Donner à un modèle de quoi citer

Les segments horodatés se découpent proprement pour la recherche documentaire, et chaque morceau sait déjà de quelle vidéo il vient et à quel endroit. C'est la différence entre une réponse et une réponse assortie d'un lien vers la seconde où cela a été dit.

Data · ML
Tarifs

Ne payez que les segments
que vous extrayez vraiment.

Pas d'abonnement, pas de minimum, pas de facture récurrente. Vos 500 premières lignes sont offertes - ensuite, paiement à l'usage, au même tarif forfaitaire que tous les autres scrapers d'ici.

Offre gratuite

500 lignes gratuites - 0 $

Sur chaque nouveau compte, une seule fois. Aucune carte bancaire requise. Import de fichier et tous les formats d'export inclus. De quoi voir la forme d'une transcription avant de bâtir dessus.

0 $ pour toujours
Paiement à l'usage

0,002 $ par ligne, après l'offre gratuite

Le même tarif forfaitaire que tous les autres scrapers de la plateforme. L'estimateur affiche le nombre de lignes et le coût en crédits avant le démarrage - pas de facture surprise, pas d'unités de calcul à convertir.

Le plus choisi
Volume

Sur mesure · gros volume

Tarifs au volume, workers dédiés et un SLA pour la surveillance continue ou de très gros historiques. Dites-nous vos chiffres et nous vous faisons une offre.

Parlons-en
10 % de remise sur votre première exécution payante.Utilisez le code LIVESCRAPER10 au paiement.
S'inscrire
S'associe bien avec

Ce qui a été dit,
et où on l'a trouvé.

Le volet juridique

Est-il légal de scraper
les transcriptions YouTube ?

Réponse courte : les sous-titres sont servis avec la vidéo - et ce que vous avez le droit de faire ensuite des mots relève du droit d'auteur, pas du scraping.

Une piste de sous-titres est servie à quiconque ouvre la vidéo, connecté ou non ; c'est ainsi que fonctionne le bouton des sous-titres. Lire cette même piste publique à des fins de recherche est une pratique établie de longue date, et rien ici ne touche à une connexion ni à un paywall. Une vidéo sans sous-titres n'a pas de transcription à lire : c'est pourquoi le scraper en exige une et le dit clairement.

Ce qu'il faut anticiper n'est pas l'accès mais la réutilisation. Une transcription, ce sont les mots de l'auteur, et la vidéo est son œuvre protégée - citer, indexer, rechercher et analyser se situent donc sur un tout autre terrain que republier une intervention comme votre propre article. Si vous entraînez un modèle dessus ou le reproduisez longuement, c'est une question de licence, et il vous revient d'y répondre avant de passer à l'échelle.

Les conditions de YouTube restreignent l'accès automatisé, c'est donc autant une question contractuelle que juridique - si vous avez une relation contractuelle avec la plateforme, vérifiez-la. Nous n'exécutons aucun traceur tiers sur la couche de données, et vos exports sont supprimés automatiquement au bout de 30 jours.

livescraper.app · principes
Uniquement les pistes de sous-titres publiques
Aucune connexion, aucun compte touché
Les mots restent ceux de l'auteur!
Votre IP n'est jamais utilisée - les nôtres tournent
Les exports s'auto-suppriment (30 jours)
Vérifiez les conditions de YouTube avant de passer à l'échelle.
Questions fréquentes

Ce que l'on demande
avant de s'inscrire.

Les questions qui reviennent le plus. Autre chose ? Parlons-en - ce sont des humains, pas des bots, qui écrivent les réponses.

Comment scraper une transcription YouTube ?+
Avec le Scraper de transcriptions YouTube :
  1. Connectez-vous à la plateforme.
  2. Ouvrez le Scraper de transcriptions YouTube.
  3. Collez des identifiants ou des URL de vidéos YouTube, un par ligne - ou importez un fichier CSV, XLSX, TXT ou Parquet.
  4. Choisissez votre format de sortie.
  5. Cliquez sur Get Data.
  6. Téléchargez la transcription en CSV, XLSX ou JSON.
Que représente une ligne ?+
Un segment de sous-titre, pas une vidéo. Une vidéo occupe autant de lignes que sa transcription compte de segments, et query, video_id et language se répètent sur chacune. Si vous préférez une ligne par vidéo, regroupez par video_id et prenez la première ligne de chaque groupe - c'est là que se trouve la transcription complète.
Pourquoi les colonnes segments et transcript sont-elles vides sur la plupart des lignes ?+
Parce qu'elles sont écrites une fois par vidéo et non une fois par ligne. Les deux apparaissent sur la première ligne de chaque vidéo et sont vides sur les lignes restantes de cette vidéo - cela s'est vérifié sur chacune de nos exécutions au format actuel, sans exception. C'est une convention de regroupement, pas un échec de collecte : segments vous dit combien de lignes cette vidéo occupe, et transcript contient l'ensemble en un bloc de texte.
Puis-je coller une URL YouTube complète, ou faut-il l'identifiant ?+
L'un ou l'autre, et un lien court youtu.be fonctionne aussi. Une URL watch portant des paramètres supplémentaires - une playlist, un indicateur radio - se résout correctement, et l'identifiant obtenu revient dans la colonne video_id : vous pouvez donc faire la jointure dessus plutôt que sur ce que vous avez collé.
Que se passe-t-il si une vidéo n'a pas de sous-titres ?+
Il n'y a pas de transcription à renvoyer. Les sous-titres sont la source que cet outil lit : une vidéo dont ils sont désactivés ne produit rien - c'est l'exigence indiquée sur l'outil lui-même, pas une erreur de votre côté. Vérifiez que la vidéo a un bouton de sous-titres avant de conclure à un échec.
Les horodatages servent-ils pour des liens profonds ?+
Oui. Chaque segment porte son instant de départ en secondes depuis le début de la vidéo, et sa durée, tous deux en nombres décimaux. C'est suffisant pour construire un lien de saut, découper un extrait, ou aligner une citation sur le moment où elle a été prononcée.
La sortie a-t-elle changé récemment ?+
Oui, le 03/07/2026. Les exécutions antérieures au changement exportaient cinq colonnes à une ligne par vidéo, avec la transcription entière dans une seule cellule. Celles postérieures exportent les huit colonnes décrites ici à une ligne par segment. C'est un changement de ce que signifie une ligne, pas seulement des colonnes en plus - si vous détenez un fichier plus ancien, il a une autre forme, et aucun des deux n'est erroné.
Combien ça coûte ?+
Les 500 premières lignes sont gratuites et offertes une seule fois, sans carte bancaire. Ensuite, c'est 0,002 $ par ligne - le même tarif forfaitaire que tous les autres scrapers de la plateforme. Rappelez-vous qu'ici une ligne est un segment : une vidéo longue coûte donc plus qu'une courte. L'estimateur affiche le coût d'une exécution avant qu'elle ne démarre.

Vos 500 premiers segments,
offerts par la maison.

500 lignes gratuites une seule fois sur chaque nouveau compte - sans expiration. Ensuite, 0,002 $ par ligne, au fil de l'eau - aucune carte enregistrée tant que vous ne le décidez pas.

Activation immédiate · sans carte bancaire

Scraper les transcriptions YouTube à grande échelle

Le Scraper de transcriptions YouTube de Livescraper transforme une liste de vidéos en texte. Vous soumettez des identifiants ou des URL de vidéos YouTube - saisis un par ligne, ou importés en CSV, XLSX, TXT ou Parquet - et téléchargez la piste de sous-titres sous forme de fichier CSV, Excel ou JSON propre. Les identifiants seuls, les liens watch et les liens courts youtu.be fonctionnent tous, et une URL watch portant des paramètres de playlist se résout toujours vers la bonne vidéo.

Une ligne est un segment de sous-titre. Chacune porte ce qui a été dit, la seconde où cela commence et la durée, aux côtés de la requête soumise, de l'identifiant de vidéo obtenu et de la langue de la piste. Deux autres colonnes fonctionnent par vidéo et non par ligne : segments, c'est-à-dire combien de lignes cette vidéo occupe, et transcript, qui contient l'ensemble en un bloc de texte. Toutes deux se trouvent sur la première ligne de chaque vidéo, et c'est le détail à connaître avant d'écrire un parser.

Les chercheurs extraient le catalogue d'une chaîne et cherchent une formule dans le texte au lieu d'avancer en accéléré. Les équipes contenu transforment des interventions en articles, en notes d'émission et en sous-titres. Les équipes qui construisent des systèmes de recherche documentaire utilisent les segments horodatés comme des morceaux qui savent déjà de quelle vidéo ils viennent et à quel endroit - la différence entre une réponse et une réponse que l'on peut relier à la seconde où elle a été prononcée.

Deux choses méritent d'être connues avant de commencer. Une vidéo dont les sous-titres sont désactivés n'a pas de transcription à renvoyer : les sous-titres sont une exigence, pas un bonus. Et parce qu'une ligne est un segment, une vidéo longue coûte plus qu'une courte au même tarif forfaitaire de 0,002 $ par ligne. Commencez gratuitement : vos 500 premières lignes ne coûtent rien et ne demandent aucune carte bancaire.