Extracteur YouTube Video

Le catalogue d'une chaîne,
en tableau.

Donnez-lui une chaîne, une playlist ou un mot-clé et récupérez les vidéos en lignes : l'id et le titre de la vidéo, un lien, la chaîne et son id, le nombre de vues à la fois tel que YouTube l'imprime et sous forme de nombre que vous pouvez additionner, depuis combien de temps elle est en ligne, la durée et une miniature. Douze colonnes, une ligne par vidéo.

500 lignes gratuites, une seule foispuis 0,002 $ par ligne12 colonnesCSV · XLSX · JSON
Comment ça marche

Une chaîne en entrée,
ses vidéos en sortie.

Le champ de saisie accepte quatre choses différentes, et vous pouvez les mélanger dans une même liste - une chaîne, une playlist, ou simplement une expression à rechercher.

  1. ÉTAPE 1Connectez-vous à la plateforme.
  2. ÉTAPE 2Ouvrez le YouTube Video Scraper.
  3. ÉTAPE 3Collez vos requêtes, une par ligne - une URL de chaîne, un @handle, un id de chaîne, une URL de playlist, ou un simple mot-clé. Ou importez un fichier CSV, XLSX, TXT ou Parquet.
  4. ÉTAPE 4Choisissez le type de vidéo : Shorts Only ou Regular Videos Only.
  5. ÉTAPE 5Fixez une limite par requête, ou laissez-la vide pour tout prendre.
  6. ÉTAPE 6Cliquez sur Get Data.

Il lit l'interface JSON de YouTube plutôt que de scraper le HTML de la page, et c'est pourquoi les champs reviennent structurés au lieu d'être extraits d'une mise en page qui change.

Pourquoi les équipes l'utilisent

Le catalogue,
pas seulement la vitrine.

Quatre façons de dire ce que vous voulez

Une URL de chaîne, un @handle, un id de chaîne, un lien de playlist ou un simple mot-clé vont tous dans le même champ, et vous pouvez les mélanger dans une liste. Rien n'a besoin d'être normalisé avant de commencer.

Un nombre de vues réellement additionnable

Le texte affiché et le nombre sous-jacent arrivent en colonnes séparées : rien n'a donc à deviner ce que veut dire 1.2M avant de pouvoir calculer un total.

L'interface, pas la page

Il lit l'interface JSON de YouTube plutôt que d'analyser du HTML rendu. C'est pourquoi les colonnes restent stables quand la mise en page du site, elle, ne l'est pas.

Ce que vous récupérez

Douze colonnes -
et deux décisions à prendre d'abord.

Cet export repose sur de vraies données : les formats ci-dessous sont donc mesurés et non décrits. Deux de ses propriétés changent la façon de planifier une exécution, et elles méritent de venir avant le tableau.

Shorts et vidéos classiques sont un choix, pas un filtre. Le réglage du type de vidéo est un ou bien l'un ou bien l'autre : une exécution renvoie les uns ou les autres, jamais les deux, et aucune de nos exécutions ne les a jamais mélangés. Il s'ensuit que récupérer toute la production d'une chaîne, ce sont deux exécutions et non une. Cela compte aussi pour ce que vous récupérez : chaque ligne de short arrive sans date de publication et sans durée, parce qu'un short n'en affiche pas. Si votre analyse a besoin d'une date ou d'une durée, il vous faut la passe sur les vidéos classiques.

La date de publication est relative, et rien dans le fichier ne l'ancre. Chaque valeur se lit il y a 9 jours ou il y a 3 mois, et il n'existe ni colonne de capture, ni horodatage, ni quoi que ce soit de daté parmi les douze. L'export ne peut donc pas vous dire quand une vidéo a réellement été mise en ligne - seulement quel âge elle avait au moment où vous avez regardé. Notez la date d'exécution à côté du fichier, car une semaine plus tard le même fichier veut discrètement dire autre chose.

Dictionnaire de données

Douze colonnes,
dans l'ordre d'export.

Relevées dans la ligne d'en-tête et les clés JSON d'exécutions réelles, et recoupées avec la liste de colonnes publiée de la plateforme. Les formats sont mesurés sur des cellules remplies.

query
La requête dont provient cette ligne, répétée sur chaque ligne qu'elle a produite. À conserver : c'est la seule chose qui sépare les résultats quand vous soumettez plusieurs requêtes à la fois.
video_id
L'id YouTube de la vidéo, toujours onze caractères. La colonne sur laquelle s'appuyer - et sur laquelle dédoublonner, car une même vidéo peut apparaître plusieurs fois dans une exécution.
title
Le titre de la vidéo. Il peut porter des espaces en fin de chaîne : nettoyez-le avant de faire des rapprochements ou des regroupements dessus.
url
Un lien vers la vidéo. La forme suit video_type : /watch?v=<id> pour une vidéo classique et /shorts/<id> pour un short. L'id y figure toujours.
channel_title
Le nom affiché de la chaîne. Porte lui aussi des espaces en fin de chaîne, et peut être vide sur des résultats issus d'une recherche par mot-clé.
channel_id
L'id de la chaîne, commençant toujours par UC. La façon stable de regrouper par chaîne - une chaîne peut se renommer, ceci ne changera pas. Il peut lui aussi être vide sur des résultats de mot-clé.
views
Le nombre de vues tel que YouTube l'imprime - une chaîne arrondie et abrégée comme 5.6K views. Ce n'est pas toujours un nombre de vues : une vue unique se lit 1 view, et un direct se lit <n> watching, c'est-à-dire des spectateurs simultanés plutôt que des lectures cumulées.
views_parsed
Le nombre. Malgré son nom, c'est le compte exact et non la chaîne affichée analysée - une vidéo affichant 4.1M views est revenue à 4099999. C'est la colonne sur laquelle sommer, trier et comparer ; views sert à montrer quelque chose à un humain.
published
Depuis combien de temps avant l'exécution la vidéo est en ligne, sous forme relative - 9 days ago, 2 weeks ago, 3 months ago. Jamais une date absolue, et jamais présent sur un short. Voyez la note ci-dessous sur la façon de l'ancrer.
length
La durée, en m:ss ou h:mm:ss. Absente sur un short, et absente sur un direct.
video_type
Soit short, soit video, selon le type que vous avez choisi pour l'exécution. Une exécution renvoie l'un ou l'autre : cette colonne est donc constante à l'intérieur d'un fichier - elle sert à distinguer deux fichiers après coup.
thumbnail
Un lien vers l'image d'aperçu. Le nom de fichier varie - frame0.jpg sur les shorts, et hqdefault, hq720 et des variantes personnalisées ailleurs - alors lisez la colonne plutôt que de fabriquer l'URL vous-même. L'id de la vidéo y figure toujours.

Trois choses mordent si vous ne les anticipez pas. D'abord, published est relative et il n'y a aucun horodatage dans le fichier - pas de date de capture, pas de date d'exécution, rien. L'export vous dit qu'une vidéo date d'il y a 3 mois par rapport au moment où vous l'avez lancé, et le même fichier lu plus tard dit les mêmes mots à propos d'une autre date. Stockez la date d'exécution avec le fichier. Ensuite, views_parsed est le nombre exact et views le texte arrondi, à l'inverse de ce que le nom laisse croire : sommez et triez sur views_parsed. Enfin, le même video_id peut apparaître plusieurs fois dans une exécution - nous avons vérifié, et la seule colonne qui diffère entre les copies est query, parce que deux saisies qui pointent vers la même chaîne renvoient chacune la vidéo. Dédoublonnez sur video_id si vous voulez des vidéos uniques, ou gardez les copies si vous tenez à savoir quelle requête a trouvé quoi. Et un détail : title et channel_title portent tous deux des espaces en fin de chaîne, nettoyez avant tout rapprochement.

Réglages d'exécution

Réglé sur la tâche,
pas dans le tableur.

Une liste d'entrée, une limite et un choix exclusif. Le type de vidéo est celui qui change ce qui revient et non la quantité - choisissez-le délibérément.

URL de chaîne @handle Id de chaîne URL de playlist Simple mot-clé Shorts Only Regular Videos Only Limite par requête Import CSV · XLSX · TXT · Parquet
Cas d'usage courants

Trois tâches qui tournent
ici plus que les autres.

Quelques exemples de la façon dont les équipes se servent du catalogue d'une chaîne pour répondre à une question qu'elles se posent vraiment.

Concurrence

Voir ce qu'une chaîne rivale publie vraiment

Un handle en entrée, le catalogue en sortie, avec des nombres de vues additionnables. Deux exécutions - une shorts, une classique - montrent comment une chaîne répartit son effort entre les formats, ce qu'un coup d'œil à la vitrine ne dira pas.

Concurrence · Contenu
Classement

Trouver les vidéos qui portent une chaîne

Trier sur le nombre de vues exact sépare la poignée de vidéos qui font le travail de la longue traîne. Comme le nombre est exact et non le texte arrondi, l'ordre tient même entre des vidéos qui s'affichent toutes pareil à l'écran.

Analytique
Sourcing

Bâtir une présélection à partir d'un mot-clé

Une simple expression dans le champ de requête cherche sur YouTube : un sujet devient donc une liste de candidats avec chaînes et nombres de vues attachés - un point de départ pour approcher des créateurs qui ne soit pas la liste de favoris de quelqu'un.

Partenariats
Tarifs

Ne payez que les vidéos
que vous extrayez vraiment.

Pas d'abonnement, pas de minimum, pas de facture récurrente. Vos 500 premières lignes sont pour nous - ensuite vous payez à l'usage, au même tarif forfaitaire que tous les autres scrapers d'ici.

Offre gratuite

500 lignes gratuites - 0 $

Sur chaque nouveau compte, une seule fois. Sans carte bancaire. Limites par requête, import de fichiers et tous les formats d'export inclus.

0 $ pour toujours
À l'usage

0,002 $ par ligne après l'offre gratuite

Environ 2 $ pour 1 000 vidéos. À garder en tête : les shorts d'une chaîne et ses vidéos classiques sont deux exécutions, un catalogue complet coûte donc les deux. L'estimateur affiche le nombre de lignes et le coût en crédits avant le lancement.

Le plus choisi
Volume

Sur mesure · gros volumes

Tarifs au volume, workers dédiés et SLA pour un suivi continu ou de très gros extraits historiques. Donnez-nous vos chiffres, nous préparons un devis.

Parlons-en
10 % de remise sur votre première exécution payante.Utilisez le code LIVESCRAPER10 au paiement.
S'inscrire
Va bien avec

Un catalogue,
et ceux d'à côté.

Le point juridique

Le scraping des
vidéos YouTube est-il légal ?

Réponse courte : ceci lit des métadonnées de listing publiques via l'interface de YouTube elle-même et ne prend aucun contenu vidéo - mais les conditions de YouTube sont plus strictes que la plupart, et cela mérite une vraie lecture.

Ce qui revient, c'est l'information qu'une page de chaîne montre à tout le monde : titres, nombres de vues, ancienneté, durées et miniatures. Aucun fichier vidéo n'est téléchargé, rien derrière une connexion n'est touché, et aucun contenu privé ou réservé aux membres n'est concerné. Le scraper lit l'interface JSON de YouTube plutôt que d'analyser la page rendue.

Cela dit, les conditions d'utilisation de YouTube restreignent l'accès automatisé et, contrairement à une place de marché ou à un annuaire, c'est une plateforme qui le dit explicitement et le fait respecter. Google publie par ailleurs une Data API officielle pour l'essentiel de tout cela. Si vous opérez à une quelconque échelle, ou construisez un produit sur les résultats, la position honnête est que l'API officielle est la voie sanctionnée et que ceci ne l'est pas - la décision vous appartient donc, avec votre propre conseil, et non à cette page.

Sur les données personnelles : les lignes décrivent des vidéos et des chaînes, pas des individus, et un nom de chaîne est une identité publiée et non privée. Cela dit, la chaîne d'un petit créateur peut être une personne sous un autre nom : si vous construisez quelque chose qui profile des individus plutôt que de mesurer du contenu, c'est là que les obligations de protection des données commencent à vous concerner. Nous n'exécutons aucun traceur tiers sur la couche de données, et vos exports s'effacent d'eux-mêmes au bout de 30 jours.

livescraper.app · principes
Métadonnées de listing publiques uniquement
Aucun fichier vidéo, aucune connexion, aucun contenu réservé aux membres
Les CGU de YouTube restreignent l'accès automatisé - lisez-les
Une Data API officielle existe et constitue la voie sanctionnée
Les exports s'effacent seuls (30 jours)
Relisez les conditions de YouTube avant de passer à l'échelle.
Questions fréquentes

Ce que l'on demande
avant de s'inscrire.

Les questions qui reviennent le plus. Une autre ? Écrivez-nous - ce sont des humains qui rédigent les réponses, pas des bots.

Comment scraper des vidéos YouTube ?+
Avec le YouTube Video Scraper :
  1. Connectez-vous à la plateforme.
  2. Ouvrez le YouTube Video Scraper.
  3. Collez vos requêtes, une par ligne - une URL de chaîne, un @handle, un id de chaîne, une URL de playlist, ou un simple mot-clé. Ou importez un fichier CSV, XLSX, TXT ou Parquet.
  4. Choisissez le type de vidéo : Shorts Only ou Regular Videos Only.
  5. Fixez une limite par requête, ou laissez-la vide pour tout prendre.
  6. Cliquez sur Get Data.
Puis-je obtenir shorts et vidéos classiques en une seule exécution ?+
Non. Le réglage du type de vidéo est exclusif et non un filtre, et il s'applique à toutes les requêtes de l'exécution : la production complète d'une chaîne, ce sont donc deux exécutions. C'est aussi pourquoi certaines colonnes paraissent dépouillées sur une exécution shorts : un short n'a ni date de publication ni durée à montrer, il n'y a donc tout simplement rien à mettre dans ces colonnes - ce n'est pas un trou dans les données.
Pourquoi n'y a-t-il pas de date de publication, seulement « il y a 3 mois » ?+
Parce que c'est ce que donne le listing, et l'export le transmet tel quel plutôt que d'inventer une date. La conséquence importante, c'est que la valeur est relative au moment où vous avez lancé la tâche, et qu'il n'existe aucune colonne d'horodatage parmi les douze pour l'ancrer. Notez la date d'exécution à côté du fichier - le même fichier lu un mois plus tard dit les mêmes mots à propos d'une autre date.
Quelle différence entre views et views_parsed ?+
La colonne views est ce qu'imprime YouTube - une chaîne arrondie et abrégée comme 5.6K views. La colonne views_parsed est le nombre et, malgré son nom, c'est le compte exact et non cette chaîne analysée : une vidéo affichant 4.1M views est revenue à 4099999. Sommez, triez et comparez sur views_parsed, et n'utilisez views que pour montrer quelque chose à une personne.
Pourquoi la même vidéo apparaît-elle deux fois ?+
Parce que deux de vos requêtes pointaient vers la même chaîne. Nous avons comparé les copies champ par champ et la seule colonne qui diffère est query - par exemple un @handle et l'URL complète de la chaîne renvoient chacun la même vidéo. Dédoublonnez sur video_id si vous voulez des vidéos uniques, ou gardez les deux lignes si vous tenez à savoir quelle requête a trouvé quoi.
Que signifie « watching » dans la colonne views ?+
C'est un direct. La colonne views porte ce qu'affiche le listing : pour un direct en cours, elle se lit donc comme un nombre de personnes en train de regarder et non comme un cumul de vues. Ces lignes arrivent en outre sans date de publication et sans durée, bien qu'elles soient typées comme des vidéos classiques - excluez-les avant de calculer une moyenne.
Que puis-je mettre dans le champ de requête ?+
Quatre choses, et vous pouvez les mélanger dans une même liste : une URL de chaîne, un @handle, un id de chaîne, ou une URL de playlist. Tout ce qui n'est pas l'un de ces quatre est traité comme un mot-clé et recherché sur YouTube. Vous pouvez aussi importer la liste sous forme de fichier CSV, XLSX, TXT ou Parquet au lieu de la saisir.
Combien ça coûte ?+
Les 500 premières lignes sont gratuites et offertes une seule fois, sans carte bancaire. Ensuite, c'est 0,002 $ par ligne - environ 2 $ pour 1 000 vidéos - soit le même tarif forfaitaire que tous les autres scrapers de la plateforme. Rappelez-vous que shorts et vidéos classiques sont des exécutions distinctes : un catalogue complet est donc facturé comme les deux. L'estimateur affiche le coût d'une exécution avant son lancement.

Vos 500 premières vidéos,
c'est la maison qui offre.

500 lignes gratuites une seule fois sur chaque nouveau compte - sans date d'expiration. Ensuite 0,002 $ par ligne à l'usage - aucune carte enregistrée tant que vous ne le décidez pas.

Actif immédiatement · sans carte bancaire

Scraper les données vidéo de YouTube à grande échelle

Le YouTube Video Scraper de Livescraper transforme une chaîne, une playlist ou une expression de recherche en tableau de vidéos. Vous collez vos requêtes une par ligne - une URL de chaîne, un @handle, un id de chaîne, un lien de playlist ou un simple mot-clé - ou vous les importez en CSV, XLSX, TXT ou Parquet, vous choisissez shorts ou vidéos classiques, plafonnez les lignes par requête, et téléchargez les résultats en CSV, Excel ou JSON propres. Il lit l'interface JSON de YouTube plutôt que d'analyser du HTML rendu.

Chaque ligne porte douze colonnes : la requête dont elle provient, l'id et le titre de la vidéo, un lien, le nom de la chaîne et son id, le nombre de vues à la fois tel que YouTube l'imprime et en nombre exact, depuis combien de temps la vidéo est en ligne, sa durée, s'il s'agit d'un short ou d'une vidéo classique, et un lien de miniature.

Les équipes contenu lancent le handle d'un concurrent pour voir ce qui est réellement publié plutôt que ce que la vitrine met en avant. Les analystes trient sur le nombre de vues exact pour séparer les vidéos qui portent une chaîne de sa longue traîne. Les équipes partenariats saisissent un sujet en mot-clé et obtiennent une liste de créateurs candidats, chaînes et nombres de vues à l'appui.

Trois propriétés méritent d'être connues avant de bâtir dessus. Shorts et vidéos classiques sont un choix exclusif et non un filtre : la production complète d'une chaîne, ce sont deux exécutions - et les shorts arrivent sans date de publication ni durée, parce qu'un short n'en affiche pas. La date de publication que portent les vidéos classiques est relative, se lisant il y a 9 jours ou il y a 3 mois, et aucune colonne d'horodatage de l'export ne l'ancre : notez donc la date d'exécution à côté du fichier. Et views_parsed est le compte exact tandis que views est le texte arrondi, à l'inverse de ce que le nom suggère - sommez et triez sur le premier. Commencez gratuitement : vos 500 premières lignes ne coûtent rien et ne demandent pas de carte bancaire, puis c'est un forfait de 0,002 $ par ligne.