Extractor de YouTube Video

El catálogo de un canal,
como una tabla.

Dale un canal, una lista de reproducción o una palabra clave y recibe los vídeos como filas: el id y el título del vídeo, un enlace, el canal y su id, el recuento de visualizaciones tal como lo imprime YouTube y también como número que puedes sumar, cuánto hace que se publicó, la duración y una miniatura. Doce columnas, una fila por vídeo.

500 filas gratis, una sola vezdespués 0,002 $ por fila12 columnasCSV · XLSX · JSON
Cómo funciona

Entra un canal,
salen sus vídeos.

La caja de entrada acepta cuatro cosas distintas, y puedes mezclarlas en una lista: un canal, una lista de reproducción o simplemente una frase para buscar.

  1. PASO 1Inicia sesión en la plataforma.
  2. PASO 2Abre el YouTube Video Scraper.
  3. PASO 3Pega tus consultas, una por línea: una URL de canal, un @handle, un id de canal, una URL de lista de reproducción o una palabra clave. O sube un archivo CSV, XLSX, TXT o Parquet.
  4. PASO 4Elige el tipo de vídeo: Shorts Only o Regular Videos Only.
  5. PASO 5Fija un límite por consulta, o déjalo vacío para llevártelo todo.
  6. PASO 6Haz clic en Get Data.

Lee la propia interfaz JSON de YouTube en lugar de raspar el HTML de la página, y por eso los campos vuelven estructurados en vez de extraídos de una maquetación que cambia.

Por qué lo usan los equipos

El catálogo,
no solo la portada.

Cuatro formas de decir lo que quieres

Una URL de canal, un @handle, un id de canal, un enlace de lista de reproducción o una palabra clave suelta van todos a la misma caja, y puedes mezclarlos en una lista. No hay que normalizar nada antes de empezar.

Un recuento de visualizaciones que se puede sumar

El texto que se muestra y el número subyacente llegan como columnas separadas, así que nada tiene que adivinar qué significa 1.2M antes de poder calcular un total.

La interfaz, no la página

Lee la propia interfaz JSON de YouTube en lugar de analizar HTML renderizado. Por eso las columnas se mantienen estables aunque la maquetación del sitio no lo haga.

Lo que recibes

Doce columnas -
y dos decisiones antes.

Esta exportación tiene datos reales detrás, así que los formatos de abajo están medidos y no descritos. Dos de sus propiedades cambian cómo planificas una ejecución, y ambas merecen ir antes de la tabla.

Shorts y vídeos normales son una elección, no un filtro. El control de tipo de vídeo es un o lo uno o lo otro: una ejecución devuelve unos u otros, nunca ambos, y ninguna de las nuestras los mezcló jamás. De ahí se sigue que sacar toda la producción de un canal son dos ejecuciones y no una. También importa para lo que recibes: cada fila de shorts llega sin fecha de publicación y sin duración, porque un short no las muestra. Si tu análisis necesita una fecha o una duración, necesitas la pasada de vídeos normales.

La fecha de publicación es relativa, y nada en el archivo la ancla. Todos los valores se leen como hace 9 días o hace 3 meses, y no hay columna de captura, ni marca de tiempo, ni nada fechado en las doce. Así que la exportación no puede decirte cuándo se publicó realmente un vídeo, solo qué antigüedad tenía cuando miraste. Anota la fecha de la ejecución junto al archivo, porque una semana después el mismo archivo significa otra cosa en silencio.

Diccionario de datos

Doce columnas,
en orden de exportación.

Tomadas de la fila de cabecera y de las claves JSON de ejecuciones reales y contrastadas con la lista de columnas publicada de la plataforma. Los formatos están medidos sobre celdas con datos.

query
La consulta de la que salió esta fila, repetida en cada fila que produjo. Conviene conservarla: es lo único que separa los resultados cuando envías más de una consulta a la vez.
video_id
El id de YouTube para el vídeo, siempre once caracteres. La columna por la que indexar, y por la que deduplicar, porque el mismo vídeo puede aparecer más de una vez en una ejecución.
title
El título del vídeo. Puede llevar espacios al final, así que recórtalo antes de comparar o agrupar por él.
url
Un enlace al vídeo. La forma sigue a video_type: /watch?v=<id> para un vídeo normal y /shorts/<id> para un short. El id siempre está dentro.
channel_title
El nombre visible del canal. También lleva espacios al final, y puede quedar vacío en resultados que vinieron de una búsqueda por palabra clave.
channel_id
El id del canal, siempre empieza por UC. La forma estable de agrupar por canal: un canal puede cambiarse el nombre y esto no cambiará. También puede quedar vacío en resultados de palabra clave.
views
El recuento de visualizaciones tal como lo imprime YouTube: una cadena redondeada y abreviada como 5.6K views. No siempre es un recuento de visualizaciones: una sola visualización se lee 1 view, y una retransmisión en directo se lee <n> watching, que son espectadores simultáneos y no reproducciones acumuladas.
views_parsed
El número. Pese al nombre, este es el recuento exacto y no la cadena mostrada analizada: un vídeo que muestra 4.1M views volvió como 4099999. Esta es la columna por la que sumar, ordenar y comparar; views es para enseñar a una persona.
published
Cuánto antes de la ejecución se publicó el vídeo, como frase relativa: 9 days ago, 2 weeks ago, 3 months ago. Nunca una fecha absoluta, y nunca presente en un short. Mira la nota de abajo sobre cómo anclarla.
length
La duración como m:ss o h:mm:ss. No está presente en un short, ni en una retransmisión en directo.
video_type
O short o video, según el tipo de vídeo que elegiste para la ejecución. Una ejecución devuelve uno u otro, así que esta columna es constante dentro de un archivo: está para distinguir dos archivos después.
thumbnail
Un enlace a la imagen de vista previa. El nombre de archivo varía -frame0.jpg en shorts, y hqdefault, hq720 y variantes personalizadas en el resto-, así que lee la columna en vez de construir la URL tú. El id del vídeo siempre está dentro.

Tres cosas muerden si no las previenes. Primera: published es relativa y no hay ninguna marca de tiempo en el archivo - ni captura, ni fecha de ejecución, nada. La exportación te dice que un vídeo es de hace 3 meses respecto al momento en que la lanzaste, y un archivo leído más tarde dice las mismas palabras sobre otra fecha. Guarda la fecha de la ejecución con el archivo. Segunda: views_parsed es el número exacto y views es el texto redondeado, al revés de lo que el nombre sugiere: suma y ordena por views_parsed. Tercera: el mismo video_id puede aparecer más de una vez en una ejecución - lo comprobamos, y la única columna que difiere entre las copias es query, porque dos entradas que resuelven al mismo canal devuelven cada una el vídeo. Deduplica por video_id si quieres vídeos únicos, o conserva las copias si te importa qué consulta encontró qué. Y una cosa menor: title y channel_title llevan ambas espacios al final, así que recorta antes de comparar.

Controles de ejecución

Se ajusta en el trabajo,
no en la hoja de cálculo.

Una lista de entrada, un límite y una elección excluyente. El tipo de vídeo es la que cambia qué vuelve y no cuánto: elígela a conciencia.

URL de canal @handle Id de canal URL de lista de reproducción Palabra clave Shorts Only Regular Videos Only Límite por consulta Subida CSV · XLSX · TXT · Parquet
Flujos de trabajo habituales

Tres tareas que se ejecutan
aquí más que ninguna otra.

Algunos ejemplos de cómo los equipos usan el catálogo de un canal para responder a una pregunta que de verdad tienen.

Competencia

Ver qué publica de verdad un canal rival

Un handle a la entrada, el catálogo a la salida, con recuentos de visualizaciones que puedes sumar. Dos ejecuciones -una de shorts y otra de vídeos normales- muestran cómo reparte un canal su esfuerzo entre formatos, algo que un vistazo a la portada no revela.

Competencia · Contenido
Ranking

Encontrar los vídeos que sostienen un canal

Ordenar por el recuento numérico separa el puñado de vídeos que hace el trabajo de la cola larga. Como el número es exacto y no el texto redondeado, el orden se mantiene incluso entre vídeos que en pantalla se leen igual.

Analítica
Prospección

Construir una preselección a partir de una palabra clave

Una frase suelta en la caja de consulta busca en YouTube, así que un tema se convierte en una lista de candidatos con canales y visualizaciones adjuntos: un punto de partida para contactar con creadores que no son los favoritos de alguien.

Alianzas
Precios

Paga solo por los vídeos
que realmente extraes.

Sin suscripción, sin mínimo, sin factura recurrente. Tus primeras 500 filas corren de nuestra cuenta; después pagas por uso, a la misma tarifa plana que cualquier otro scraper de aquí.

Nivel gratuito

500 filas gratis - 0 $

En cada cuenta nueva, una sola vez. Sin tarjeta de crédito. Límites por consulta, subida de archivos y todos los formatos de exportación incluidos.

0 $ para siempre
Pago por uso

0,002 $ por fila tras el nivel gratuito

Unos 2 $ por cada 1.000 vídeos. Conviene recordar que los shorts de un canal y sus vídeos normales son dos ejecuciones, así que un catálogo completo cuesta las dos. El estimador muestra el número de filas y el coste en créditos antes de arrancar.

El más elegido
Volumen

A medida · gran volumen

Precios por volumen, workers dedicados y un SLA para monitorización continua o descargas históricas muy grandes. Dinos tus cifras y preparamos un presupuesto.

Habla con nosotros
10 % de descuento en tu primera ejecución de pago.Usa el código LIVESCRAPER10 al pagar.
Registrarse
Combina bien con

Un catálogo,
y los de al lado.

La parte legal

¿Es legal hacer scraping
de vídeos de YouTube?

Respuesta corta: esto lee metadatos públicos de listado a través de la propia interfaz de YouTube y no toma contenido de vídeo, pero los términos de YouTube son más estrictos que la mayoría, y eso conviene leerlo bien.

Lo que vuelve es la información que una página de canal muestra a cualquiera: títulos, recuentos de visualizaciones, cuánto hace que se publicó algo, duraciones y miniaturas. No se descarga ningún archivo de vídeo, no se toca nada tras un inicio de sesión y no hay contenido privado ni exclusivo para miembros de por medio. El scraper lee la propia interfaz JSON de YouTube en lugar de analizar la página renderizada.

Dicho esto, los Términos del Servicio de YouTube restringen el acceso automatizado y, a diferencia de un marketplace o un directorio, esta es una plataforma que lo dice explícitamente y lo hace cumplir. Google además publica una Data API oficial para buena parte de esto. Si operas a cualquier escala, o construyes un producto sobre los resultados, la posición honesta es que la API oficial es la vía sancionada y esto no lo es, así que la decisión es tuya y de tu propio asesoramiento, no algo que esta página pueda decidir por ti.

Sobre datos personales: las filas describen vídeos y canales, no individuos, y el nombre de un canal es una identidad publicada, no privada. Aun así, el canal de un creador pequeño puede ser una persona con otro nombre, así que si construyes algo que perfila a individuos en lugar de medir contenido, ese es el punto en el que las obligaciones de protección de datos empiezan a aplicarte. No ejecutamos rastreadores de terceros en la capa de datos y tus exportaciones se borran solas a los 30 días.

livescraper.app · principios
Solo metadatos públicos de listado
Sin archivos de vídeo, sin inicios de sesión, sin contenido de miembros
Los términos de YouTube restringen el acceso automatizado: léelos
Existe una Data API oficial y es la vía sancionada
Las exportaciones se borran solas (30 días)
Revisa los términos propios de YouTube antes de escalar.
Preguntas frecuentes

Lo que pregunta la gente
antes de registrarse.

Las preguntas que más nos hacen. ¿Alguna más? Habla con nosotros: las respuestas las escriben personas, no bots.

¿Cómo hago scraping de vídeos de YouTube?+
Con el YouTube Video Scraper:
  1. Inicia sesión en la plataforma.
  2. Abre el YouTube Video Scraper.
  3. Pega tus consultas, una por línea: una URL de canal, un @handle, un id de canal, una URL de lista de reproducción o una palabra clave. O sube un archivo CSV, XLSX, TXT o Parquet.
  4. Elige el tipo de vídeo: Shorts Only o Regular Videos Only.
  5. Fija un límite por consulta, o déjalo vacío para llevártelo todo.
  6. Haz clic en Get Data.
¿Puedo obtener shorts y vídeos normales en una sola ejecución?+
No. El control de tipo de vídeo es excluyente y no un filtro, y se aplica a todas las consultas de la ejecución, así que toda la producción de un canal son dos ejecuciones. También es la razón de que algunas columnas parezcan desnudas en una ejecución de shorts: un short no tiene fecha de publicación ni duración que mostrar, así que sencillamente no hay nada que esas columnas puedan llevar; no es un hueco en los datos.
¿Por qué no hay fecha de publicación, solo «hace 3 meses»?+
Porque es lo que da el listado, y la exportación lo traslada tal cual en vez de inventarse una fecha. La consecuencia importante es que el valor es relativo al momento en que lanzaste el trabajo, y no hay ninguna columna de marca de tiempo entre las doce con la que anclarlo. Anota la fecha de la ejecución junto al archivo: el mismo archivo leído un mes después dice las mismas palabras sobre otra fecha.
¿Cuál es la diferencia entre views y views_parsed?+
La columna views es lo que imprime YouTube: una cadena redondeada y abreviada como 5.6K views. La columna views_parsed es el número y, pese al nombre, es el recuento exacto y no esa cadena analizada: un vídeo que muestra 4.1M views volvió como 4099999. Suma, ordena y compara por views_parsed, y usa views solo cuando enseñes algo a una persona.
¿Por qué aparece el mismo vídeo dos veces?+
Porque dos de tus consultas resolvieron al mismo canal. Comprobamos las copias campo por campo y la única columna que difiere es query: por ejemplo, un @handle y la URL completa del canal devuelven cada uno el mismo vídeo. Deduplica por video_id si quieres vídeos únicos, o conserva ambas filas si te importa qué consulta encontró qué.
¿Qué significa «watching» en la columna views?+
Es una retransmisión en directo. La columna views lleva lo que muestre el listado, así que para una retransmisión en curso se lee como un número de personas viendo y no como un recuento acumulado de visualizaciones. Esas filas además llegan sin fecha de publicación y sin duración, aunque estén tipadas como vídeos normales, así que exclúyelas antes de promediar nada.
¿Qué puedo poner en la caja de consulta?+
Cuatro cosas, y puedes mezclarlas en una lista: una URL de canal, un @handle, un id de canal o una URL de lista de reproducción. Cualquier cosa que no sea una de ellas se trata como palabra clave y se busca en YouTube. También puedes subir la lista como archivo CSV, XLSX, TXT o Parquet en lugar de escribirla.
¿Cuánto cuesta?+
Las primeras 500 filas son gratis y de una sola vez, sin tarjeta de crédito. Después son 0,002 $ por fila -unos 2 $ por cada 1.000 vídeos-, la misma tarifa plana que cualquier otro scraper de la plataforma. Recuerda que los shorts y los vídeos normales son ejecuciones separadas, así que un catálogo completo se factura como ambas. El estimador muestra el coste de una ejecución antes de que arranque.

Tus primeros 500 vídeos,
invita la casa.

500 filas gratis de una sola vez en cada cuenta nueva, sin fecha de caducidad. Después, 0,002 $ por fila y pago por uso: sin tarjeta guardada hasta que tú lo digas.

Activo al instante · sin tarjeta

Hacer scraping de datos de vídeos de YouTube a escala

El YouTube Video Scraper de Livescraper convierte un canal, una lista de reproducción o una frase de búsqueda en una tabla de vídeos. Pegas tus consultas una por línea -una URL de canal, un @handle, un id de canal, un enlace de lista o una palabra clave- o las subes como archivo CSV, XLSX, TXT o Parquet, eliges si quieres shorts o vídeos normales, limitas las filas por consulta y descargas los resultados como un CSV, un Excel o un JSON limpios. Lee la propia interfaz JSON de YouTube en lugar de analizar HTML renderizado.

Cada fila lleva doce columnas: la consulta de la que salió, el id y el título del vídeo, un enlace, el nombre del canal y su id, el recuento de visualizaciones tal como lo imprime YouTube y también como número exacto, cuánto hace que se publicó, su duración, si es un short o un vídeo normal, y un enlace a la miniatura.

Los equipos de contenido lanzan el handle de un rival para ver qué se publica de verdad y no lo que destaca la portada. Los analistas ordenan por el recuento exacto para separar los vídeos que sostienen un canal de su cola larga. Los equipos de alianzas ponen un tema como palabra clave y obtienen una lista de candidatos con canales y visualizaciones adjuntos.

Conviene conocer tres propiedades antes de construir sobre esto. Shorts y vídeos normales son una elección excluyente y no un filtro, así que toda la producción de un canal son dos ejecuciones, y los shorts llegan sin fecha de publicación y sin duración porque un short no las muestra. La fecha de publicación que sí llevan los vídeos normales es relativa, se lee como hace 9 días o hace 3 meses, y no hay ninguna columna de marca de tiempo en la exportación que la ancle, así que anota la fecha de la ejecución junto al archivo. Y views_parsed es el recuento exacto mientras que views es el texto redondeado, al revés de lo que sugiere el nombre: suma y ordena por el primero. Empieza gratis: tus primeras 500 filas no cuestan nada y no requieren tarjeta de crédito, y después es una tarifa plana de 0,002 $ por fila.