Scraper de Busca do YouTube

Uma expressão de pesquisa,
como tabela de resultados.

Escreva o que escreveria no YouTube e receba os resultados como linhas, pela ordem em que foram devolvidos: o id e o título do vídeo, o canal, a contagem de visualizações como número exato, a duração, há quanto tempo foi publicado, um link e uma miniatura. Nove colunas, uma linha por resultado.

500 linhas grátis, uma única vezdepois 0,002 $ por linha9 colunasCSV · XLSX · JSON
Como funciona

Entra uma expressão,
saem os resultados.

A entrada é um termo de pesquisa e mais nada - as mesmas palavras que poria na caixa do site.

  1. PASSO 1Inicie sessão na plataforma.
  2. PASSO 2Abra o YouTube Search Scraper.
  3. PASSO 3Escreva as suas expressões de pesquisa, uma por linha - ou carregue um ficheiro CSV, XLSX, TXT ou Parquet.
  4. PASSO 4Defina um limite por consulta, ou deixe-o vazio para levar tudo o que houver.
  5. PASSO 5Escolha o formato de saída.
  6. PASSO 6Clique em Get Data.

Lê os próprios dados de resultados incorporados do YouTube através do conjunto de proxies, e funciona com o gratuito - o seu próprio endereço nunca é usado, e nada aqui precisa de um proxy pago.

Porque as equipas o usam

A página de resultados,
pela ordem em que chegou.

Palavras-chave, não contas

Uma expressão por linha é toda a entrada. Nada tem de ser resolvido para um canal primeiro, o que faz dela a ferramenta certa quando a pergunta é sobre um tema e não sobre alguém em particular.

Visualizações ao dígito

A contagem chega escrita por extenso em vez de arredondada para 1.2M, por isso dois vídeos que no ecrã parecem iguais continuam distinguíveis no ficheiro.

Funciona com o conjunto gratuito

Nenhum proxy pago para tratar nem chave para obter. Os pedidos saem pelo conjunto partilhado em vez do seu próprio endereço, e para este isso chega.

O que recebe

Nove colunas -
e a única coisa que não está nelas.

Esta exportação tem dados reais por trás, por isso os formatos abaixo estão medidos. O que convém saber primeiro nem sequer é um formato - é uma ausência.

Não há coluna de posição. Os resultados chegam pela ordem em que a pesquisa os devolveu, e essa ordem não é transportada por nada a não ser pela posição da linha no ficheiro. Abra-o numa folha de cálculo, ordene por visualizações para ver os maiores, guarde - e a ordenação por que veio desapareceu, sem nada nos dados a partir do qual a reconstruir. Se a ordem lhe interessa, acrescente a sua própria coluna de índice na importação, antes de mais alguma coisa tocar no ficheiro.

A outra coisa a saber é o que esta ferramenta não é. Aceita apenas expressões de pesquisa e identifica canais pelo nome visível em vez de por um id. Se a sua pergunta é sobre um canal em concreto - o seu catálogo, os seus shorts, como os seus vídeos se ordenam entre si -, o YouTube Video Scraper é o que traz ids de canal, uma distinção shorts/normais e uma coluna de posição. Este é para perguntas sobre um tema.

Dicionário de dados

Nove colunas,
por ordem de exportação.

Retiradas da linha de cabeçalho e das chaves JSON de execuções reais e confrontadas com a lista de colunas publicada da plataforma. Todas as colunas são cadeias de texto; os formatos abaixo estão medidos em células preenchidas.

query
A expressão de pesquisa de onde esta linha veio, repetida em cada linha que produziu. A única coisa que separa os resultados quando submete várias pesquisas de uma vez.
video_id
O id do YouTube para o vídeo, sempre onze caracteres. Aqui é único dentro de uma execução, por isso não é preciso desduplicar - vale a pena notar, porque isso não é verdade no video scraper.
title
O título do vídeo. Pode trazer espaços no fim, por isso apare antes de comparar ou agrupar por ele.
channel
O nome visível do canal - e apenas o nome. Nesta exportação não há id de canal, por isso agrupar por canal é agrupar por uma etiqueta que dois canais podem partilhar e que um canal pode mudar. Também traz espaços no fim.
views
A contagem de visualizações, escrita por extenso com separadores de milhares - 49,498 views, 18,226,447 views. Nunca abreviada, e não há coluna numérica à parte, por isso retire as vírgulas e a palavra final você mesmo. Nem sempre é uma contagem de visualizações: uma única visualização lê-se 1 view, e uma transmissão em direto lê-se <n> watching ou chega vazia.
duration
A duração como m:ss, ou h:mm:ss assim que um vídeo passa da hora. Não está presente numa transmissão em direto.
published
Há quanto tempo antes da execução o vídeo foi publicado, como expressão relativa - 1 day ago, 5 months ago, 9 years ago. Nunca uma data absoluta, e não está presente numa transmissão em direto. Veja a nota abaixo sobre como a ancorar.
url
Um link para o vídeo, sempre na forma /watch?v=<id>. O id está sempre lá. Note que nenhuma coluna lhe diz se um resultado é um short ou um vídeo normal.
thumbnail
Um link para a imagem de pré-visualização, com a sua própria cadeia de consulta. O nome do ficheiro varia - hq720, hqdefault e variantes personalizadas -, por isso leia a coluna em vez de construir o URL você mesmo. O id do vídeo está sempre lá.

Três ausências moldam a forma de usar este ficheiro. Não há coluna de posição, por isso a ordem da pesquisa vive apenas na ordem das linhas - ordene o ficheiro sobre si mesmo e é irrecuperável; acrescente o seu próprio índice na importação. Não há id de canal, apenas um nome visível, por isso agrupar por canal é agrupar por algo que dois canais podem partilhar e que um canal pode mudar. E não há qualquer marca temporal nas nove, enquanto published é relativa - o ficheiro diz que um vídeo é de há 5 meses relativamente ao momento em que o correu, e lido mais tarde diz as mesmas palavras sobre outra data. Guarde a data da execução ao lado. Quanto aos formatos: views é o número exato com separadores de milhares em vez de um 1.2M arredondado, o contrário do video scraper - a precisão está aqui, mas a análise é sua. Uma transmissão em direto volta sem duração e sem data de publicação, com espectadores em simultâneo na coluna das visualizações ou sem nada. E title e channel trazem ambos espaços no fim.

Controlos de execução

Definido na tarefa,
não na folha de cálculo.

Expressões de pesquisa e um limite. É essa toda a entrada - não há campo de canal, nem de playlist, nem tipo de vídeo a escolher, e é isso que mantém este simples e o que o encaminha para o video scraper quando precisa de mais.

Expressão de pesquisa Uma por linha Limite por consulta Limite vazio leva tudo Carregamento CSV Carregamento XLSX Carregamento TXT Carregamento Parquet Conjunto de proxies gratuito, nunca o seu IP
Fluxos de trabalho comuns

Três tarefas que correm
aqui mais do que quaisquer outras.

Alguns exemplos de como as equipas usam resultados de pesquisa para responder a uma pergunta que têm mesmo.

Visibilidade

Ver de quem é um tema

Uma expressão devolve os vídeos e os canais por trás deles pela ordem em que o YouTube os classificou. Manter a ordem das linhas intacta é o que transforma isso num retrato de quem é visível para um termo, e não apenas numa lista de vídeos sobre ele.

Conteúdo · SEO
Procura

Comparar quão cheias estão duas expressões

Correr várias expressões num trabalho e ler as contagens de visualizações lado a lado mostra que formulação de um assunto tem público e qual só tem carregamentos. Como as contagens são exatas e não arredondadas, os casos renhidos continuam decidíveis.

Investigação
Prospeção

Encontrar criadores a trabalhar num nicho

Uma pesquisa por tema traz à superfície os canais ativos nele, com contagens de visualizações agregadas, o que é melhor ponto de partida para contactar do que uma lista curada por alguém. Passe ao video scraper assim que souber que catálogo quer.

Parcerias
Preços

Pague só pelos resultados
que realmente extrai.

Sem subscrição, sem mínimo, sem fatura recorrente. As suas primeiras 500 linhas são por nossa conta - depois paga conforme usa, à mesma tarifa fixa de qualquer outro scraper daqui.

Nível gratuito

500 linhas grátis - 0 $

Em cada conta nova, uma única vez. Sem cartão de crédito. Limites por consulta, carregamento de ficheiros e todos os formatos de exportação incluídos.

0 $ para sempre
Conforme usa

0,002 $ por linha após o nível gratuito

Cerca de 2 $ por cada 1.000 resultados, e sem fatura de proxy por cima - este corre no conjunto gratuito. O estimador mostra o número de linhas e o custo em créditos antes de uma execução arrancar.

O mais escolhido
Volume

À medida · grande volume

Preços por volume, workers dedicados e um SLA para monitorização contínua ou extrações históricas muito grandes. Diga-nos os seus números e preparamos uma proposta.

Fale connosco
10 % de desconto na sua primeira execução paga.Use o código LIVESCRAPER10 no pagamento.
Registar
Combina bem com

Uma pesquisa,
e as do lado.

A parte legal

É legal fazer scraping
da pesquisa do YouTube?

Resposta curta: isto lê a lista pública de resultados e não retira conteúdo de vídeo - mas os termos do YouTube são mais estritos do que os da maioria dos sites, e isso merece uma leitura a sério em vez de um sossego.

O que volta é o que a página de resultados mostra a qualquer pessoa que faça a mesma pesquisa: títulos, nomes de canais, contagens de visualizações, durações, há quanto tempo algo foi publicado e miniaturas. Não é descarregado nenhum ficheiro de vídeo, não há qualquer início de sessão envolvido, e não se toca em conteúdo privado nem exclusivo para membros.

Dito isto, os Termos de Serviço do YouTube restringem o acesso automatizado, e esta é uma plataforma que o diz explicitamente em vez de o deixar implícito. A Google publica ainda uma Data API oficial que cobre a pesquisa. Se opera a qualquer escala, ou constrói um produto sobre os resultados, a posição honesta é que a API oficial é a via sancionada e isto não é - o que faz disto uma decisão sua e do seu próprio aconselhamento, e não uma que esta página possa tomar por si.

Sobre dados pessoais: as linhas descrevem vídeos e canais, não pessoas, e o nome de um canal é uma identidade publicada. Mas o canal de um criador pequeno é muitas vezes uma pessoa com outro nome, por isso se estiver a perfilar indivíduos em vez de medir o que posiciona, é aí que as obrigações de proteção de dados começam a aplicar-se-lhe. Não corremos rastreadores de terceiros na camada de dados, e as suas exportações apagam-se sozinhas ao fim de 30 dias.

livescraper.app · princípios
Apenas listas públicas de resultados
Sem ficheiros de vídeo, sem inícios de sessão, sem conteúdo de membros
Os termos do YouTube restringem o acesso automatizado - leia-os
Existe uma Data API oficial e é a via sancionada
As exportações apagam-se sozinhas (30 dias)
Reveja os termos do próprio YouTube antes de escalar.
Perguntas frequentes

O que as pessoas perguntam
antes de se registarem.

As perguntas que mais ouvimos. Mais alguma? Fale connosco - as respostas são escritas por pessoas, não por bots.

Como faço scraping dos resultados de pesquisa do YouTube?+
Com o YouTube Search Scraper:
  1. Inicie sessão na plataforma.
  2. Abra o YouTube Search Scraper.
  3. Escreva as suas expressões de pesquisa, uma por linha - ou carregue um ficheiro CSV, XLSX, TXT ou Parquet.
  4. Defina um limite por consulta, ou deixe-o vazio para levar tudo o que houver.
  5. Escolha o formato de saída.
  6. Clique em Get Data.
Como mantenho a ordenação da pesquisa?+
Acrescente a sua própria coluna de índice na importação, antes de mais alguma coisa tocar no ficheiro. Nesta exportação não há coluna de ordenação nem de posição - a ordem pela qual os resultados foram devolvidos é transportada apenas pela ordem das linhas. Isso sobrevive a uma leitura simples e não sobrevive a uma ordenação, por isso uma folha de cálculo ordenada por visualizações perdeu a ordenação sem nada nos dados a partir do qual a reconstruir.
Posso pesquisar um canal específico com isto?+
Com este não. Aceita apenas expressões de pesquisa e identifica canais pelo nome visível em vez de por um id, por isso não consegue distinguir com fiabilidade dois canais com o mesmo nome. Se a sua pergunta é sobre um canal em concreto - o seu catálogo, os seus shorts, como os seus próprios vídeos se comparam -, o YouTube Video Scraper aceita canais e playlists diretamente e traz o id do canal.
A contagem de visualizações é exata ou arredondada?+
Exata. Chega escrita por extenso com separadores de milhares, como 49,498 views ou 18,226,447 views, em vez de abreviada para 49K ou 18M. Não há coluna numérica à parte, por isso retire as vírgulas e a palavra final você mesmo antes de fazer contas. Isto é o contrário do YouTube Video Scraper, onde a cadeia apresentada é arredondada e uma segunda coluna traz o número exato.
Porque é que algumas linhas não têm duração nem data de publicação?+
São transmissões em direto. Uma transmissão a decorrer não tem duração nem data de publicação para reportar, por isso ambas as colunas voltam vazias nessas linhas, e a coluna das visualizações mostra quantas pessoas estão a ver ou está também vazia. Filtre-as antes de fazer médias de durações ou visualizações, porque são outra espécie de coisa.
Porque é que não há data de publicação, só «há 5 meses»?+
Porque é o que a página de resultados dá, e a exportação passa-o adiante em vez de inventar uma data. A consequência é que o valor é relativo ao momento em que correu o trabalho, e não há nenhuma coluna de marca temporal entre as nove para o ancorar. Registe a data da execução junto ao ficheiro - lido um mês depois, o mesmo ficheiro diz as mesmas palavras sobre outra data.
Consigo distinguir shorts de vídeos normais?+
A partir desta exportação, não. Não há coluna de tipo de vídeo, e todos os links voltam na forma watch habitual, por isso nada nos dados distingue uns dos outros. O YouTube Video Scraper distingue-os - devolve uns ou outros por execução e etiqueta cada linha.
Quanto custa?+
As primeiras 500 linhas são grátis e de uma só vez, sem cartão de crédito. Depois disso são 0,002 $ por linha - cerca de 2 $ por cada 1.000 resultados - que é a mesma tarifa fixa de qualquer outro scraper da plataforma, sem fatura de proxy por cima porque este corre no conjunto gratuito. O estimador mostra o custo de uma execução antes de ela arrancar.

Os seus primeiros 500 resultados,
são por nossa conta.

500 linhas grátis de uma só vez em cada conta nova - sem data de validade. Depois 0,002 $ por linha, conforme usa - sem cartão guardado até que o diga.

Ativo de imediato · sem cartão

Fazer scraping dos resultados de pesquisa do YouTube em escala

O YouTube Search Scraper da Livescraper transforma uma expressão de pesquisa numa tabela de resultados. Escreve as suas expressões uma por linha - ou carrega-as como ficheiro CSV, XLSX, TXT ou Parquet -, limita as linhas por consulta e descarrega os resultados como um CSV, um Excel ou um JSON limpos. Lê os próprios dados de resultados incorporados do YouTube através do conjunto partilhado de proxies, e funciona com o gratuito, por isso não há nenhum proxy pago para tratar.

Cada linha traz nove colunas: a expressão de onde veio, o id e o título do vídeo, o nome do canal, a contagem de visualizações escrita por extenso, a duração, há quanto tempo o vídeo foi publicado, um link e uma miniatura. Tudo chega como texto.

As equipas de conteúdo e SEO correm uma expressão para ver que vídeos e canais são visíveis para ela. Quem investiga compara várias formulações do mesmo assunto lado a lado, usando as contagens exatas para resolver os casos renhidos. As equipas de parcerias usam uma pesquisa por tema para encontrar os criadores a trabalhar num nicho antes de passar ao video scraper para um catálogo em concreto.

Aqui três ausências importam mais do que qualquer formato. Não há coluna de posição, por isso a ordem da pesquisa é transportada apenas pela ordem das linhas - acrescente o seu próprio índice na importação, porque um ficheiro ordenado por visualizações perdeu a ordenação de vez. Não há id de canal, apenas um nome visível, por isso agrupar por canal significa agrupar por uma etiqueta que dois canais podem partilhar. E não há marca temporal em lado nenhum, enquanto a data de publicação é relativa, por isso registe quando correu o trabalho ou o ficheiro passará a significar outra coisa em silêncio um mês depois. Comece grátis: as suas primeiras 500 linhas não custam nada e não exigem cartão de crédito, e depois é uma tarifa fixa de 0,002 $ por linha.