Scraper de Transcrições do YouTube

O que foi realmente dito,
como planilha.

Informe um id ou uma URL de vídeo do YouTube e receba a transcrição como linhas - uma linha por segmento de legenda, cada uma com o texto, o momento em que começa e quanto dura, mais a transcrição inteira num único campo. Oito colunas. Sem conta no YouTube, sem proxy residencial, sem parser para manter vivo.

500 linhas grátis, uma única vezUS$ 0,002 por linha depois8 colunasCSV · XLSX · JSON
Como funciona

Entra uma lista de vídeos,
saem as palavras ditas.

A entrada é o vídeo. Cole o que você já tem - o id puro, um link watch ou um link curto youtu.be - e o job busca a faixa de legendas por trás dele.

  1. PASSO 1Entre na plataforma.
  2. PASSO 2Abra o Scraper de Transcrições do YouTube.
  3. PASSO 3Cole ids ou URLs de vídeos do YouTube, um por linha - ou envie um arquivo CSV, XLSX, TXT ou Parquet.
  4. PASSO 4Escolha o formato de saída.
  5. PASSO 5Clique em Get Data.
  6. PASSO 6Baixe a transcrição como CSV, XLSX ou JSON.

Cada linha vem marcada com a consulta de que veio e com o id do vídeo a que pertence - assim, uma execução sobre o equivalente a uma playlist ainda bate com a sua lista de entrada.

Por que as equipes usam

Fala que dá para
buscar e citar.

Um id, um link watch ou um link curto

Os três vão no mesmo campo, um por linha. Uma URL watch com parâmetros extras - uma playlist, uma marca de rádio - ainda resolve para o vídeo certo, e o id resolvido volta em coluna própria para você cruzar por ele.

Cronometrado ao segundo

Cada segmento traz o momento em que começa e quanto dura, ambos em segundos decimais. É isso que transforma uma parede de fala em algo para onde dá para pular - montar um link direto, cortar um trecho, ou alinhar uma citação com o quadro de onde ela veio.

Os segmentos e o todo

Você recebe as duas formas num arquivo: uma linha por segmento para tudo que é cronometrado, e a transcrição completa como um único campo para o que só precisa do texto. O dicionário de dados explica exatamente onde fica esse campo de texto completo, porque ele não está em todas as linhas.

O que você recebe

Oito colunas,
uma linha por segmento.

Cada linha é um segmento de legenda: o que foi dito, quando começa e quanto dura, marcado com o vídeo a que pertence e a consulta que você enviou.

A lista de colunas abaixo é a linha de cabeçalho de exportações reais, corroborada pelo array de colunas que a interface de execução renderiza; as duas batem exatamente. Duas das oito se comportam de forma diferente das demais - aparecem uma vez por vídeo, e não uma vez por linha - e é isso que mais tende a surpreender, então está detalhado na tabela e de novo na nota abaixo dela.

Dicionário de dados

Oito colunas,
e duas delas são especiais.

Extraído da linha de cabeçalho de execuções reais. As notas descrevem o que cada coluna contém e como ela se repete - não quantas linhas você vai receber, porque isso é uma propriedade da faixa de legendas do vídeo, e não do scraper.

query
O id ou a URL do vídeo que você enviou, repetido em cada linha que veio dele - inclusive os parâmetros extras da URL, exatamente como você digitou.
video_id
O id do YouTube para o qual a consulta resolveu, repetido em cada linha daquele vídeo. É por esta coluna que se cruza: uma URL watch com playlist e o id puro chegam aqui como o mesmo valor.
language
O código de idioma da faixa de legendas, repetido em cada linha do vídeo. Só executamos vídeos em inglês, então en é o único valor que vimos - a página não chuta o que mais a coluna pode conter.
segments
Só na primeira linha de cada vídeo. Em quantos segmentos a transcrição daquele vídeo foi dividida - que é também quantas linhas o vídeo ocupa. Em todas as outras linhas do mesmo vídeo fica vazia. Um inteiro onde está preenchida, não uma string.
transcript
Só na primeira linha de cada vídeo. A transcrição inteira como um bloco de texto, com os segmentos unidos.
text
O que foi dito neste segmento. Presente em todas as linhas - esta é a metade por linha da exportação.
start
Quando o segmento começa, em segundos desde o início do vídeo, como número decimal. Sobe ao longo de um vídeo e recomeça no seguinte.
duration
Quanto o segmento dura, em segundos, como número decimal.

Três coisas para saber antes de escrever código contra isto. Uma linha é um segmento, não um vídeo - um vídeo ocupa tantas linhas quantos segmentos a faixa de legendas tiver, e query, video_id e language se repetem por todas elas. segments e transcript quebram esse padrão: são escritas só na primeira linha de cada vídeo e ficam vazias no resto, então agrupe por video_id e pegue a primeira linha em vez de esperá-las em todo lugar. E start e duration voltam como números de verdade enquanto todo o resto é texto - inclusive segments, que é um inteiro onde está preenchida e uma string vazia onde não está, então um parser estrito precisa tolerar as duas coisas.

Controles da execução

Um campo,
e nada para ajustar.

Este scraper não tem limite nem ordenação - a transcrição é o que é. A única coisa que você decide é como entrega os vídeos.

Id de vídeo puro URL watch?v= Link curto youtu.be Colar um por linha Upload de CSV Upload de XLSX Upload de TXT Upload de Parquet
Fluxos de trabalho comuns

Três tarefas que as pessoas
mais executam aqui.

Alguns exemplos do que as equipes fazem com as palavras ditas depois que elas estão numa planilha.

Pesquisa

Procurar uma frase em todo um acervo

Puxe as transcrições dos vídeos de um canal e filtre a coluna de texto. Achar cada menção a um produto, a um concorrente ou a uma afirmação custa um filtro em vez de uma tarde adiantando a reprodução.

Research · Comms
Conteúdo

Transformar palestras em material escrito

Uma transcrição é o primeiro rascunho de um artigo, de uma página de notas do episódio ou de um conjunto de legendas. O campo de texto completo entrega tudo numa célula, e as linhas cronometradas dão as marcações para linkar de volta.

Conteúdo
IA

Dar a um modelo algo que ele possa citar

Segmentos cronometrados se dividem bem para recuperação, e cada trecho já sabe de que vídeo veio e de que ponto. Essa é a diferença entre uma resposta e uma resposta com link para o segundo em que foi dito.

Data · ML
Preços

Pague só pelos segmentos
que você realmente puxa.

Sem assinatura, sem mínimo, sem fatura recorrente. Suas primeiras 500 linhas são por nossa conta - depois, pague conforme o uso, na mesma tarifa fixa de qualquer outro scraper daqui.

Plano gratuito

500 linhas grátis - US$ 0

Em toda conta nova, uma única vez. Sem cartão de crédito. Upload de arquivo e todos os formatos de exportação incluídos. Suficiente para ver o formato de uma transcrição antes de construir em cima dela.

US$ 0 para sempre
Pague conforme o uso

US$ 0,002 por linha, após o plano gratuito

A mesma tarifa fixa de qualquer outro scraper da plataforma. O estimador prévio mostra a quantidade de linhas e o custo em créditos antes de a execução começar - sem contas surpresa, sem unidades de computação para traduzir.

Mais popular
Volume

Sob medida · alto volume

Preço por volume, workers dedicados e um SLA para monitoramento contínuo ou extrações históricas muito grandes. Diga-nos seus números e faremos uma proposta.

Fale conosco
10% de desconto na sua primeira execução paga.Use o código LIVESCRAPER10 no checkout.
Cadastre-se
Combina bem com

O que foi dito,
e onde foi encontrado.

A parte jurídica

É legal fazer scraping
de transcrições do YouTube?

Resposta curta: as legendas são entregues junto com o vídeo - e o que você pode fazer com as palavras depois é uma questão de direitos autorais, não de scraping.

Uma faixa de legendas é entregue a qualquer pessoa que abra o vídeo, logada ou não; é assim que o botão de legendas funciona. Ler essa mesma faixa pública para pesquisa é prática consolidada há muito tempo, e nada aqui toca em login ou paywall. Um vídeo sem legendas não tem transcrição para ler, e é por isso que o scraper precisa de uma e diz isso com clareza.

O que há para planejar não é o acesso, e sim a reutilização. Uma transcrição são as palavras de quem criou, e o vídeo é a obra protegida dessa pessoa - então citar, indexar, buscar e analisar ficam num terreno bem diferente de republicar uma palestra como artigo seu. Se você vai treinar em cima disso ou reproduzir em extensão, isso é uma questão de licenciamento, e cabe a você responder antes de escalar.

Os termos do YouTube restringem o acesso automatizado, então esta é tanto uma questão contratual quanto jurídica - se você tem relação contratual com a plataforma, confira. Não rodamos rastreadores de terceiros na camada de dados, e suas exportações se apagam sozinhas após 30 dias.

livescraper.app · princípios
Apenas faixas de legendas públicas
Sem logins, sem tocar em contas
As palavras continuam sendo de quem as disse!
Seu IP nunca é usado - os nossos rotacionam
Exportações se apagam sozinhas (30 dias)
Confira os termos do próprio YouTube antes de escalar.
Perguntas frequentes

O que as pessoas perguntam
antes de se cadastrar.

As perguntas que mais ouvimos. Mais alguma coisa? Fale conosco - quem escreve as respostas são pessoas, não bots.

Como faço scraping de uma transcrição do YouTube?+
Com o Scraper de Transcrições do YouTube:
  1. Entre na plataforma.
  2. Abra o Scraper de Transcrições do YouTube.
  3. Cole ids ou URLs de vídeos do YouTube, um por linha - ou envie um arquivo CSV, XLSX, TXT ou Parquet.
  4. Escolha o formato de saída.
  5. Clique em Get Data.
  6. Baixe a transcrição como CSV, XLSX ou JSON.
O que uma linha representa?+
Um segmento de legenda, não um vídeo. Um vídeo ocupa tantas linhas quantos segmentos a transcrição tiver, e query, video_id e language se repetem por todas elas. Se você quiser uma linha por vídeo, agrupe por video_id e pegue a primeira linha de cada grupo - é ali que fica a transcrição completa.
Por que as colunas segments e transcript estão vazias na maioria das linhas?+
Porque são escritas uma vez por vídeo, e não uma vez por linha. As duas aparecem na primeira linha de cada vídeo e ficam vazias nas linhas restantes daquele vídeo - valeu para todas as execuções no formato atual que fizemos, sem exceção. É uma convenção de agrupamento, não uma falha de coleta: segments diz quantas linhas aquele vídeo ocupa, e transcript guarda o todo como um bloco de texto.
Posso colar uma URL completa do YouTube, ou precisa ser o id?+
Qualquer um dos dois, e um link curto youtu.be também funciona. Uma URL watch com parâmetros extras - uma playlist, uma marca de rádio - resolve corretamente, e o id resolvido volta na coluna video_id, então você pode cruzar por ele em vez do que colou.
O que acontece se um vídeo não tiver legendas?+
Não há transcrição para devolver. As legendas são a fonte que isto lê, então um vídeo com elas desativadas não produz nada - esse é o requisito indicado na própria ferramenta, não um erro do seu lado. Confira se o vídeo tem botão de legendas antes de considerar a execução falha.
As marcações de tempo servem para links diretos?+
Sim. Cada segmento traz o momento em que começa, em segundos desde o início do vídeo, e quanto dura, ambos como números decimais. Isso basta para montar um link de salto, cortar um trecho, ou alinhar uma citação com o momento em que foi dita.
A saída mudou recentemente?+
Sim, em 03/07/2026. As execuções anteriores à mudança exportavam cinco colunas com uma linha por vídeo e a transcrição inteira numa única célula. As posteriores exportam as oito colunas descritas aqui com uma linha por segmento. Isso é uma mudança no que uma linha significa, não só colunas extras - se você tem um arquivo mais antigo, ele tem outro formato, e nenhum dos dois está errado.
Quanto custa?+
As primeiras 500 linhas são grátis e valem uma única vez, sem cartão de crédito. Depois disso são US$ 0,002 por linha - a mesma tarifa fixa de qualquer outro scraper da plataforma. Lembre que aqui uma linha é um segmento, então um vídeo longo custa mais que um curto; o estimador mostra o custo de uma execução antes de ela começar.

Seus primeiros 500 segmentos,
por conta da casa.

500 linhas grátis, uma única vez, em toda conta nova - sem prazo de validade. Depois são US$ 0,002 por linha, conforme o uso - sem cartão cadastrado até você decidir.

Ativa na hora · sem cartão

Faça scraping de transcrições do YouTube em escala

O Scraper de Transcrições do YouTube da Livescraper transforma uma lista de vídeos em texto. Você envia ids ou URLs de vídeos do YouTube - digitados um por linha, ou enviados como arquivo CSV, XLSX, TXT ou Parquet - e baixa a faixa de legendas num arquivo CSV, Excel ou JSON limpo. Ids puros, links watch e links curtos youtu.be funcionam todos, e uma URL watch com parâmetros de playlist ainda resolve para o vídeo certo.

Uma linha é um segmento de legenda. Cada uma traz o que foi dito, o segundo em que começa e quanto dura, junto com a consulta que você enviou, o id do vídeo para o qual resolveu e o idioma da faixa. Outras duas colunas funcionam por vídeo, e não por linha: segments, que é quantas linhas aquele vídeo ocupa, e transcript, que guarda o todo como um bloco de texto. As duas ficam na primeira linha de cada vídeo, e esse é o detalhe que vale saber antes de escrever um parser.

Pesquisadores puxam o acervo de um canal e buscam uma frase no texto em vez de adiantar a reprodução. Equipes de conteúdo transformam palestras em artigos, notas de episódio e legendas. Equipes que constroem sistemas de recuperação usam os segmentos cronometrados como trechos que já sabem de que vídeo vieram e de que ponto - a diferença entre uma resposta e uma resposta que você pode linkar ao segundo em que foi dita.

Duas coisas valem saber antes de começar. Um vídeo com as legendas desativadas não tem transcrição para devolver, então legendas são requisito e não um extra. E porque uma linha é um segmento, um vídeo longo custa mais que um curto na mesma tarifa fixa de US$ 0,002 por linha. Comece grátis: suas primeiras 500 linhas não custam nada e não exigem cartão.