Fazer scraping de perfis do Twitter/X para uma planilha
O Scraper de Perfis do Twitter da Livescraper transforma uma lista de handles em dados de perfil. Você envia handles do Twitter/X ou URLs de perfil - digitados um por linha, ou enviados como arquivo CSV, XLSX, TXT ou Parquet - e baixa o resultado como um arquivo CSV, Excel ou JSON limpo, uma linha por perfil. As duas formas de entrada levam à mesma conta, então uma lista que ninguém normalizou funciona como está, e toda linha carrega a consulta que a produziu. Não há campo de limite neste serviço: as contas que você nomeia são as linhas que você recebe.
A exportação carrega doze colunas: a consulta que você enviou, o nome de exibição e o handle, a bio, as contagens de seguidores e seguindo, a localização, o site, uma marca de verificação e uma data de entrada, o avatar e o link canônico do perfil. Tudo é string, e o JSON acrescenta um décimo terceiro campo, position, que o CSV e o XLSX não têm.
Uma coisa nesta página importa mais que o resto, e é uma limitação e não um recurso. Em toda exportação que temos, seis dessas doze colunas estavam vazias em todas as linhas - followers, following, location, website, verified e joined - enquanto query, name, username, bio, avatar e profile_url carregaram um valor todas as vezes. A própria nota da plataforma sobre este serviço diz que o X exige uma sessão logada para dados completos, junto com um proxy residencial, e toda exportação que temos foi feita sem sessão. Isso é coerente com o que vemos, mas nunca tivemos uma execução feita com uma, então esta página não promete que fornecer uma sessão preenche essas colunas - ela lhe diz o que vimos e deixa o resto para uma pequena primeira execução. Pelo mesmo motivo não há aqui nenhuma taxa de preenchimento. Um detalhe prático para levar ao seu carregador: bio pode conter quebras de linha, e uma bio que ocupa várias linhas dentro de uma célula vai quebrar qualquer importação que divida o CSV por quebras de linha em vez de interpretar campos entre aspas.
Esta exportação descreve pessoas identificáveis, o que a torna dado pessoal sob o GDPR e regimes comparáveis. Tudo o que é coletado é mostrado a qualquer visitante em um perfil público e nada é inferido, mas pesquisa agregada e montar uma lista curta para abordar são usos comuns de um jeito que monitorar uma pessoa ao longo do tempo não é. Os próprios termos do X restringem o acesso automatizado, então verifique antes de escalar. Comece grátis: suas primeiras 500 linhas não custam nada e não precisam de cartão, e depois são US$ 0,002 por linha, tarifa plana.