Extrator Universal com IA

Para os sites que
não têm extrator próprio.

Cole a URL de qualquer página, nomeie os atributos que quiser - preço, descrição, nota, o que a página tiver - e receba-os como colunas. Não há parser por site para esperar: a página é lida e os campos que você pediu saem como uma linha.

500 linhas grátis, uma única vezdepois US$ 0,002 por linhaas colunas que você definirCSV · XLSX · JSON
Como funciona

Dê a ele uma página
e uma lista de campos.

Duas entradas e nada mais: onde olhar e o que trazer de volta. A segunda é a parte que faz isso funcionar num site para o qual ninguém escreveu um parser.

  1. PASSO 1Entre na plataforma.
  2. PASSO 2Abra o Extrator Universal com IA.
  3. PASSO 3Cole as URLs das páginas, uma por linha - ou envie um arquivo CSV, XLSX, TXT ou Parquet.
  4. PASSO 4Adicione os atributos que quer extrair. Escolha entre as sugestões ou digite os seus.
  5. PASSO 5Defina o limite de páginas por consulta - ele começa em 1, então aumente quando estiver satisfeito.
  6. PASSO 6Escolha o formato de saída e clique em Get Data.

Cada página é obtida pelo nosso pool de proxies, nunca pelo seu IP real, e lida pelo Claude, que extrai os atributos que você nomeou.

Por que as equipes usam

Um extrator para
a cauda longa.

Você decide as colunas

Os atributos que você digita são o esquema. Peça um preço e uma nota e recebe duas colunas; acrescente uma descrição e são três. Nada aqui tem linha de cabeçalho fixa, e é exatamente por isso que serve para páginas diferentes entre si.

Sem esperar por um parser dedicado

A maioria dos sites nunca será popular o bastante para ganhar um extrator feito sob medida. Esta é a resposta para eles: um catálogo de fornecedor, um diretório setorial, um marketplace regional - qualquer coisa com os dados na página e ninguém mantendo um extrator.

O mesmo formato de arquivo de sempre

Seja como for que você defina as colunas, a saída é o CSV, XLSX ou JSON comum que o resto da plataforma produz. Ela entra no mesmo pipeline que uma execução de qualquer um dos nossos extratores de esquema fixo.

O que você recebe

Não há lista de colunas,
e é esse o ponto.

Toda outra página deste site nomeia um conjunto fixo de colunas. Esta não pode, porque quem escreve é você.

Os atributos que você adiciona são a saída. Digite price e rating e o arquivo terá duas colunas com esses nomes. O seletor sugere alguns comuns para começar - name, price, discount price, description, image, rating, reviews -, mas o campo aceita texto livre, então a lista é uma conveniência e não um limite. Peça o que a página realmente tiver.

Essa flexibilidade é o produto inteiro, e traz uma consequência óbvia: não podemos mostrar uma exportação de exemplo nem prometer o que uma célula específica vai conter, porque as duas coisas dependem da página que você aponta e das palavras que escolhe. Nomeie os atributos como a própria página os rotula, conte com uma célula vazia quando uma página simplesmente não trouxer algo que você pediu, e teste a formulação em algumas páginas antes de soltar sobre uma lista.

Uma diferença prática em relação ao resto da plataforma: o limite de páginas começa em 1, não em 100. É um padrão sensato para uma ferramenta que se destina a ser testada primeiro em uma página, mas significa que uma execução vai parar depois de uma única página até você aumentá-lo.

O que ele aceita

Qualquer página,
e os campos que você nomear.

Não há lista de sites suportados para conferir, porque não há parser por site. As duas entradas obrigatórias são as URLs e os atributos que você quer delas.

Qualquer URL de página, uma por linha Atributos a extrair (obrigatório) Sugeridos: name · price · description Ou digite o seu próprio atributo Upload CSV · XLSX · TXT · Parquet Limite de páginas por consulta (começa em 1) Lido pelo Claude Nunca o seu IP real
Fluxos de trabalho comuns

Três tarefas que as pessoas
mais executam aqui.

Alguns exemplos do que um extrator sem esquema fixo serve de verdade.

Cauda longa

Extraia um site para o qual ninguém fez um parser

Um marketplace regional, o diretório de uma associação setorial, o catálogo de um fabricante. Os dados estão na página e não existe ferramenta dedicada - nomeie os campos de que precisa e leve-os.

Pesquisa · Cobertura
Prototipagem

Teste uma ideia antes de se comprometer com ela

Aponte para um punhado de páginas com uma lista de atributos aproximada e veja se os dados de que precisa estão ali. É um primeiro passo mais barato do que especificar um extrator sob medida para uma fonte que você ainda não validou.

Descoberta · Viabilidade
Formatos estranhos

Pegue o campo que a exportação padrão deixa de fora

Às vezes um extrator dedicado devolve quase tudo o que você quer. Aponte este para as mesmas páginas, peça só o atributo que falta e junte o resultado pela URL.

Enriquecimento · Preenchimento de lacunas
Preços

Pague só pelas linhas
que você realmente extrai.

Sem assinatura, sem mínimo, sem fatura recorrente. Suas primeiras 500 linhas são por nossa conta - depois, pagamento por uso, à mesma tarifa fixa de qualquer outro extrator daqui.

Plano gratuito

500 linhas grátis - US$ 0

Em toda conta nova, uma única vez. Sem cartão. Listas de atributos próprias, upload de arquivo e todos os formatos de exportação incluídos.

US$ 0 para sempre
Pagamento por uso

US$ 0,002 por linha, após o plano gratuito

A mesma tarifa fixa do resto da plataforma. O estimador prévio mostra o número de linhas e o custo em créditos antes de a execução começar - sem cobranças surpresa e sem unidades de computação para converter.

Mais popular
Volume

Sob medida · alto volume

Preço por volume, workers dedicados e um SLA para rodar listas grandes de páginas de forma programada. Conte seus números e enviamos uma proposta.

Fale conosco
10% de desconto na sua primeira execução paga.Use o código LIVESCRAPER10 no checkout.
Cadastre-se
Use estes quando servirem

Um extrator dedicado
ganha de um genérico.

Esta ferramenta existe para sites sem extrator feito sob medida. Onde existe um, ele é a melhor escolha - conhece as peculiaridades do site e entrega um conjunto de colunas documentado.

A parte jurídica

É legal extrair dados
de qualquer página?

Resposta curta: depende inteiramente da página - que é a resposta honesta para uma ferramenta sem alvo fixo, e ela deixa mais julgamento nas suas mãos do que os nossos outros extratores.

Todo outro extrator daqui aponta para um site, então podemos dizer o que ele coleta e o que os termos daquele site dizem. Este aponta para onde você mandar, então não podemos fazer essa avaliação por você. A execução busca a página como um visitante comum faria, pelo nosso pool de proxies e nunca pelo seu IP real, e lê o que está nela - não faz login, não fura paywall e não alcança nada que um visitante não pudesse ver. Além disso, se de uma dada página pode haver coleta é uma pergunta sobre os termos dela e sobre a sua finalidade, e cabe a você respondê-la antes de apontar a ferramenta.

Seja deliberado com os atributos que pede. Um extrator genérico devolverá o que você nomear, inclusive coisas que são dados pessoais - o nome de uma pessoa, um endereço de e-mail, um telefone. Pedi-los transforma uma simples busca de página em tratamento de dados pessoais, e na UE e no Reino Unido isso traz o RGPD com você como controlador: base legal, transparência sobre a origem dos dados e atenção a oposições e pedidos de eliminação. A ferramenta não vai impedi-lo; a obrigação é sua.

Não rodamos rastreadores de terceiros na camada de dados, e suas exportações se apagam sozinhas após 30 dias. Se estiver em dúvida sobre uma fonte ou um campo, busque orientação antes de escalar e não depois.

livescraper.app · princípios
Busca páginas como um visitante faria
Sem logins, sem paywalls, sem tocar em contas
Nunca o seu IP real
Exports se excluem sozinhos (30 dias)
Você escolhe o alvo - e assume esse julgamento!
Confira os termos da fonte antes de escalar.
Perguntas frequentes

O que as pessoas perguntam
antes de se cadastrar.

As perguntas que mais ouvimos. Mais alguma coisa? Fale conosco - quem escreve as respostas são humanos, não bots.

Como eu uso o Extrator Universal com IA?+
Entre na plataforma. Abra o Extrator Universal com IA. Cole as URLs das páginas, uma por linha - ou envie um arquivo CSV, XLSX, TXT ou Parquet. Adicione os atributos que quer extrair, escolhendo entre as sugestões ou digitando os seus. Defina o limite de páginas por consulta. Escolha o formato de saída e clique em Get Data.
Que colunas eu vou receber?+
As que você pedir. Os atributos que você adiciona são o esquema de saída: digite price e rating e o seu arquivo terá duas colunas com esses nomes. É por isso que esta página não tem dicionário de dados - diferente de todos os outros extratores daqui, não há conjunto fixo de colunas para publicar, porque você o escreve em tempo de execução.
Que atributos eu posso pedir?+
Qualquer um que a página tiver. O seletor sugere name, price, discount price, description, image, rating e reviews para começar, mas o campo aceita texto livre, então são uma conveniência e não um limite. Nomeie os atributos como a própria página os rotula e você terá resultados melhores do que com um termo abstrato.
O que acontece se uma página não tiver o atributo que pedi?+
Conte com uma célula vazia naquela linha. A ferramenta lê o que está na página - ela não vai procurar em outro lugar nem inferir um valor que não existe. Vale lembrar disso quando você aponta uma mesma lista de atributos para um conjunto de páginas que não têm todas o mesmo formato.
Quais sites são suportados?+
Não há lista de sites suportados, porque não há parser por site. É justamente esse o ponto: a ferramenta foi feita para a cauda longa de sites que nunca terão um extrator dedicado. Onde existe um - Google Maps, Amazon e o resto do nosso catálogo - essa será a escolha mais previsível.
Por que o limite de páginas começa em 1?+
Porque esta é uma ferramenta feita para ser testada primeiro em uma única página, então o padrão mantém a primeira execução pequena e barata. Isso significa, porém, que uma execução para depois de uma página até você aumentá-lo, o que surpreende quem está acostumado com o padrão 100 dos nossos outros extratores.
Dá para confiar na extração sem conferir?+
Confira. Nunca publicamos um número de precisão para isto e não vamos inventar um - o quanto funciona bem depende da página e de como você formula os atributos. Rode sobre duas ou três páginas representativas, leia a saída ao lado da página, ajuste a formulação e só então aponte para uma lista longa. São cinco minutos que evitam um conjunto de dados ruim.
Quanto custa?+
As primeiras 500 linhas são grátis e valem uma única vez, sem cartão de crédito. Depois disso são US$ 0,002 por linha - a mesma tarifa fixa de qualquer outro scraper da plataforma. O estimador mostra o custo de uma execução antes de ela começar.

O site de que você precisa
não tem extrator. Tudo bem.

Suas primeiras 500 linhas são grátis - sem cartão, sem assinatura. Depois são US$ 0,002 por linha, tarifa fixa.

Ativa na hora · sem cartão

Extrair qualquer página com um esquema próprio

A maioria das ferramentas de scraping é construída site a site. Alguém estuda a marcação de uma página, escreve um extrator e publica um conjunto fixo de colunas - o que funciona lindamente para o punhado de sites grandes o bastante para justificar o esforço, e nada para todo o resto. O Extrator Universal com IA é para todo o resto. Você dá a ele URLs de páginas e uma lista dos atributos que quer, cada página é obtida pelo nosso pool de proxies e lida pelo Claude, e os atributos que você nomeou voltam como as colunas de um arquivo CSV, XLSX ou JSON comum.

É por isso que esta página não tem dicionário de dados. Toda outra página de produto deste site publica uma linha de cabeçalho fixa; esta não pode, porque você escreve o esquema em tempo de execução. Digite price e rating e o seu arquivo terá duas colunas com esses nomes. O seletor sugere um punhado de atributos comuns - name, price, discount price, description, image, rating, reviews - mas o campo aceita texto livre: peça o que a página realmente tiver.

A flexibilidade tem um custo que vale dizer com clareza. Como tanto o alvo quanto o esquema são seus, não podemos mostrar uma exportação de exemplo nem prometer o que uma célula específica vai conter, e não publicamos nenhum número de precisão. O conselho prático é o mesmo que você daria a um colega: nomeie os atributos como a página os rotula, conte com uma célula vazia onde a página simplesmente não trouxer o que você pediu, e valide a formulação em duas ou três páginas representativas antes de apontar para uma lista longa. Note também que o limite de páginas começa em 1, e não nos 100 que os nossos outros extratores trazem por padrão.

Onde já existe um extrator dedicado para a sua fonte, use-o: ele conhece as peculiaridades daquele site e entrega um conjunto de colunas documentado. Este ganha o seu lugar nos sites para os quais ninguém construiu um parser, e provavelmente nunca construirá. Comece grátis: suas primeiras 500 linhas não custam nada e não pedem cartão, e depois são US$ 0,002 por linha, tarifa fixa.