Scraper de Produtos do Best Buy

Entra um URL de pesquisa,
saem linhas ordenadas.

Isto não é um scraper de fichas de produto. Dá-lhe uma página de resultados de pesquisa da Best Buy e devolve uma linha por cada anúncio nela, cada uma com a posição que ocupava - preço, avaliação e lugar na prateleira leem-se da mesma tabela.

500 linhas grátis, uma única vezdepois US$ 0,002 por linhaum URL de pesquisa, muitas linhas ordenadasCSV · JSON · Excel
Como funciona

Entra um URL de pesquisa, sai uma folha de cálculo.

  1. PASSO 1Inicie sessão na plataforma.
  2. PASSO 2Abra o Best Buy Products Scraper.
  3. PASSO 3Cole os URLs de resultados de pesquisa da Best Buy que quiser, um por linha - do tipo que se parece com /site/searchpage.jsp?st=….
  4. PASSO 4Escolha o formato de saída (CSV / JSON / XLSX).
  5. PASSO 5Execute o trabalho.
  6. PASSO 6Descarregue os resultados - onze colunas por linha, pela ordem dos anúncios.
O que esperar

O que vale a pena saber antes de o executar.

Cada linha sabe onde estava

position é a posição do anúncio na página de resultados, a partir de 1. As nossas execuções devolveram as posições 1 a 23. É essa coluna que separa isto de um scraper de produtos: está a capturar uma prateleira tal como estava ordenada num dado dia, e não um conjunto de fichas soltas, por isso a mesma consulta executada semanalmente dá-lhe uma série de movimentos em vez de um instantâneo.

Onze colunas, não as dezassete que talvez espere

Se já usou os nossos outros catálogos de retalho, vai procurar parsed_price, currency, availability e um sinalizador status. Nenhum existe aqui. Este serviço devolve query, name, sku, brand, model, price, rating, reviews, image, url e position - uma forma de resultados de pesquisa, não de ficha de produto.

O SKU é a chave de junção, e está no URL

O SKU da Best Buy é um número simples e cada linha carrega-o duas vezes - uma em sku e outra dentro de url. Na nossa exportação apareceram duas formas de URL: 58 linhas como /product/…/sku/<sku> e 27 como /site/-/<sku>.p?skuId=<sku>. Junte por sku em vez do endereço e ambas as formas reconciliam no mesmo produto.

A coluna brand é o início do título

Em 85 das nossas 85 linhas o valor de brand é uma subcadeia inicial de name. Isso funciona quando o título começa pelo fabricante e dá «HP» ou «Dell»; não funciona quando começa por uma medida ou uma frase comercial, e por isso a nossa exportação contém valores como «Customer», «Latitude» e «15.6" 2K Touchscreen Laptop». Trate-a como o início do título e normalize antes de agrupar por ela.

A profundidade varia entre execuções da mesma consulta

As nossas sete execuções submeteram todas o mesmo URL de pesquisa e voltaram com 2, 3, 10, 14, 15, 18 e 23 linhas. As posições começavam sempre em 1, por isso o que mudou foi até onde cada execução desceu na página. Reconcilie por sku e position, trate uma execução curta como uma execução curta e não como produtos desaparecidos, e repita-a quando uma série parecer magra.

Aqui não há coluna de estado

Os serviços de catálogo de dezassete colunas escrevem um status por linha para que uma recolha bloqueada seja visível. Este esquema não tem nenhum - uma execução que não devolve nada não devolve linha alguma. O catálogo do fornecedor marca este serviço como Partial com a nota -blocked (needs residential proxy), o que bate certo com o que vemos: as linhas chegam, mas a profundidade não está garantida. Conte as linhas por execução e alerte quando caírem.

O que recebe de volta

Onze colunas, medidas em 85 linhas.

Pela ordem da exportação. As contagens vêm das nossas próprias sete execuções, por isso onde aqui se diz que uma coluna trazia valor descrevem-se linhas que realmente temos.

query
O URL de pesquisa que submeteu. Cada linha que uma pesquisa produz repete-o, e é isso que volta a agrupar um conjunto de resultados depois de combinar exportações. As nossas 85 linhas trazem o mesmo valor porque as sete execuções submeteram a mesma consulta.
name
O título do anúncio tal como a página de resultados o imprime. Preenchida nas 85 linhas. Conte com a configuração dentro do título: processador, memória, armazenamento e tamanho do ecrã fazem parte do nome em vez de serem colunas próprias.
sku
O número de produto próprio da Best Buy, e a coluna pela qual juntar. Preenchida nas 85 linhas, com 70 valores distintos, e aparece também dentro de url em cada linha. Sete SKU surgiram em mais do que uma das nossas execuções, que é como se segue um produto ao longo das datas.
brand
O início do título, não um campo de fabricante normalizado. Preenchida nas 85 linhas - e nas 85 é uma subcadeia inicial de name. Aparecem fabricantes reais, e também fragmentos como «Customer» ou um tamanho de ecrã. Normalize antes de agrupar por ela.
model
A referência de modelo do fabricante quando o anúncio imprime uma - 69 de 85 linhas. É o valor que sobrevive à passagem para o catálogo de outro retalhista, por isso guarde-o mesmo sendo o mais escasso dos dois identificadores.
price
O preço tal como apresentado, com o símbolo monetário. 78 de 85 linhas. Este esquema não tem coluna numérica própria nem coluna de moeda, por isso retire o símbolo antes de fazer contas. A nossa execução tinha valores de dois algarismos até US$ 4.199,98.
rating
A avaliação média em estrelas, como cadeia de texto. 81 de 85 linhas. Leia-a junto de reviews: 19 linhas trazem uma avaliação de 0 ao lado de uma contagem de opiniões de 0, e isso é um anúncio que ninguém avaliou ainda, não um mal avaliado.
reviews
O número de opiniões por trás dessa avaliação. As mesmas 81 linhas de rating, com a mesma ressalva sobre os zeros. A nossa execução ia de 0 até 5.929.
image
A miniatura do anúncio, servida a partir do servidor de imagens da Best Buy. 84 de 85 linhas. Uma linha voltou sem ela, por isso trate a coluna como opcional no seu importador.
url
A página de produto desse anúncio. Preenchida nas 85 linhas, numa de duas formas - /product/…/sku/<sku> em 58 linhas e /site/-/<sku>.p?skuId=<sku> em 27. Ambas incorporam o SKU, por isso o endereço é uma ligação e não uma identidade.
position
A posição que o anúncio ocupava na página de resultados, a partir de 1. Preenchida nas 85 linhas; a nossa chegou a 23. É a coluna que faz da exportação o retrato de uma prateleira, e só tem sentido ao lado de query e da data em que a executou.

Onze colunas por linha · CSV, JSON ou Excel

Duas coisas a planear. Primeira: este esquema não é a forma de catálogo de dezassete colunas das nossas páginas de distribuidores. Não há parsed_price, nem currency, nem availability, nem description e - o mais importante - nem status por linha. Se escrever um só importador para várias fontes, este precisa do seu próprio ramo. Segunda: a profundidade não é fixa. Sete execuções do mesmo URL de pesquisa devolveram 2, 3, 10, 14, 15, 18 e 23 linhas, sempre a começar na posição 1. O próprio catálogo do fornecedor marca este serviço como Partial com a nota -blocked (needs residential proxy). As linhas chegam; quantas não é coisa que prometamos a partir de sete execuções, e não citamos nenhuma taxa de sucesso.

Fluxos de trabalho comuns

Para que serve uma prateleira ordenada.

Seguimento de posição

Ver onde está um produto, semana a semana

Execute a mesma consulta com um agendamento e guarde query, sku, position e a data. Como sete dos nossos SKU apareceram em mais do que uma execução, a junção é directa: mesmo SKU, outra posição, outro dia. Essa série é o que uma captura de ecrã não lhe dá.

Merchandising · Monitorização
Movimento de preços

Seguir o preço pedido numa categoria

O preço chegou em 78 das nossas 85 linhas. Retire o símbolo uma vez na importação, guarde o número ao lado do SKU e da data, e uma varredura semanal de uns quantos URLs de pesquisa torna-se uma série de preços de toda uma categoria em vez de um punhado de produtos.

Preços · Investigação competitiva
Comparação de opiniões

Ver que anúncios carregam a prova social

rating e reviews chegaram juntas em 81 linhas. Ordenada pelo número de opiniões, uma página de resultados diz-lhe que produtos acumularam atenção e quais são novos - desde que exclua as linhas 0/0, que significam sem avaliação e não maus.

Investigação de categoria · Posicionamento
Mapa de sortido

Ler a ficha técnica no título

Não há coluna de descrição, por isso a configuração vive em name. Analisá-la ao longo de uma página de resultados inteira dá-lhe uma tabela de especificações comparável para uma categoria - e model, nas 69 linhas que o traziam, é o que permite encontrar a mesma unidade no catálogo de outro retalhista.

Sortido · Aprovisionamento
Preços

Pague só o que realmente usa.

Plano gratuito

As primeiras 500 linhas são grátis

Uma única vez, ao registar-se. Sem cartão, e sem nada para cancelar depois.

Uma única vez, ao registar-se
Tarifa

depois US$ 0,002 por linha

Facturado pelas linhas efectivamente devolvidas - o que aqui é o mais justo, porque um URL de pesquisa pode produzir duas linhas ou duas dúzias. A nossa execução de 23 linhas custou 23 linhas; a de 2 linhas custou 2.

Facturado pelas linhas devolvidas
Sem subscrição

Nada recorrente

Os créditos não expiram num ciclo mensal. Siga uma categoria durante o outono e pare no verão se o trabalho tiver essa forma.

Sem expiração mensal
10 % de desconto na sua primeira execução paga.Use o código LIVESCRAPER10 no pagamento.
Registar
Combina bem com

Outras prateleiras, outros esquemas.

A parte legal

É legal fazer scraping da Best Buy?

Preços, avaliações e ordem da prateleira numa página de pesquisa pública são informação competitiva corrente. As ressalvas que vale a pena nomear são sobre o ritmo, e sobre sermos francos onde não conseguimos verificar algo.

Um preço, um título de produto, uma avaliação e a ordem em que os anúncios aparecem são factos sobre bens postos à venda. Lê-los de uma página servida a qualquer visitante é o que um comprador faz à mão, apenas a uma velocidade útil. Nada nas onze colunas descreve uma pessoa: nem nome, nem endereço de correio electrónico, nem telefone, nem conta - por isso as questões de protecção de dados que moldam os nossos serviços sobre pessoas não se colocam aqui.

Duas coisas são próprias deste sítio. Primeira, o ritmo. Uma página de pesquisa é um pedido mais pesado do que uma ficha de produto e a profundidade que obtivemos variou entre duas e vinte e três linhas na mesma consulta, por isso trabalhamos a um ritmo comedido e deve agendar em conformidade em vez de martelar um URL à procura de uma página mais funda. O próprio catálogo do fornecedor marca este serviço como Partial e anota que precisa de um proxy residencial, que é a mesma história vista do outro lado. Segunda, e preferimos dizê-lo a disfarçá-lo: não conseguimos ler o robots.txt da Best Buy. Três acessos comuns a partir da nossa máquina em 12 de agosto de 2026 - a página inicial, o ficheiro robots e o URL de pesquisa - esgotaram o tempo ou viram a ligação cortada, enquanto um sítio sem relação respondia normalmente na mesma sessão. Por isso esta página não cita nenhum resumo do robots.txt: não vimos o ficheiro.

As nossas condições são as mesmas de qualquer outro serviço aqui. Apenas páginas de acesso público, nada atrás de um início de sessão, sem rastreadores de terceiros na camada de dados, e as exportações são apagadas automaticamente ao fim de 30 dias. As suas primeiras 500 linhas são grátis e não exigem cartão.

livescraper.app · o que molda uma execução
Um URL de pesquisa torna-se muitas linhas ordenadas
A profundidade variou de 2 a 23 linhas nas nossas execuções
Sem coluna de estado - uma execução magra parece uma prateleira pequena
Apenas acesso anónimo
As exportações são apagadas automaticamente ao fim de 30 dias
Não conseguimos ler o robots.txt do sítio a partir desta máquina, por isso esta página não cita nenhum.
Perguntas frequentes

O que se pergunta antes de se registar.

O que submeto - um URL de produto ou um de pesquisa?+
Um URL de pesquisa. Todas as execuções da nossa exportação submeteram uma página de resultados da Best Buy com a forma /site/searchpage.jsp?st=…, e cada uma devolveu uma linha por anúncio dessa página com a sua posição em position. É essa a forma em torno da qual o serviço está construído.
Quantas linhas devolve um URL de pesquisa?+
Varia, e não vamos fingir o contrário. As nossas sete execuções da mesma consulta devolveram 2, 3, 10, 14, 15, 18 e 23 linhas, sempre a começar na posição 1 - o que diferiu foi até onde cada execução desceu na página. O catálogo do fornecedor marca este serviço como Partial com a nota de que precisa de um proxy residencial. Conte as linhas por execução e repita as magras.
É o mesmo esquema de dezassete colunas dos vossos outros scrapers de retalho?+
Não, e isso apanha muita gente. Este devolve onze colunas - query, name, sku, brand, model, price, rating, reviews, image, url, position. Não há parsed_price, nem currency, nem availability, nem description, nem status por linha.
Porque é que a coluna brand contém coisas que não são marcas?+
Porque é o início do título do anúncio. Nas nossas 85 linhas o valor de brand é uma subcadeia inicial de name, por isso um título que começa pelo fabricante dá-lhe «HP», e um que começa por um tamanho de ecrã dá-lhe um tamanho de ecrã. Normalize-a, ou retire o fabricante de name.
Por que coluna devo juntar?+
sku. Chegou nas 85 linhas, tem 70 valores distintos e aparece também dentro de url em cada linha - incluindo as 27 cujo endereço usa a forma /site/-/<sku>.p?skuId= em vez de /product/…/sku/. Se precisar antes de cruzar com outro retalhista, use model, que chegou em 69 linhas.
Uma linha tem avaliação 0 e 0 opiniões. Os dados estão partidos?+
Não - é um anúncio que ninguém avaliou ainda. Dezanove das nossas linhas trazem os dois valores a zero em conjunto. Filtre-as de uma média em vez de as tratar como produtos de uma estrela.
A exportação inclui moeda?+
Não. price chega tal como apresentado, símbolo incluído, em 78 das nossas 85 linhas, e este esquema não tem coluna numérica nem de moeda separada. Retire o símbolo na importação se pensa calcular com ele.
Quanto custa?+
As suas primeiras 500 linhas são grátis, uma única vez, sem cartão. Depois é US$ 0,002 por linha, facturado pelas linhas efectivamente devolvidas - por isso uma execução que volta magra custa menos, não mais.
Em que formatos posso exportar?+
CSV, JSON ou Excel. As onze colunas e a sua ordem são iguais nos três.

Capture a prateleira, não apenas o produto.

Um URL de pesquisa, uma linha por cada anúncio nela, com preço, avaliação e a posição que ocupava. As suas primeiras 500 linhas são grátis, depois US$ 0,002 cada.

Activo de imediato · sem cartão

Extrair dados de produtos da Best Buy

A Best Buy é uma retalhista de electrónica de consumo, e o serviço desta página lê os seus resultados de pesquisa em vez das suas fichas de produto. Essa distinção atravessa tudo o resto. Submete um URL com a forma /site/searchpage.jsp?st=…, e o que volta é uma linha por cada anúncio dessa página, com a posição que ocupava numa coluna position. As nossas sete execuções submeteram todas a mesma consulta de portáteis e produziram entre si oitenta e cinco linhas, com posições de um a vinte e três. Se o que quer é a ficha completa de um produto, esta é a forma errada; se o que quer é o estado de uma categoria num dado dia, é exactamente a certa.

O esquema tem onze colunas e não é a forma de dezassete dos nossos catálogos de distribuidores. Não há coluna de preço calculável, nem moeda, nem disponibilidade, nem descrição e - a que mais provavelmente morde - nenhum sinalizador de estado por linha. Nos serviços de dezassete colunas uma recolha bloqueada continua a produzir uma linha que o diz. Aqui uma execução que alcança menos página simplesmente devolve menos linhas, e nada no ficheiro distingue uma prateleira curta de uma execução curta. A nossa prova disso é directa: sete execuções de uma consulta idêntica devolveram duas, três, dez, catorze, quinze, dezoito e vinte e três linhas, todas a começar na posição um. O catálogo do fornecedor marca este serviço como Partial e regista que precisa de um proxy residencial. Conte as linhas por execução, guarde a contagem e alerte quando caia, em vez de assumir que a categoria encolheu.

Duas colunas compensam uma leitura atenta. sku é o número de produto próprio da Best Buy e o correcto para juntar: chegou em cada linha, tinha setenta valores distintos nas nossas oitenta e cinco, e aparece dentro do próprio URL da linha nas duas formas de endereço que vimos. brand não é o que o nome sugere. Nas oitenta e cinco linhas é uma subcadeia inicial do título do anúncio, o que dá um fabricante real quando o título começa por um e dá um tamanho de ecrã ou uma palavra solta quando não - a nossa exportação contém «HP» e «Dell» ao lado de «Customer» e de um fragmento de descrição de produto. Normalize antes de agrupar. model, presente em sessenta e nove linhas, é o identificador mais escasso mas mais portátil, e é o que permite encontrar a mesma unidade no catálogo de outro retalhista. Avaliações e contagens de opiniões chegaram juntas em oitenta e uma linhas, e dezanove delas trazem zero em ambas, o que significa sem avaliação e não mal avaliado.

Uma coisa que não faremos é descrever um ficheiro que não conseguimos ler. Em 12 de agosto de 2026, três acessos comuns a partir da nossa máquina - a página inicial da Best Buy, o seu robots.txt e o próprio URL de pesquisa - esgotaram o tempo ou viram a ligação cortada, enquanto uma retalhista sem relação respondia normalmente na mesma sessão. Por isso esta página não traz nenhum resumo do robots.txt do sítio, porque não o vimos, nem nenhuma taxa de sucesso, porque sete execuções de uma consulta não podem sustentar uma. O que afirmamos é o que a nossa própria exportação contém e como foi medida. Apenas páginas de acesso público, nada atrás de um início de sessão, sem rastreadores de terceiros na camada de dados, as exportações são apagadas automaticamente ao fim de 30 dias, e as suas primeiras 500 linhas são grátis e sem cartão.