Scraper de Produtos do Otto

O catálogo de um retalhista alemão,
um produto por linha.

A Otto é um dos maiores retalhistas generalistas da Alemanha, e as suas páginas de produto são montadas no navegador em vez de servidas inteiras. Este serviço carrega-as como um navegador faz e devolve dezassete colunas por URL de produto - o mesmo esquema que os nossos outros scrapers de catálogo usam, por isso um só importador lê todos.

500 linhas grátis, uma única vezdepois US$ 0,002 por linhadezassete colunas por produtoCSV · JSON · Excel
Como funciona

Entra uma lista de URLs, sai uma folha de cálculo.

  1. PASSO 1Inicie sessão na plataforma.
  2. PASSO 2Abra o Otto Products Scraper.
  3. PASSO 3Cole os URLs de produto da Otto que quiser, um por linha.
  4. PASSO 4Escolha o formato de saída (CSV / JSON / XLSX).
  5. PASSO 5Execute a tarefa.
  6. PASSO 6Descarregue os resultados - uma linha por URL, dezassete colunas.
O que é preciso saber

O que enquadra uma execução contra a Otto.

As listagens são montadas no navegador

Peça https://www.otto.de com um cliente comum e recebe uma página funcional de cerca de 320 KB com setenta e tal etiquetas de script e nenhuma ligação de produto na marcação servida. O catálogo chega depois, do JavaScript. Tudo o que assente numa biblioteca HTTP e num analisador de HTML lê uma página válida e não encontra produtos nela - este serviço carrega a página como um navegador faz.

Um retalhista de consumo, não um distribuidor profissional

A Otto vende ao público, e vale a pena dizê-lo porque os outros catálogos neste esquema - BiggestBook, Vistaprint, Waxie - são sites profissionais cujas colunas de preço voltam vazias por razões próprias de cada um. Uma loja de consumo publica os preços a toda a gente. Não medimos os da Otto, por isso também não os prometemos, mas as razões que aquelas páginas dão para colunas de dinheiro vazias não se transferem para aqui.

Dezassete colunas, algumas aos pares

A exportação traz price e parsed_price, sku e sku_code, image e images, url e product_url. Em cada par, uma é para ler e outra para calcular, e saber qual é qual antes de escrever o importador poupa uma reescrita.

A mesma forma do resto da família

A Livescraper aplica este esquema a uma série de fontes de retalho e abastecimento. Os dezassete nomes e a sua ordem são idênticos, por isso um só importador lê todas, e acrescentar uma segunda fonte é uma alteração de configuração e não um projecto.

Cada linha diz se resultou

A última coluna é status, escrita pelo nosso exportador e não pelo site. Uma linha que não pôde ser obtida chega na mesma, com o motivo. Faz a reconciliação com a lista de entrada em vez de descobrir uma falha silenciosa três semanas depois.

Dizemos o que não medimos

As duas execuções por detrás desta página submeteram ambas um URL fictício que devolveu um 404, por isso não temos quaisquer dados de produto da Otto. A lista de colunas abaixo é real - é a linha de cabeçalho dessas exportações. Os valores não são descritos, porque não vimos nenhum.

O que recebe

Dezassete colunas, por produto.

Lidas do cabeçalho de uma exportação real deste serviço, pela ordem da folha. As duas execuções que temos não devolveram dados sob esse cabeçalho - veja a nota por baixo da tabela - por isso cada entrada diz para que serve a coluna e fica por aí.

query
O URL da Otto que submeteu, repetido em cada linha para que uma exportação com muitos produtos continue separável. Guarde-o: é o único registo da entrada a que o resto da linha responde.
sku_code
O código de artigo tal como o catálogo o imprime. Faz par com sku mais abaixo - verifique os dois antes de escolher uma chave de junção, porque nesta família de esquemas são preenchidos de forma independente e já foram observados tanto iguais como diferentes.
product_url
A página de produto canónica. Distinta de url, que indica o endereço a partir do qual a linha foi de facto produzida; as duas divergem assim que um link submetido redirecciona.
name
O título do produto tal como a página o indica. Conte com alemão, já que esta é uma loja alemã - planeie a colação e a codificação dessa coluna em conformidade.
description
O texto da descrição. Conte com um campo de texto livre longo e não com uma etiqueta curta, e dê-lhe uma coluna larga ou um tipo texto na base de dados.
parsed_price
O preço como número puro, sem símbolo nem separador de milhares - o que se usa para aritmética, ordenação e limiares.
price
O preço tal como apresentado. Use-o quando precisar de mostrar a um cliente exactamente o que a página dizia; use parsed_price quando precisar de calcular. Numa loja alemã, a forma apresentada não é a que a sua folha de cálculo interpreta por omissão.
currency
A moeda em que o preço está expresso. Leia-a em vez de a assumir - é assim que um valor em euros acaba somado a um em dólares.
availability
O estado de stock tal como publicado na página. Trate-o como a afirmação do catálogo no momento da recolha, não como um fluxo de inventário em tempo real.
rating
A classificação média, quando a página publica uma. Nem todos os produtos trazem uma, por isso escreva o importador para aceitar uma célula vazia em vez de falhar.
reviews
O número de avaliações, com a mesma ressalva de rating. Onde ambos existem andam juntos; uma nota sem a contagem por trás não chega para ordenar.
images
Todas as imagens que a página traz, num só campo. Divida-o antes de guardar se precisar de uma linha por recurso - e verifique primeiro qual é realmente o separador, porque nesta família de esquemas foi precisamente isso que já correu mal.
brand
O fabricante ou a marca. É o campo por onde agrupar para trabalho de sortido: que marcas um retalhista lista, e com que profundidade em cada linha.
sku
A referência do artigo. A outra metade do par de identificadores com sku_code.
url
O endereço a partir do qual a linha foi produzida. Compare-o com query para detectar redireccionamentos e com product_url para detectar canonização.
image
A imagem principal isolada, para que o caso comum - uma miniatura por produto - não exija dividir cadeias de texto.
status
Um indicador por linha escrito pelo nosso exportador, não pela Otto. Diz se a linha foi obtida. As duas execuções por detrás desta página trazem aqui http 404, porque o URL submetido era um endereço fictício que não existe.

Dezassete colunas por linha · CSV, JSON ou Excel

Por detrás desta página estão duas execuções, de 14 e 15 de julho de 2026, cujas cargas são idênticas byte a byte. Ambas submeteram https://www.example.com/product/123 - um endereço fictício, não um endereço da Otto - e ambas devolveram uma única linha com http 404 e as catorze colunas de dados vazias. Podemos portanto dar-lhe o esquema com segurança e não lhe podemos dar nada sobre os valores da Otto, e esta página não finge o contrário. Os dezassete nomes aparecem pela mesma ordem nas nossas exportações da BiggestBook, Vistaprint e Waxie, e as da Waxie estão preenchidas - é assim que sabemos que o esquema está vivo e não é um esboço. Deliberadamente não descrevemos as colunas da Otto usando os valores dessas páginas: são sites profissionais cujas colunas de dinheiro estão vazias por razões particulares de cada um, e a Otto é um retalhista de consumo. Pedir emprestadas as medições deles seria um palpite vestido de facto.

Fluxos de trabalho comuns

Para que serve um catálogo de retalho.

Acompanhamento de preços

Vigiar uma gama, não um artigo isolado

Submeta os URLs dos produtos que lhe interessam de forma agendada e guarde parsed_price, currency e a data da execução. O valor não está num número isolado mas na série - um retalhista costuma mexer numa gama inteira de uma vez, e uma tabela mostra-o onde um separador do navegador não mostra.

Preços · Monitorização
Análise de sortido

Ver que marcas um retalhista realmente tem

Agrupe uma exportação por brand e conte. A profundidade por marca diz-lhe onde um retalhista se comprometeu e onde está apenas a experimentar - a mesma pergunta que um comprador faz antes de acrescentar um fornecedor, respondida a partir do próprio catálogo.

Compras de categoria · Sortido
Enriquecimento de catálogo

Preencher os campos que faltam nos seus registos

As bases de dados de produto costumam ser fortes em identificadores e fracas em textos e imagens. description, image e images cobrem essa falha contra um identificador que já tem, sem voltar a fotografar nada.

Operações de e-commerce · Catálogo
Estudo de entrada em mercado

Ler uma loja alemã a partir de fora da Alemanha

O catálogo de um retalhista nacional é o retrato mais barato disponível daquilo que um mercado tem e a que nível de preço. Guarde name, brand e parsed_price e tem a forma de uma categoria sem encomendar um estudo.

Estratégia · Estudo de mercado
Preços

Pague só o que realmente usa.

Plano gratuito

As primeiras 500 linhas são grátis

Uma única vez, ao registar-se. Sem cartão, e sem nada para cancelar depois.

Uma única vez, ao registar-se
Tarifa

depois US$ 0,002 por linha

Facturado pelas linhas efectivamente devolvidas. Uma linha que volta com um status diferente de sucesso não é uma linha de dados de produto, e não lhe é cobrada como tal.

Facturado pelas linhas devolvidas
Sem subscrição

Nada recorrente

Os créditos não expiram num ciclo mensal. Faça uma varredura de catálogo em março e mais nada até setembro se o trabalho tiver essa forma.

Sem expiração mensal
10 % de desconto na sua primeira execução paga.Use o código LIVESCRAPER10 no pagamento.
Registar
Combina bem com

Outros catálogos, as mesmas dezassete colunas.

A parte legal

É legal fazer scraping da Otto?

Factos de produto numa página de acesso público são informação concorrencial comum. As ressalvas que vale a pena assinalar aqui dizem respeito à reutilização e ao facto de um site alemão ser um site alemão.

Um preço, um nome de produto, uma marca e um estado de stock são factos sobre bens postos à venda. Lê-los numa página servida a qualquer visitante é a mesma actividade que um comprador faz à mão, a uma velocidade útil. Nada nas dezassete colunas descreve uma pessoa: não há nome, e-mail, telefone nem conta - por isso as questões de protecção de dados que moldam os nossos serviços sobre pessoas não se colocam aqui. Vale a pena dizê-lo explicitamente num site alemão, porque o RGPD é a primeira coisa por que se pergunta, e regula dados pessoais, coisa que uma linha de produto não é.

Duas ressalvas merecem ser nomeadas. Primeiro, a reutilização: descrições e fotografia de produto são obra protegida de alguém. Usá-las internamente para acompanhamento de preços, análise de sortido ou reconciliação com os seus próprios registos é prática comum; republicá-las como catálogo próprio é outra pergunta com outra resposta. Segundo, as preferências declaradas do próprio site. A Otto publica um robots.txt e, para um rastreador geral, ele traz apenas um punhado de exclusões estreitas em vez de uma geral, por isso as páginas de produto não estão entre os caminhos que pede aos rastreadores para evitar. Lemos esse ficheiro em vez de assumir, ficamos em páginas de acesso público e avançamos a um ritmo comedido.

As nossas condições são as mesmas de qualquer outro serviço aqui. Apenas páginas de acesso público, nada atrás de um início de sessão, sem rastreadores de terceiros na camada de dados, e as exportações são apagadas automaticamente ao fim de 30 dias. As suas primeiras 500 linhas são grátis e não exigem cartão.

livescraper.app · o que enquadra uma execução
Um URL de produto por linha
A página é renderizada, não apenas descarregada
Apenas acesso anónimo
Nenhum valor da Otto medido - apenas o esquema
As exportações são apagadas ao fim de 30 dias
Podemos dizer-lhe a forma da tabela com segurança. O que a Otto lá põe, ainda não vimos.
Perguntas frequentes

O que as pessoas perguntam antes de se registarem.

Que colunas tem a exportação?+
Dezassete, por esta ordem: query, sku_code, product_url, name, description, parsed_price, price, currency, availability, rating, reviews, images, brand, sku, url, image e status. Uma linha por URL de produto submetido.
Há dados de exemplo da Otto nesta página?+
Não, e não os vamos inventar. As duas execuções por detrás desta página submeteram um URL fictício que devolveu http 404, por isso todas as colunas de dados voltaram vazias. Isso chega para estabelecer os dezassete nomes de coluna e mais nada - por isso esta página descreve para que serve cada coluna e nunca como são os seus valores.
As colunas de preço vão vir preenchidas?+
Não as medimos, por isso não vamos prometer. O que podemos dizer é que as razões que as nossas outras páginas de catálogo dão para colunas de preço vazias não se aplicam aqui: aqueles são sites profissionais que cotam por conta ou por quantidade, e a Otto é um retalhista de consumo que publica preços a toda a gente. Isso torna-o provável, não certo, e preferimos marcar a diferença a reivindicar uma medição que não temos.
Porque é que a Otto exige mais do que um simples pedido HTTP?+
Porque as listagens são montadas no navegador. Um pedido a https://www.otto.de com um cliente comum devolve uma página funcional de cerca de 320 KB com umas setenta etiquetas de script e nenhuma ligação de produto na marcação servida. O catálogo é pedido e renderizado depois, por isso um scraper assente apenas num analisador de HTML vê uma página válida sem nada dentro.
Os dados vêm em alemão?+
Conte com isso - name e description são o que a loja imprime, e esta é uma loja alemã. Planeie a codificação e a colação dessas colunas em conformidade, e lembre-se de que o price apresentado usará formatação numérica alemã, mesmo estando parsed_price ali precisamente para se calcular.
Porque há duas colunas de preço e duas de identificador?+
Em cada par, uma é para ler e outra para calcular. price é o preço tal como apresentado e parsed_price o mesmo número sem formatação; sku e sku_code são preenchidos de forma independente nesta família de esquemas e já foram observados tanto iguais como diferentes, por isso verifique os dois antes de escolher uma chave de junção. A mesma duplicação vale para image e images, e para url e product_url.
O que significa a coluna status?+
É escrita pelo nosso exportador, não pela Otto, e diz se a linha foi obtida. Uma linha falhada chega na mesma com o motivo, por isso pode reconciliar a exportação com a sua lista de entrada em vez de descobrir uma falha silenciosa mais tarde. As duas execuções por detrás desta página lêem aí http 404.
Quanto custa?+
As suas primeiras 500 linhas são grátis, uma única vez, sem cartão. Depois são US$ 0,002 por linha, facturados pelas linhas efectivamente devolvidas, sem subscrição e sem expiração mensal de créditos.
Em que formatos posso exportar?+
CSV, JSON ou Excel. As dezassete colunas e a sua ordem são iguais nos três.

Leia o catálogo como uma tabela.

Dezassete colunas por produto, de uma loja que se monta a si própria no navegador. As suas primeiras 500 linhas são grátis, depois US$ 0,002 cada.

Activo de imediato · sem cartão

Extrair dados de produto da Otto

A Otto é um dos maiores retalhistas generalistas da Alemanha e vende vestuário, mobiliário, electrónica e artigos para o lar ao público através de otto.de. O facto de ser uma loja de consumo e não um distribuidor profissional importa mais do que parece, porque os outros catálogos que partilham este esquema - BiggestBook, Vistaprint, Waxie - são todos sites profissionais, e cada um tem a sua própria razão para devolver colunas de preço vazias. Um retalhista que vende a toda a gente publica os preços a toda a gente. Não medimos os da Otto, por isso esta página não os promete, mas o raciocínio que se aplica àquelas páginas não se transfere para esta e preferimos dizê-lo a deixar que a parecença de família insinue algo que não testámos.

O obstáculo prático está na forma como o site é construído. Um pedido a https://www.otto.de a partir de um cliente HTTP comum devolve uma resposta bem-sucedida de cerca de 320 KB com cerca de setenta etiquetas de script e nenhuma ligação de produto na marcação que serve - as listagens são montadas no cliente, depois de essa casca chegar. Tudo o que assente numa biblioteca HTTP e num analisador de HTML lerá portanto uma página válida e não encontrará nada lá dentro, o que é a razão mais comum para um scraper caseiro parecer funcionar e devolver linhas vazias. Este serviço carrega a página como um navegador faz, por isso os produtos estão presentes antes de algo ser lido.

A exportação são dezassete colunas por URL de produto: query, sku_code, product_url, name, description, parsed_price, price, currency, availability, rating, reviews, images, brand, sku, url, image e status. Quatro delas são pares - preço apresentado contra preço calculável, dois campos de identificador, imagem principal contra todas as imagens, URL pedido contra URL canónico - e saber que metade usar antes de escrever o importador é a diferença entre um carregamento limpo e uma reescrita. Que o par de identificadores merece verificação não é teórico: na nossa exportação da Waxie, que usa este mesmo esquema, as duas colunas levavam números genuinamente diferentes, o número de artigo do distribuidor e o do fabricante. Conte com texto em alemão em name e description, e com formatação numérica alemã no price apresentado.

Estamos a ser deliberadamente claros sobre os limites do que podemos mostrar. As duas execuções por detrás desta página, de 14 e 15 de julho de 2026, submeteram ambas um endereço fictício em vez de um da Otto, e ambas voltaram com um 404 e todas as colunas de dados vazias. Isso estabelece o esquema - um cabeçalho é um cabeçalho real mesmo sem dados por baixo - e não estabelece nada sobre os valores da Otto, por isso não encontrará preços, referências nem classificações de exemplo em parte alguma desta página. No plano legal, uma linha de produto não contém dados pessoais, que é a primeira coisa que um site alemão costuma levantar; descrições e fotografia são um assunto separado de direitos de autor e reutilização. A Otto publica um robots.txt e, para um rastreador geral, lista apenas um punhado de exclusões estreitas em vez de uma geral, por isso as páginas de produto não estão entre os caminhos que pede para evitar. Apenas páginas de acesso público, sem rastreadores de terceiros na camada de dados, e as exportações são apagadas automaticamente ao fim de 30 dias. As suas primeiras 500 linhas são grátis e não exigem cartão.