Scraper de Productos de Home Depot

Los anuncios de Home Depot,
en filas que puedes ordenar.

Escribe una palabra clave - o pega una URL de categoría o de producto de Home Depot - y los anuncios vuelven como una tabla: el producto, su marca, su precio y su precio de lista, su valoración y su número de reseñas, su modelo y su SKU, un enlace, una imagen y su disponibilidad.

500 filas gratis, una sola vezdespués 0,002 $ por filauna fila por productoJSON · Excel
Cómo funciona

Una palabra clave o un enlace,
y cuántos por consulta.

Un campo obligatorio y un ajuste. No hay control de orden ni selector de tienda o región.

  1. PASO 1Inicia sesión en la plataforma y asegúrate de tener configurado tu proxy residencial de pago - este servicio lo necesita.
  2. PASO 2Abre el Scraper de Productos de Home Depot.
  3. PASO 3Escribe palabras clave o pega URLs de homedepot.com, una por línea: las páginas de categoría y las de producto individual funcionan por igual, y puedes mezclarlas.
  4. PASO 4O sube un archivo. Un CSV o TXT se lee línea a línea y solo se usa su primera columna; un XLSX usa la primera columna de la primera hoja. Lo que encuentre se combina con lo que hayas escrito y se deduplica.
  5. PASO 5Fija un límite por consulta. Por defecto es 100, el valor más pequeño que acepta es 1 y dejarlo vacío lo trae todo.
  6. PASO 6Pulsa «Start scraping» y descarga los resultados en JSON o Excel.

El límite es por consulta, así que una lista de palabras clave lo multiplica. Una categoría amplia sin límite puede tardar mucho.

Por qué es útil

Dos precios, dos identificadores,
una fila.

Lo que te da una fila de anuncio de Home Depot y no te da una captura de la página de búsqueda.

Precio y precio de lista, uno al lado del otro

price y original_price son columnas separadas, así que un descuento es una resta y no una suposición. Sigue el par a lo largo del tiempo y tendrás la forma de una promoción: cuándo empezó, hasta dónde llegó y si volvió.

Dos columnas de identificador, no una

model y sku vuelven ambos. Dos identificadores te dan dos oportunidades de cruzar una fila con tu propio catálogo o con el feed de otro minorista, que suele ser la diferencia entre un join que funciona y otro que descarta en silencio la mitad de las filas.

Palabras clave y URLs en la misma caja

No te obligan a elegir una forma de entrada. Un término de búsqueda, una página de categoría y una página de producto pueden ocupar líneas consecutivas de la misma ejecución, de modo que un solo trabajo puede cubrir a la vez un barrido amplio y una lista corta de seguimiento.

Lee esto primero

Tres cosas que saber
antes de planificar una ejecución.

Uno es un requisito firme, otro tiene que ver con cuánto está dispuesta a prometer esta página, y el último es una trampa silenciosa en la subida de archivos.

Este servicio necesita tu propio proxy residencial de pago. Cuando una ejecución vuelve sin nada, la plataforma explica por qué: homedepot.com no deja pasar direcciones de proxy gratuitas, hace falta una dirección residencial de pago configurada como PROXY_URL, y tu IP real nunca se usa. Ese mensaje solo aparece después de una ejecución vacía, que es justamente por lo que conviene leerlo antes aquí: de otro modo una tabla vacía parece un servicio roto en lugar de un ajuste que falta.

No hemos medido esta exportación, y esta página no finge lo contrario. Las doce columnas de abajo son las que declara el servicio, en el orden en que las declara. Lo que hay dentro -si price es un número o una cadena, qué vocabulario usa availability, si rating y reviews son cifras simples, con qué frecuencia se rellena original_price- no aparece en ninguna parte de esta página, porque no tenemos ninguna exportación de este servicio con la que contrastarlo. Otras páginas de aquí sí indican formatos; detrás tenían ejecuciones reales. Haz una primera ejecución pequeña y lee tu propia fila de cabecera antes de montar un pipeline sobre cualquier suposición acerca de la forma.

El cargador de archivos lee menos de lo que podrías esperar. Ofrece CSV, XLSX, TXT y Parquet, pero un archivo Parquet se rechaza en el navegador con una nota que te dice que pegues las URLs o uses uno de los otros tres. En un CSV o TXT toma solo la primera columna de cada línea, así que una hoja con las URLs en la columna B se subirá como una lista de lo que haya en la columna A. Un XLSX se comporta igual con la primera hoja. Lo que sí lee se combina con lo que ya esté escrito en la caja y se deduplica, algo cómodo cuando lo sabes y desconcertante cuando no.

Lo que recibes

Doce columnas declaradas,
nombradas, no medidas.

Esta es la lista de columnas del propio servicio, en su propio orden. Las descripciones dicen para qué sirve cada columna; deliberadamente no dicen qué aspecto tienen sus valores.

query
La palabra clave o la URL de la que salió esta fila. Es la primera columna que declara el servicio, que es la convención en esta plataforma para repetir la entrada en cada fila.
name
El nombre del producto. La tabla de resultados lo muestra como texto del enlace, usando url como destino.
brand
La marca bajo la que está clasificado el anuncio. Aparece como columna propia en la tabla de resultados, así que está separada del nombre del producto y no incrustada en él.
price
El precio del anuncio. La interfaz muestra esta columna como $ seguido del valor, de modo que el valor que recibe no lleva símbolo de moneda propio: eso es lo único que podemos afirmar de esta columna sin una exportación.
original_price
El precio de lista que se muestra junto al actual. Léelo junto con price para obtener un descuento. No podemos decirte con qué frecuencia se rellena, porque no hemos ejecutado este servicio.
rating
La valoración del producto. Aparece en la tabla de resultados junto al número de reseñas. Esta página no afirma nada sobre su escala ni sobre su tipo.
reviews
Cuántas reseñas tiene el producto. Nombrada como recuento y no como texto de reseña: para las reseñas en sí, usa el scraper de reseñas independiente enlazado abajo.
model
Un identificador de modelo del producto. Se declara aparte de sku, así que no son el mismo número, pero qué numeración usa cada uno no es algo que esta página vaya a afirmar sin una exportación delante.
sku
Un segundo identificador, declarado junto a model. Útil como clave de cruce alternativa; en la nota sobre model está el motivo por el que ninguno se describe aquí con más precisión.
url
El enlace a la página del producto. La tabla de resultados lo usa como href detrás del nombre del producto, así que lleva a una página de homedepot.com.
image
Un enlace a la imagen del producto.
availability
La disponibilidad del producto. La página no enumera los valores posibles, porque no hemos visto ninguna fila de esta exportación de la que leerlos.

Estas son columnas declaradas, no medidas. Cualquier otra afirmación de esta página procede o bien de la propia lista de columnas del servicio, o bien de la interfaz de la plataforma que puedes ver tú mismo; nada viene de una exportación, porque no tenemos ninguna de este servicio. Por eso arriba no se indica ningún tipo, formato, vocabulario de valores ni tasa de relleno: una conjetura plausible sobre availability o price te valdría menos que un hueco honesto. Dos cosas en las que sí puedes confiar. La lista de columnas está fijada en doce y es la base de cualquier descarga JSON o Excel, así que una fila de cabecera no te sorprenderá. Y la ejecución no devolverá nada en absoluto si antes no hay un proxy residencial de pago configurado, que es con diferencia el motivo más frecuente de que este servicio parezca vacío. Haz una primera ejecución pequeña, lee tu propia fila de cabecera y trátala como la especificación de todo lo que venga después.

Flujos de trabajo habituales

Lo que la gente
ejecuta de verdad.

Todos empiezan con algo que escribirías en el propio buscador de Home Depot.

Precios

Vigilar los precios y descuentos de una categoría

Pega una URL de categoría, ejecútala de forma programada y mantén price junto a original_price. La diferencia entre ambos es la promoción, y observarla en toda una categoría dice más que observar cualquier producto suelto.

Precios · Inteligencia competitiva
Catálogo

Cruzar una lista de proveedor con lo que realmente está en venta

Sube tus palabras clave o URLs de producto y luego cruza los resultados con tu propio catálogo por model o por sku. Dos columnas de identificador significan que una fila que falla con una todavía tiene una segunda oportunidad con la otra.

Merchandising · Operaciones
Surtido

Ver qué contiene una categoría antes de entrar en ella

Una ejecución amplia de categoría sin límite devuelve el surtido como filas: marcas, niveles de precio, valoraciones y números de reseñas juntos. Es una pregunta distinta de cuánto cuesta un producto concreto, y es la que conviene hacerse primero.

Estrategia · Planificación de surtido
Precios

Paga por fila de producto,
y por nada más.

La misma tarifa plana que cualquier otro scraper de la plataforma. Sin plan, sin licencias, sin mínimo mensual.

Gratis

500 filas, gratis

Una sola vez en cada cuenta nueva. Sin tarjeta. Todos los scrapers desbloqueados, y suficiente para confirmar que tu proxy está configurado y leer tú mismo la fila de cabecera real de este servicio antes de montar nada encima.

Una sola vez · Sin tarjeta
Pago por uso

0,002 $ por fila

Unos 2 $ por 1.000 productos, la misma tarifa plana que cualquier otro scraper de aquí. El límite se aplica por consulta, así que una lista de palabras clave lo multiplica, y dejarlo vacío lo trae todo.

Los créditos no caducan
Empresas

A medida: categorías enteras, programadas

Precio por volumen, SLA, workers dedicados e integración a medida para equipos que siguen surtidos minoristas de forma programada, en lugar de consultar un puñado de productos. Dinos tus cifras y te preparamos un presupuesto.

Habla con ventas
10 % de descuento en tu primera ejecución de pago.Usa el código LIVESCRAPER10 al pagar.
Registrarse
Combina bien con

El anuncio,
y lo que hay a su alrededor.

Este devuelve la fila de producto. Aquellos devuelven lo que hay detrás, o el mismo lineal en la competencia. Cada uno tiene su propio esquema.

La parte legal

¿Es legal hacer scraping
de los anuncios de Home Depot?

Respuesta corta: son anuncios de productos públicos, y nada en las doce columnas describe a una persona.

Todo lo que hay en estas columnas se le muestra a cualquier visitante en una página pública de búsqueda o de producto de homedepot.com. No se usa ningún inicio de sesión, no se cruza ningún muro de pago y no se toca ninguna cuenta. Recopilar información de productos y precios publicada abiertamente para investigación y comparación es una práctica establecida desde hace mucho, y la transparencia de precios es uno de los casos más claros a su favor.

Esta exportación no lleva datos personales. Cada columna describe un producto: un nombre, una marca, dos precios, una valoración y un recuento, dos identificadores, un enlace, una imagen y un estado de disponibilidad. En la lista declarada no aparece ningún autor de reseña, ningún nombre de vendedor, ningún contacto ni ningún correo, algo que no podemos decir de la mayoría de las páginas de este sitio. La valoración es un agregado de lo que dijeron los clientes y no lo dicho en sí; si quieres las reseñas individuales, ese es el servicio aparte enlazado arriba, y trae consigo una obligación mayor.

La exigencia de pasar por tu propio proxy residencial de pago es una condición técnica de uso más que jurídica, pero conviene leerla como una señal: Home Depot dedica un esfuerzo real a controlar el acceso automatizado, y sus términos lo regulan. Léelos antes de escalar, mantén la recopilación proporcionada a la investigación que realmente estás haciendo y no tomes unos precios publicados como licencia para republicar un catálogo entero. No ejecutamos rastreadores de terceros en la capa de datos, y tus exportaciones se autoeliminan a los 30 días.

livescraper.app · principios
Solo datos públicos
Sin inicios de sesión ni muros de pago
Ningún dato personal en ninguna columna declarada
Las exportaciones se borran solas (30 días)
Los mismos anuncios que ve cualquier visitante en homedepot.com.
Preguntas frecuentes

Lo que se pregunta antes de registrarse.

¿Qué envío?+
Una palabra clave o una URL de homedepot.com, una por línea, mezcladas libremente. Las páginas de categoría y las de producto individual funcionan por igual: el propio ejemplo del formulario muestra dos URLs de categoría y una de producto. Puedes subir un archivo en lugar de pegar, con las salvedades de más abajo.
¿Necesito un proxy?+
Sí, y este es un paso de configuración y no una salvedad. Home Depot no deja pasar direcciones de proxy gratuitas, así que el servicio necesita una dirección residencial de pago configurada como PROXY_URL; tu IP real nunca se usa. Configúrala antes de la primera ejecución, o la ejecución volverá vacía y el motivo solo aparecerá después.
¿Qué columnas contendrá la exportación?+
Doce, en este orden: query, name, brand, price, original_price, rating, reviews, model, sku, url, image y availability. Esa es la lista que declara el propio servicio, y es a partir de ella que se construye cualquier descarga JSON o Excel.
¿Por qué esta página no describe los formatos de los datos?+
Porque no tenemos ninguna exportación de este servicio y no vamos a adivinar. Otras páginas de aquí indican formatos medidos; detrás tenían ejecuciones reales que leer. Aquí tienes la lista de columnas y lo que muestra la propia interfaz, y nada sobre tipos, vocabularios de valores ni con qué frecuencia se rellena una columna. Haz una primera ejecución pequeña y lee tu propia fila de cabecera.
¿Cómo funciona el límite?+
Por defecto es 100 y se aplica por consulta y no por ejecución, así que una lista de palabras clave lo multiplica. El valor más pequeño que acepta es 1, y dejar el campo vacío lo trae todo. Ten en cuenta que esto no es igual que en nuestra búsqueda de empresas de Glassdoor, cuyo formulario admite el 0 como valor que significa «todo».
¿Puedo subir una hoja de cálculo con URLs?+
Sí, con dos cosas que vigilar. Un CSV o TXT se lee línea a línea y solo se usa su primera columna, y un XLSX usa la primera columna de la primera hoja, así que pon tus palabras clave o URLs en la primera columna. El selector de archivos incluye Parquet, pero el navegador lo rechaza y te indica que pegues las URLs o uses uno de los otros tres formatos. Lo que sí se lee se combina con lo que hayas escrito y se deduplica.
¿Puedo ordenar los resultados o elegir una tienda?+
No. Este formulario no tiene control de orden ni selector de tienda, región o país: admite consultas y un límite, y nada más. Si el orden te importa, ordena la exportación después de descargarla.
¿En qué formatos puedo descargar?+
JSON o Excel. Esos son los dos botones de descarga que ofrece la plataforma en este servicio; aquí CSV es un formato de subida y no de descarga.
¿Cuánto cuesta?+
Las primeras 500 filas de una cuenta nueva son gratis y por una sola vez; a partir de ahí son 0,002 $ por fila (unos 2 $ por cada 1.000), con pago por uso y sin suscripción. Los créditos no caducan y no hay reinicio mensual.

Ejecuta una palabra clave,
y después una categoría.

Devuelven cosas muy distintas, y ejecutar ambas es la forma más rápida de ver para qué sirve esta exportación. Tus primeras 500 filas son gratis.

Se activa al instante · sin tarjeta

Exportar los anuncios de productos de Home Depot en filas

El Scraper de Productos de Home Depot convierte una búsqueda en homedepot.com en una hoja de cálculo. Envías palabras clave o URLs de Home Depot -una por línea, mezcladas libremente, con páginas de categoría y de producto individual admitidas por igual, o subidas como archivo CSV, XLSX o TXT-, fijas un límite por consulta y cada anuncio vuelve como una fila: el nombre del producto, su marca, su precio y su precio de lista, su valoración y su número de reseñas, un número de modelo y un SKU, un enlace a la página, una imagen y un estado de disponibilidad. Doce columnas, una fila por producto, descargables en JSON o Excel.

Dos cosas condicionan su uso, y conviene conocer ambas antes de una primera ejecución. La primera es que el servicio exige tu propio proxy residencial de pago, configurado como PROXY_URL. Home Depot no deja pasar direcciones de proxy gratuitas, y una ejecución sin uno vuelve vacía: la plataforma explica el motivo solo después, que es justo por lo que aquí se dice al principio. La segunda es que esta página documenta la lista de columnas declarada y se detiene ahí a propósito. No tenemos ninguna exportación de este servicio, así que aquí nada afirma un tipo de dato, un formato de valor, un vocabulario para availability ni con qué frecuencia se rellena original_price. Varias páginas de este sitio sí indican formatos medidos, porque había ejecuciones que leer; esta es honesta al reconocer que no las tiene. Haz una primera ejecución pequeña y deja que tu propia fila de cabecera sea la especificación.

Lo que sí te dice la lista de columnas merece la pena. price y original_price llegan como columnas separadas, así que un descuento es aritmética y no inferencia, y seguir el par a lo largo de una categoría en el tiempo te da la forma de una promoción en vez de una instantánea. model y sku se declaran por separado, lo que significa dos oportunidades de cruzar una fila con tu propio catálogo o con el feed de un competidor, que suele ser la diferencia entre una tasa de coincidencia fiable y otra que descarta filas en silencio. Y como palabras clave y URLs comparten la misma caja de entrada, un solo trabajo puede cubrir a la vez un barrido amplio de categoría y una lista corta de productos concretos.

Unas notas prácticas. El límite es 100 por defecto, acepta un mínimo de 1 y se aplica por consulta y no por ejecución, así que una lista de palabras clave lo multiplica; déjalo vacío para llevarte todo, aunque una categoría amplia sin límite puede tardar mucho. El cargador de archivos solo lee la primera columna de un CSV, TXT o XLSX, y rechaza Parquet en el navegador, así que mantén tus URLs en la columna A. No hay control de orden ni selector de tienda o región: ordena la exportación después de descargarla. En lo legal, esta exportación es inusualmente limpia: cada columna describe un producto y no a una persona, y en la lista declarada no aparece ningún autor de reseña, vendedor, contacto ni correo. Los términos de Home Depot siguen rigiendo el acceso automatizado, así que léelos antes de escalar. Empieza gratis: tus primeras 500 filas no cuestan nada ni piden tarjeta, y después son 0,002 $ por fila, tarifa plana. Consulta precios para las tarifas actuales.