Extractor de Productos de CDW

Una URL de categoría entra,
una fila por producto sale.

CDW es un distribuidor de tecnología y, a diferencia de los otros catálogos de este esquema, no hace falta darle los productos de uno en uno. Dale una página de categoría y devuelve una fila por cada producto listado en ella, con el precio, la referencia de CDW y la del fabricante en cada una.

500 filas gratis por única vezdespués 0,002 $ por filauna URL de categoría se abre en muchas filasCSV · JSON · Excel
Cómo funciona

Una lista de URLs entra, una hoja de cálculo sale.

  1. PASO 1Inicia sesión en la plataforma.
  2. PASO 2Abre el CDW Products Scraper.
  3. PASO 3Pega las URLs de CDW que quieras, una por línea: una página de categoría devuelve todos sus productos, una página de producto devuelve una fila.
  4. PASO 4Elige tu formato de salida (CSV / JSON / XLSX).
  5. PASO 5Lanza el trabajo.
  6. PASO 6Descarga los resultados: diecisiete columnas por fila.
Qué esperar

Lo que conviene saber antes de lanzarlo.

Una URL de categoría se abre en una fila por producto

Esta es la diferencia útil. Nuestra ejecución envió una sola página de categoría de portátiles 2 en 1 y recibió 24 filas, todas informando ok, todas compartiendo la misma query, cada una con su propia product_url. Los otros scrapers de catálogo de este esquema dan una fila por URL enviada. Aquí una URL puede ser un estante entero, y la entrada de ejemplo publicada para este servicio es precisamente una página de categoría.

El precio es real, y no está en el código de la página

Las 24 filas llevaban parsed_price, price y currency. Pide tú mismo la misma página de producto y encontrarás ambos identificadores y el nombre en el marcado, y ninguna cifra en dólares, ni un bloque de datos estructurados tampoco. El precio se renderiza en el navegador. Por eso un servicio que renderiza la página devuelve uno y una petición HTTP corriente no.

Dos referencias, y no son la misma

sku_code es la referencia propia de CDW: también es el último segmento de la URL de producto y el identificador dentro de la URL de imagen. sku es la referencia del fabricante. En nuestras filas eran valores distintos, y los dos aparecen en la página en vivo. Revisa ambos antes de elegir una clave de cruce: la del fabricante es la que sobrevive al salto a otro distribuidor.

Cinco de las diecisiete columnas volvieron vacías

brand, rating, reviews, description y availability estaban vacías en las 24 filas. Una página de listado de distribuidor lleva precio y referencias en vez de el mobiliario de reseñas de consumo, así que planifica el importador según lo que llega y no según la lista de columnas.

El esquema cambió entre el 1 y el 3 de julio de 2026

Nuestra ejecución más antigua lleva una cabecera de once columnas: sin parsed_price, sin sku_code, sin product_url, sin description, sin reviews, sin images. Todas las ejecuciones desde el 3 de julio tienen la forma de diecisiete columnas documentada abajo. Si tienes una exportación antigua de CDW, por eso faltan cuatro de las columnas que esperas.

Los bloqueos ocurren, y son intermitentes

Dos de nuestras ejecuciones volvieron con blocked (needs residential proxy) el mismo día en que otras devolvieron filas completas. La columna de estado te dice cuál es cuál, así que una fila bloqueada es visible y no silenciosa. Ocho ejecuciones son una muestra demasiado pequeña para citar una tasa de éxito, así que no la citamos: incluye reintentos.

Lo que recibes

Diecisiete columnas, doce de ellas con datos.

Leídas de la cabecera de una exportación real, en el orden de la hoja. Los recuentos de abajo vienen de nuestra ejecución de 24 filas, así que donde aquí se dice que una columna llevaba un valor se está describiendo filas que realmente tenemos.

query
La URL de CDW que enviaste. En una ejecución de categoría es el mismo valor en cada fila que esa categoría produjo, que es lo que permite distinguir un estante de otro en una exportación combinada. Consérvala: con una apertura en abanico, es lo único que agrupa las filas.
sku_code
La referencia propia de CDW. Con datos en las 24 filas de nuestra ejecución de categoría. También es el último segmento de product_url y el identificador dentro de la URL de imagen, así que los tres coinciden y puedes verificar una fila contra sí misma.
product_url
La página de producto canónica. En una ejecución de categoría es el producto propio de la fila -24 filas, 24 valores distintos-, que es lo que hace la apertura útil en vez de simplemente larga.
name
El título del producto tal como lo indica el listado. Espera redacción de distribuidor con la configuración escrita: procesador, memoria y almacenamiento suelen formar parte del nombre y no ser campos aparte.
description
Pensada para llevar el texto largo del producto. Vacía en las 24 filas. Un listado de categoría no imprime uno; una página de producto quizá sí.
parsed_price
El precio como número puro. Con datos en las 24 filas. Es el que usar para calcular, y en la nota de abajo está por qué existe siquiera, dado que la página no lo sirve.
price
El mismo precio tal como se muestra, con símbolo y separador de miles. Úsalo cuando necesites enseñar exactamente lo que CDW enseñaba; usa parsed_price para la aritmética.
currency
La moneda en la que se cotiza el precio. Con datos en las 24 filas. Léela en vez de suponerla: un distribuidor con tiendas internacionales no siempre responde en la misma.
availability
Pensada para llevar el estado de stock. Vacía en las 24 filas. Trata su ausencia como que el listado no publica uno, no como que el producto no está disponible.
rating
Pensada para llevar una valoración media. Vacía en las 24 filas. Un listado de distribuidor dirigido a compradores profesionales normalmente no lleva valoraciones de consumo.
reviews
Pensada para llevar el recuento de reseñas, con la misma advertencia que rating. Vacía en las 24 filas.
images
Todas las imágenes que lleva el listado. Con datos en las 24 filas. Conviene saber: la URL de imagen incluye un preajuste de renderizado, y ese preajuste difería entre nuestra ejecución de categoría y la de producto -el mismo producto, dos tamaños distintos. No trates la URL como identidad estable; lo estable es el identificador que hay dentro.
brand
Pensada para llevar el fabricante. Vacía en las 24 filas, aunque el nombre del fabricante suele ser la primera palabra de name. Si necesitas agrupar por marca, extráela del nombre.
sku
La referencia del fabricante, y un valor distinto de sku_code. Esta es la columna por la que cruzar cuando preguntas si otro distribuidor lista el mismo producto físico.
url
La dirección desde la que se produjo la fila. En nuestra ejecución de categoría esto era igual a product_url y no a query: la fila apunta a su propio producto, no al estante del que salió.
image
La imagen principal por separado, para que el caso habitual no requiera partir cadenas. Misma advertencia sobre el preajuste de renderizado que images.
status
Un indicador por fila escrito por nuestro exportador, no por CDW. A lo largo de nuestras ocho ejecuciones tomó cuatro valores: ok, blocked (needs residential proxy), no response (proxy) y http 404. Concilia por esta columna, sobre todo con una apertura en abanico, donde el número de filas por sí solo no dice nada.

Diecisiete columnas por fila · CSV, JSON o Excel

Dos cosas de esta tabla merecen leerse antes de construir contra ella. Primero, los precios son reales. Las 24 filas de nuestra ejecución de categoría llevaban un número, un precio formateado y una moneda: este es el único catálogo de esta familia cuyas columnas de dinero llegan con datos. Pero pedir la misma página de producto directamente devuelve unos 57 KB de HTML que contienen ambas referencias y el nombre del producto y ningún precio, sin bloque de datos estructurados del que leer uno. La cifra se renderiza en el navegador. Nuestra exportación la tiene porque el servicio renderiza la página, y un scraper construido sobre una librería HTTP y un analizador de HTML volvería con las manos vacías aparentando funcionar. Segundo, el esquema se movió. Nuestra ejecución del 1 de julio lleva una cabecera de once columnas -query, name, brand, price, currency, sku, availability, rating, url, image, status- sin parsed_price, sku_code, product_url, description, reviews ni images. Todo lo del 3 de julio en adelante es la forma de diecisiete columnas de arriba. Si estás conciliando lo viejo contra lo nuevo, esa es la diferencia.

Flujos de trabajo habituales

Para qué sirve una apertura en abanico.

Barrido de precios por categoría

Poner precio a un estante entero en una petición

Envía las páginas de categoría que te importan en vez de enumerar productos. Una URL devolvió dos docenas de filas con precio en nuestra ejecución, así que un barrido semanal de un puñado de categorías es un trabajo pequeño que produce una serie de precios real. Este es el flujo para el que está pensado el servicio.

Precios · Monitorización
Comparación entre distribuidores

Localizar el mismo hardware en otro distribuidor

sku es la referencia del fabricante, así que sobrevive al salto de CDW al catálogo de un competidor, cosa que la propia sku_code de CDW no hace. Combínala con parsed_price y podrás responder quién es más barato en una pieza idéntica y no en un nombre parecido.

Compras · Aprovisionamiento
Mapeo de configuraciones

Leer la especificación desde el nombre del producto

Los listados de distribuidor ponen la configuración en el título: procesador, memoria, almacenamiento. Con description vacía, name es donde vive ese detalle, y extraerlo te da una tabla de especificaciones comparable en toda una categoría sin abrir una sola página.

Investigación de categoría · Surtido
Conciliación de catálogo

Alinear tus registros de compra

sku_code es el número que CDW usa en su propio sistema, lo que lo convierte en el adecuado para conciliar presupuestos y facturas. Conserva las dos columnas de identificador y podrás hablar con el distribuidor en su numeración y con tu inventario en la del fabricante.

Compras · Registros
Precios

Paga solo por lo que realmente usas.

Plan gratuito

Las primeras 500 filas son gratis

Por única vez, al registrarte. Sin tarjeta y sin nada que cancelar después.

Por única vez, al registrarte
Tarifa

después 0,002 $ por fila

Se factura por filas realmente devueltas, algo que aquí importa más que en otros sitios, porque una URL de categoría puede producir docenas de filas. Nuestra ejecución de 24 filas costó 24 filas, no una.

Facturado por filas devueltas
Sin suscripción

Nada recurrente

Los créditos no caducan en un ciclo mensual. Lanza un barrido de categorías en marzo y nada más hasta septiembre si el trabajo tiene esa forma.

Sin caducidad mensual
10 % de descuento en tu primera ejecución de pago.Usa el código LIVESCRAPER10 al pagar.
Registrarse
Combina bien con

Otros catálogos, las mismas diecisiete columnas.

La parte legal

¿Es legal hacer scraping de CDW?

Los precios y las referencias en un listado de acceso público son información competitiva corriente. Las advertencias que merece la pena señalar aquí van sobre el ritmo y sobre leer las preferencias declaradas del propio sitio.

Un precio, un nombre de producto y una referencia son hechos sobre bienes puestos a la venta. Leerlos de una página que se sirve a cualquier visitante es la misma actividad que un comprador hace a mano, a una velocidad útil. Nada en las diecisiete columnas describe a una persona: no hay nombre, ni correo, ni teléfono, ni cuenta, así que las cuestiones de protección de datos que marcan nuestros servicios sobre personas no se plantean aquí.

Dos cosas son propias de este sitio. Primero, el ritmo. Una URL de categoría que se abre en dos docenas de filas hace más trabajo por petición que una descarga de un solo producto, y dos de nuestras propias ejecuciones volvieron bloqueadas un día en que otras funcionaron. Vamos a un ritmo considerado y sacamos el bloqueo a la columna de estado en vez de reintentarlo hasta el agotamiento; deberías programar en consecuencia y no tratar la apertura en abanico como un multiplicador gratis. Segundo, las preferencias declaradas del sitio. El robots.txt de CDW devuelve 403 a un cliente simple y 200 a un agente de navegador: lo informamos en vez de fingir que el archivo se leyó limpiamente. Leído con agente de navegador no lleva exclusión general para rastreadores comunes, y ni la ruta de producto ni la de categoría que usamos están prohibidas.

Nuestras condiciones son las mismas que en cualquier otro servicio de aquí. Solo páginas de acceso público, nada detrás de un inicio de sesión, sin rastreadores de terceros en la capa de datos, y las exportaciones se eliminan automáticamente a los 30 días. Tus primeras 500 filas son gratis y no necesitan tarjeta.

livescraper.app · qué condiciona una ejecución
Una URL de categoría puede volverse docenas de filas
La página se renderiza, no solo se descarga
Los bloqueos son intermitentes: la columna de estado los muestra
Solo acceso anónimo
Las exportaciones se eliminan a los 30 días
El precio no está en el código de la página. El renderizado es lo que lo produce, y esa es toda la razón de ser de este servicio.
Preguntas frecuentes

Lo que la gente pregunta antes de registrarse.

¿Puedo enviar una URL de categoría en vez de productos sueltos?+
Sí, y es el uso previsto. Nuestra ejecución envió una página de categoría de portátiles 2 en 1 y recibió 24 filas, todas informando ok, todas compartiendo la misma query, cada una con su propia product_url. La entrada de ejemplo publicada para este servicio es precisamente una página de categoría. Una URL de producto también funciona y devuelve una sola fila.
¿La exportación incluye precios?+
Sí. Las 24 filas de nuestra ejecución de categoría llevaban parsed_price, price y currency. Eso hace a CDW inusual entre los catálogos de este esquema, donde las columnas de dinero suelen estar vacías por razones propias de cada sitio.
¿Por qué no puedo pedir la página y leer el precio yo mismo?+
Porque no está ahí. Pedir la misma página de producto devuelve unos 57 KB de HTML con ambas referencias y el nombre del producto, sin ninguna cifra en dólares y sin bloque de datos estructurados del que leer una. El precio se renderiza en el navegador después. Un scraper construido sobre una librería HTTP y un analizador de HTML aparentará funcionar y devolverá una columna de precio vacía.
¿Qué columnas vuelven realmente con datos?+
Doce de las diecisiete, en nuestra ejecución de 24 filas: query, sku_code, product_url, name, parsed_price, price, currency, images, sku, url, image y status. Vacías en las 24: description, availability, rating, reviews y brand.
¿Por qué hay dos referencias?+
Son cosas distintas. sku_code es la referencia propia de CDW -el mismo valor con el que termina la URL de producto y que aparece dentro de la URL de imagen- y sku es la del fabricante. Usa la de CDW para hablar con CDW de un presupuesto, y la del fabricante para encontrar el mismo producto físico en el catálogo de otro distribuidor.
Tengo una exportación de CDW más antigua y tiene menos columnas. ¿Por qué?+
El esquema cambió. Nuestra ejecución del 1 de julio de 2026 lleva una cabecera de once columnas sin parsed_price, sku_code, product_url, description, reviews ni images. Todas las ejecuciones desde el 3 de julio tienen la forma de diecisiete columnas. Si estás conciliando lo viejo contra lo nuevo, esa es la diferencia.
¿Qué significa la columna status?+
La escribe nuestro exportador, no CDW, e informa de si la fila se recuperó. A lo largo de nuestras ocho ejecuciones tomó cuatro valores: ok, blocked (needs residential proxy), no response (proxy) y http 404, este último en una dirección de marcador que no existe. Concilia por esta columna y no por el número de filas, que una apertura en abanico deja sin sentido por sí solo.
¿Cuánto cuesta?+
Tus primeras 500 filas son gratis, por única vez y sin tarjeta. Después son 0,002 $ por fila, facturadas por filas realmente devueltas. Con una apertura en abanico conviene planificarlo: nuestra única URL de categoría produjo 24 filas, y 24 filas es lo que costaría.
¿En qué formatos puedo exportar?+
CSV, JSON o Excel. Las diecisiete columnas y su orden son los mismos en los tres.

Pon precio a un estante, no a un producto.

Una URL de categoría, una fila por cada producto en ella, con el precio y ambas referencias en cada una. Tus primeras 500 filas son gratis, después 0,002 $ cada una.

Se activa al instante · sin tarjeta

Hacer scraping de datos de producto de CDW

CDW es un distribuidor de tecnología que vende hardware, software y servicios a empresas, administraciones y centros educativos. Dos cosas hacen que hacerle scraping sea distinto de los otros catálogos que comparten este esquema de diecisiete columnas, y conviene conocer las dos antes de escribir un importador. La primera es que una URL de categoría se abre en abanico. Nuestra ejecución envió una sola página de categoría de portátiles 2 en 1 y recibió veinticuatro filas, todas informando éxito, todas con la URL enviada en query y con su propia product_url distinta. En todos los demás sitios de esta familia una URL significa una fila. Aquí una URL puede ser un estante entero, y la propia entrada de ejemplo publicada por el proveedor para este servicio es una página de categoría y no de producto: la apertura en abanico es el flujo previsto, no un efecto secundario.

La segunda es el precio. Las veinticuatro filas llevaban un número calculable, un precio formateado y una moneda, lo que hace a CDW inusual aquí: en nuestras otras páginas de catálogo las columnas de dinero están vacías por razones propias de cada sitio. Lo interesante es dónde no está ese precio. Pedir la misma página de producto directamente devuelve unos 57 KB de HTML que contienen la referencia de CDW, la del fabricante y el nombre completo del producto, y ninguna cifra en dólares, sin bloque de datos estructurados del que leer una. La cifra se renderiza en el navegador después de que llegue el marcado. Un scraper construido sobre una librería HTTP y un analizador de HTML encontrará los identificadores, se perderá el precio por completo y dará toda la apariencia de funcionar. Este servicio carga la página como lo hace un navegador, que es toda la razón de que la columna venga con datos.

Las columnas de identificador merecen atención. sku_code es la referencia propia de CDW, y también es el último segmento de la URL de producto y el identificador incrustado en la URL de imagen, así que una fila se puede verificar contra sí misma. sku es la referencia del fabricante y un valor genuinamente distinto. La del fabricante es la que sobrevive al salto a otro distribuidor, así que es la columna por la que cruzar cuando preguntas si alguien más lista el mismo hardware físico; la de CDW es la que concilia contra un presupuesto. Cinco columnas volvieron vacías en todas las filas -brand, rating, reviews, description y availability-, que es a lo que se parece un listado profesional: referencias y precio en vez de mobiliario de reseñas de consumo. El fabricante suele ser la primera palabra de name si necesitas agrupar por él.

Dos advertencias dichas y no enterradas. El esquema cambió entre el 1 y el 3 de julio de 2026: nuestra ejecución más antigua lleva una cabecera de once columnas sin parsed_price, sku_code, product_url, description, reviews ni images, y todo lo posterior es la forma de diecisiete. Si tienes una exportación antigua, por eso no cuadran las columnas. Y el bloqueo es real e intermitente: dos de nuestras ocho ejecuciones devolvieron blocked (needs residential proxy) el mismo día en que otras devolvieron filas completas, así que la columna de estado importa y una programación debería incluir reintentos. Ocho ejecuciones son una muestra demasiado pequeña para citar una tasa de éxito y no citamos ninguna. Sobre el acceso: el robots.txt de CDW devuelve 403 a un cliente simple y 200 a un agente de navegador, lo cual informamos en vez de maquillarlo; leído así no lleva exclusión general, y ni la ruta de producto ni la de categoría que usamos están prohibidas. Solo páginas de acceso público, sin rastreadores de terceros en la capa de datos, y las exportaciones se eliminan automáticamente a los 30 días. Tus primeras 500 filas son gratis y no necesitan tarjeta.