Scraper de Productos de ItemInfo

Entra una URL de categoría,
sale un catálogo con precios.

Apúntalo a una página de producto de ItemInfo o a una categoría de búsqueda entera y recibe el catálogo como filas: nombre, precio, moneda, disponibilidad, marca y los identificadores que hacen cruzable una exportación - sku, mpn y gtin. Quince columnas, una fila por producto. Y a diferencia de varios scrapers de aquí, no hay ningún proxy que configurar.

500 filas gratis, una sola vez0,002 $ por fila después15 columnasCSV · XLSX · JSON
Cómo funciona

Cinco pasos,
y ninguna configuración.

Una entrada y un control. Aquí no hay proxy que configurar, así que todo el trabajo es una lista de enlaces y un número.

  1. PASO 1Inicia sesión en la plataforma.
  2. PASO 2Abre el Scraper de Productos de ItemInfo.
  3. PASO 3Pega URLs de producto de ItemInfo o URLs de categoría y búsqueda, una por línea - o sube un archivo CSV, XLSX o TXT.
  4. PASO 4Fija un límite por consulta, o déjalo vacío para llevarte todo, y haz clic en Get Data.
  5. PASO 5Descarga el resultado como CSV, XLSX o JSON.

El límite es por consulta: cinco URLs de categoría con un límite de doscientos son doscientos productos de cada una, no doscientos en total.

Por qué lo usan los equipos

Nada que configurar,
y las claves correctas.

Sin proxy que aportar

Las peticiones salen por nuestro pool y no por tu propia dirección, y este minorista no es uno de los cuatro que la herramienta señala como necesitados de un proxy residencial adicional. Así que no hay nada que comprar, nada que configurar y ninguna segunda factura - algo que no es cierto de todos los scrapers de este catálogo, y la razón de que esta página sea más corta que sus hermanas.

Hecho para cruzar catálogos

sku, mpn y gtin están en la misma fila que el precio y la disponibilidad. Son los campos que permiten alinear una exportación con tu propio maestro de artículos o con la lista de otro distribuidor: cruzar por nombres de producto es adivinar, cruzar por número de pieza del fabricante no.

Una página de búsqueda es una entrada válida

No necesitas una lista de URLs de producto para empezar. Dale una URL de búsqueda o de categoría y vuelve desplegada, una fila por producto - que es exactamente como está escrito el propio ejemplo de la herramienta para ItemInfo, apuntando a una sección entera y no a un artículo suelto.

Lo que recibes

Quince columnas,
una fila por producto.

Cada fila es un artículo: cómo se llama, cuánto cuesta y en qué moneda, si está disponible, quién lo fabrica, los identificadores que lo fijan y cómo se presenta.

La lista de columnas de abajo es la fila de encabezado de exportaciones reales - cuarenta y cinco, todas idénticas -, corroborada por el array de columnas que dibuja la pantalla de ejecución. Los nombres son todo lo sólidos que pueden ser. Lo que viene después de la tabla importa más de lo habitual, eso sí, porque este servicio comparte una tubería con varios otros y nosotros nunca la hemos apuntado a ItemInfo. La nota dice exactamente qué nos permite y qué no nos permite contarte.

Diccionario de datos

Quince columnas,
y un techo honesto.

Los nombres son exactos y están doblemente confirmados. Las descripciones dicen para qué sirve cada columna, no qué contendrá, porque eso lo decide el minorista y no nosotros, y la nota de abajo explica por qué.

query
La URL que enviaste para esta fila: la página de producto, categoría o búsqueda de la que salió. La escribe el scraper, así que está en todas las filas.
service
De qué minorista salió esta fila. Este scraper comparte una tubería con varios otros servicios de producto, y el que elegiste queda estampado en cada fila - útil si mantienes más de un minorista en la misma tabla.
name
El nombre del producto tal y como lo declara la página.
price
El precio que declara la página.
currency
La moneda de ese precio, como columna aparte - así no tienes que extraer un símbolo del campo de precio.
availability
El estado de stock que declara la página.
brand
La marca que declara la página.
sku
El código de artículo propio del minorista.
mpn
El número de pieza del fabricante. Junto con gtin, es lo que hace que una exportación se pueda cruzar con un catálogo que no sea el de ItemInfo.
gtin
El número global de artículo comercial: el identificador del código de barras.
rating
La valoración del producto, si la página publica una. Aquí no se indica ninguna escala; no hemos visto ningún valor.
reviews
El número de reseñas. Un recuento, no el texto - en esta exportación no hay cuerpo de reseña.
image
La imagen de producto que declara la página.
url
El enlace al producto.
description
La descripción del producto que declara la página.

Dos cosas sobre las pruebas que hay detrás de esta página. Primero, el mecanismo: los productos se leen del JSON-LD que una página publica sobre sí misma, los datos estructurados que los minoristas incrustan para los buscadores. Eso pone un techo que esta página no va a fingir superar. Cada columna después de service existe solo si ItemInfo declara ese campo, así que un hueco significa no publicado, no ejecución fallida. Segundo, la laguna: nunca hemos ejecutado esto contra ItemInfo. Tenemos cuarenta y cinco exportaciones de la tubería compartida que hay detrás de este servicio y ninguna es una ejecución de ItemInfo: cuarenta y cuatro volvieron vacías y la única con datos es de otro minorista. Esa exportación vale como un dato honesto sobre la herramienta, no sobre ItemInfo: query y service venían rellenos en todas las filas, porque los escribe el propio scraper - y seis de las quince estaban vacías en todas y cada una de las filas. Cuenta también aquí con huecos, cuenta con que caigan en otro sitio porque otro minorista publica otros datos estructurados, y deja que tu primera ejecución del plan gratuito te diga cuáles. Por eso esta página tampoco imprime valores de ejemplo ni formatos: sin una ejecución de ItemInfo, nos los estaríamos inventando.

Controles de la ejecución

Un mando,
y una lista de enlaces.

Una línea es una página de producto, una categoría o una búsqueda. Más allá de eso hay un solo número que fijar y una forma de entregar una lista más larga - y nada más que configurar.

URL de producto URL de categoría URL de búsqueda Una por línea Límite por consulta Vacío o 0 se lo lleva todo Subida de CSV Subida de XLSX Subida de TXT Sin proxy necesario
De dónde salen los campos

La página lo declara,
nosotros lo reportamos.

Este scraper lee los datos estructurados que una página de producto publica sobre sí misma: el bloque JSON-LD que los minoristas incrustan para que los buscadores puedan mostrar un precio y un estado de stock. Por eso las columnas se leen como se leen: sku, mpn, gtin, brand, availability y currency son el vocabulario estándar para describir un producto, no nombres que nos hayamos inventado.

La consecuencia práctica es la que conviene tener en cuenta. Una columna es tan buena como el marcado del propio minorista. Si un campo falta en los datos estructurados de la página, vuelve vacío, y repetir la ejecución no cambia eso: no es un fallo, es una ausencia. En la única exportación con datos que tenemos de esta herramienta compartida, seis de las quince columnas estaban vacías en todas las filas.

Si necesitas algo que el marcado no lleva, ese es otro trabajo: el Scraper Universal con IA lee la página en sí y devuelve los atributos que nombres, en lugar de solo lo que se declaró para los buscadores.

livescraper.app · el techo
Leído del JSON-LD de la página
query y service: los escribimos nosotros
Las otras trece: las declara la página
Vacío = no publicado, no fallido!
Comprueba los huecos en tu primera ejecución
Los datos estructurados los decide cada minorista, y no todos deciden igual.
Entregar la lista

Las subidas se suman
y no eliminan duplicados.

Un archivo subido no vacía el cuadro: las líneas se añaden a lo que ya habías escrito, y los duplicados no se eliminan. Sube el mismo archivo dos veces y esas URLs se pedirán realmente dos veces, y se facturarán dos veces.

Para un CSV o un TXT se toma la línea entera como una URL, así que una hoja de cálculo con columnas extra no es lo que quieres aquí. Solo un XLSX se lee por columnas, y ahí toma la columna A.

El selector lista Parquet junto a CSV, XLSX y TXT, pero en realidad no puede leer uno en el navegador y te lo dirá - usa cualquiera de los otros tres.

livescraper.app · la subida
CSV · XLSX · TXT
Los duplicados NO se eliminan!
CSV y TXT: la línea entera
XLSX: columna A
Añadido a lo que escribiste
Revisa el cuadro antes de ejecutar: una lista duplicada es una factura duplicada.
Flujos de trabajo habituales

Tres tareas que la gente
ejecuta más aquí.

Algunas formas en que los equipos convierten el catálogo de un distribuidor en algo que una hoja de cálculo pueda responder.

Compras

Pon precio a tu propia lista de piezas

Exporta las categorías de las que compras y cruza el resultado con tu maestro de artículos por mpn o gtin en vez de por nombres. Lo que obtienes es una comparación línea a línea con lo que estás pagando de verdad, que es la versión de esa pregunta que un equipo financiero aceptará.

Compras · Finanzas
Catálogo

Rellena los huecos de tus propios datos

Si a tus fichas de producto les faltan números de fabricante o códigos de barras, una exportación de categoría es una fuente. Marca, sku, mpn y gtin llegan juntos en una fila, que suele bastar para reconciliar un artículo que ya tienes en stock.

Datos · Surtido
Disponibilidad

Vigila una categoría en el tiempo

Ejecuta la misma categoría de forma periódica y guarda las exportaciones. Cómo se mueven precio y disponibilidad en toda una sección dice más de un proveedor que cualquier artículo suelto - y como no hay proxy de por medio, aquí un trabajo recurrente solo cuesta sus filas.

Operaciones
Precios

Paga por los productos
que realmente extraes.

Sin suscripción, sin mínimo, sin factura recurrente - y en este, tampoco factura de proxy. Tus primeras 500 filas corren de nuestra cuenta.

Plan gratuito

500 filas gratis - 0 $

En cada cuenta nueva, una sola vez. Sin tarjeta de crédito. Límites por consulta, subida de archivos y todos los formatos de exportación incluidos - y nada que aportar encima, porque este servicio no necesita proxy propio.

0 $ para siempre
Pago por uso

0,002 $ por fila, tras el plan gratuito

La misma tarifa plana que cualquier otro scraper de la plataforma, y aquí una fila es un producto. El estimador muestra el número de filas y el coste en créditos antes de que arranque la ejecución: sin facturas sorpresa ni unidades de cómputo que traducir.

El más popular
Volumen

A medida · gran volumen

Precio por volumen, workers dedicados y un SLA para monitorización continua o extracciones de catálogo muy grandes. Dinos tus cifras y te lo presupuestamos.

Habla con nosotros
10 % de descuento en tu primera ejecución de pago.Usa el código LIVESCRAPER10 al pagar.
Regístrate
Combina bien con

La misma tubería,
otros estantes.

Uno es el gemelo de este scraper en un minorista que sí necesita proxy; el otro rellena los campos que una página nunca declaró.

La parte legal

¿Es legal hacer scraping
de catálogos de producto?

Respuesta corta: sí para los datos públicos de catálogo - y por el lado de la privacidad esto es de lo menos problemático que hay, porque no aparece ninguna persona.

Todo lo que hay en esta exportación se muestra en una página pública de producto a cualquiera que la abra: el nombre, el precio, la moneda, la disponibilidad, la marca, los identificadores, una imagen y una descripción. Es más: la mayor parte se publica en forma estructurada precisamente para que la lean las máquinas - para eso está el JSON-LD. Recopilarlo para investigación de precios y trabajo de catálogo es una práctica asentada desde hace mucho, y nada de esto toca un inicio de sesión, un precio de cliente ni una caja.

En estas quince columnas no hay ningún dato personal - ni nombres, ni reseñadores, ni datos de contacto. Eso hace corto el análisis de privacidad habitual. Lo que ocupa su lugar es comercial: los precios y la estructura del catálogo son información de negocio de un proveedor, y usarlos para orientar tus propias compras es corriente, mientras que republicar el catálogo de un distribuidor como propio es otra cosa que ninguna exportación vuelve aceptable.

Lo que esta página no hará es leer la ausencia de un requisito de proxy como una invitación. Que un minorista no bloquee direcciones de centros de datos no dice nada sobre lo que permiten sus términos, así que léelos antes de escalar un trabajo recurrente. No ejecutamos rastreadores de terceros en la capa de datos, y tus exportaciones se autodestruyen a los 30 días.

livescraper.app · principios
Solo páginas públicas de catálogo
Sin inicios de sesión, sin precios de cliente, sin caja
Ningún dato personal en ninguna columna
Que no bloqueen no es lo mismo que permiso!
Las exportaciones se autoborran (30 días)
Consulta los propios términos de ItemInfo antes de escalar.
Preguntas frecuentes

Lo que preguntan
antes de registrarse.

Las preguntas que más nos hacen. ¿Algo más? Habla con nosotros: las respuestas las escriben personas, no un bot.

¿Cómo hago scraping de datos de producto de ItemInfo?+
Con el Scraper de Productos de ItemInfo:
  1. Inicia sesión en la plataforma.
  2. Abre el Scraper de Productos de ItemInfo.
  3. Pega URLs de producto de ItemInfo o URLs de categoría y búsqueda, una por línea - o sube un archivo CSV, XLSX o TXT.
  4. Fija un límite por consulta, o déjalo vacío para llevarte todo, y haz clic en Get Data.
  5. Descarga el resultado como CSV, XLSX o JSON.
¿Necesito un proxy para este?+
No - y merece la pena decirlo porque varios scrapers de esta plataforma sí lo necesitan. Las peticiones salen por nuestro pool compartido y no por tu dirección real, y la herramienta nombra cuatro minoristas que necesitan además un proxy residencial propio. ItemInfo no es uno de ellos, así que no hay nada que configures. Esa es la valoración de la propia herramienta, no una promesa sobre cada ejecución.
¿Puedo apuntar a una categoría entera o solo a productos sueltos?+
A cualquiera de las dos. Una línea puede ser una URL de producto o una URL de categoría o búsqueda, y una categoría devuelve una fila por producto que contenga. El ejemplo que la propia herramienta pone en el cuadro para ItemInfo es una URL de búsqueda que cubre una sección entera, así que trabajar categoría a categoría es la forma prevista de usarlo.
¿De dónde salen realmente los datos?+
Del JSON-LD que la página publica sobre sí misma: los datos estructurados que los minoristas incrustan para los buscadores. Conviene saberlo porque pone el techo: este scraper reporta lo que ItemInfo declara, así que una columna vuelve vacía cuando la página nunca declaró ese campo, no porque la ejecución fallara.
¿Estarán rellenas las quince columnas?+
Casi con seguridad no, y no vamos a fingir lo contrario. Como los campos se leen de los datos estructurados de cada página, qué campos hay lo decide el minorista. En la única exportación con datos que tenemos de esta herramienta compartida - otro minorista, no ItemInfo - seis de las quince estaban vacías en todas las filas. Cuenta con huecos y deja que tu primera ejecución gratuita te diga cuáles aplican aquí.
¿Lo habéis ejecutado vosotros contra ItemInfo?+
No. Tenemos cuarenta y cinco exportaciones del scraper de productos compartido que hay detrás de este servicio y ninguna es una ejecución de ItemInfo. Así que los quince nombres de columna son sólidos - dos fuentes independientes coinciden - y qué devuelve ItemInfo en concreto lo establecerá tu primera ejecución del plan gratuito antes que nosotros.
¿Para qué sirve la columna service?+
Registra de qué minorista salió una fila. Este scraper es uno de varios servicios que comparten una única tubería de producto, y el servicio que elegiste se envía con el trabajo y se escribe en cada fila - así que si guardas exportaciones de más de un minorista en la misma tabla, esa columna es la que los mantiene separados.
¿Cuánto cuesta?+
Las primeras 500 filas son gratis y de una sola vez, sin tarjeta de crédito. Después son 0,002 $ por fila: la misma tarifa plana que cualquier otro scraper de la plataforma. Una fila es un producto, y no hay factura de proxy encima.

Tus primeros 500 productos,
invita la casa.

500 filas gratis, una sola vez, en cada cuenta nueva - sin caducidad. Después son 0,002 $ por fila, pago por uso, sin tarjeta registrada hasta que tú decidas. Nada más que aportar: este no necesita proxy propio.

Activo en segundos · sin tarjeta

Haz scraping de datos de producto de ItemInfo a escala

El Scraper de Productos de ItemInfo de Livescraper convierte páginas de catálogo en una hoja de cálculo. Pegas URLs de producto de ItemInfo, URLs de categoría o URLs de búsqueda - una por línea, o subidas como archivo CSV, XLSX o TXT -, fijas cuántos productos tomar por consulta y descargas el resultado en un archivo CSV, Excel o JSON limpio, una fila por producto. No hay proxy que configurar ni nada que instalar.

Cada fila lleva el nombre, el precio y su moneda como columnas separadas, la disponibilidad, la marca y los tres identificadores que hacen posible el trabajo de catálogo: sku, mpn y gtin. Los dos últimos son la razón de que esta exportación sea útil y no solo interesante - un número de pieza del fabricante se cruza con tu maestro de artículos, donde un nombre de producto solo lo hace aproximadamente. Valoración, número de reseñas, imagen, enlace y descripción completan las quince.

Los equipos de compras exportan las categorías de las que compran y cruzan el resultado con lo que ya están pagando, línea a línea. Los equipos de datos y surtido lo usan para rellenar números de fabricante y códigos de barras que faltan en sus propias fichas. Los equipos de operaciones ejecutan la misma categoría de forma periódica y vigilan cómo se mueven precio y disponibilidad en toda una sección en lugar de en un solo artículo - barato de repetir aquí, porque las filas son el único coste.

Un límite se dice con claridad en lugar de enterrarlo. Los campos se leen de los datos estructurados que cada página publica sobre sí misma, lo que significa que una columna vacía es un campo que el minorista nunca declaró y no una ejecución fallida; en la única exportación con datos que tenemos de esta herramienta compartida, de otro minorista, seis de las quince columnas estaban vacías de principio a fin. No lo hemos ejecutado contra ItemInfo, así que los quince nombres de columna son lo que respaldamos y el resto es lo que te enseñará tu primera ejecución del plan gratuito. Empieza gratis: tus primeras 500 filas no cuestan nada y no requieren tarjeta.