Extractor de Productos de BiggestBook

Un catálogo de oficina que
se renderiza en JavaScript.

BiggestBook es el catálogo online de Essendant para sus clientes distribuidores: material de oficina, mobiliario, tecnología, sala de descanso y limpieza. Pídelo con un cliente HTTP normal y obtienes un armazón de aplicación de 6,9 KB sin un solo producto dentro. Este servicio carga la página como lo hace un navegador y devuelve diecisiete columnas por producto.

500 filas gratis por única vezdespués 0,002 $ por filadiecisiete columnas por productoCSV · JSON · Excel
Cómo funciona

Una lista de URLs entra, una hoja de cálculo sale.

  1. PASO 1Inicia sesión en la plataforma.
  2. PASO 2Abre el BiggestBook Products Scraper.
  3. PASO 3Pega las URLs de producto de BiggestBook que quieras, una por línea.
  4. PASO 4Elige tu formato de salida (CSV / JSON / XLSX).
  5. PASO 5Lanza el trabajo.
  6. PASO 6Descarga los resultados: una fila por URL, diecisiete columnas.
Por qué este catálogo es incómodo

Lo que lo hace difícil de leer.

La página es una aplicación, no un documento

Pide https://www.biggestbook.com con curl y obtienes HTTP 200 y unos 6,9 KB: un armazón Angular con <base href="/ui">, el título «Biggestbook Web» y ni una sola aparición de un precio, un SKU o un botón de añadir al carrito. El catálogo llega después, desde JavaScript. Cualquier cosa construida sobre una librería HTTP y un analizador de HTML lee ese armazón y concluye que la página está vacía.

Diecisiete columnas, y algunas van en pareja

La exportación lleva price y parsed_price, sku y sku_code, image e images, url y product_url. No es redundancia porque sí: una de cada pareja es para leer y otra para calcular, y saber cuál es cuál antes de escribir el importador ahorra una reescritura.

Un catálogo de distribuidor, no una tienda

BiggestBook existe para servir a distribuidores y no a compradores finales, así que los campos que importan son los que necesita un sistema de compras -identificador, marca, disponibilidad, moneda- y no los que usa una página de marketing. El esquema lo refleja: dos columnas de identificador, y valoración y reseñas presentes pero nunca dadas por hechas.

La misma forma que el resto de la familia de suministro

Livescraper usa este esquema en una serie de fuentes B2B y de suministro: CDW, AutoZone, Brady, Decathlon y otras. Los diecisiete nombres y su orden son idénticos, así que un solo importador las lee todas y añadir una segunda fuente es un cambio de configuración, no un proyecto.

Cada fila dice si funcionó

La última columna es status, escrita por nuestro exportador y no por el sitio. Una fila que no se pudo recuperar llega igualmente, con el motivo. Concilias contra la lista de entrada en vez de descubrir un hueco silencioso tres semanas después.

Decimos lo que no hemos medido

Las dos ejecuciones que hay detrás de esta página enviaron una URL de marcador que devolvió un 404, así que no tenemos ningún dato de producto de BiggestBook. La lista de columnas de abajo es real: es la cabecera de esas exportaciones. Los valores no se describen, porque no hemos visto ninguno.

Lo que recibes

Diecisiete columnas, por producto.

Leídas de la cabecera de una exportación real de este servicio, en el orden de la hoja. Las dos ejecuciones que tenemos no devolvieron datos bajo esa cabecera -mira la nota debajo de la tabla-, así que cada entrada dice para qué sirve la columna y ahí se detiene.

query
La URL de BiggestBook que enviaste, repetida en cada fila para que una exportación con muchos productos siga siendo separable. Consérvala: es el único registro de a qué entrada responde el resto de la fila.
sku_code
El código de artículo tal como lo imprime el catálogo. Emparejado con sku más abajo: revisa los dos antes de elegir una clave de cruce, porque en esta familia de esquemas se rellenan de forma independiente.
product_url
La página de producto canónica. Distinta de url, que indica la dirección desde la que se produjo realmente la fila; las dos difieren siempre que un enlace enviado redirige.
name
El título del producto tal como aparece en la página.
description
El texto de la descripción. Espera un campo de texto libre largo y no una etiqueta corta, y dale una columna ancha o un tipo texto en tu base de datos.
parsed_price
El precio como número puro, sin símbolo ni separador de miles: el que usar para aritmética, ordenación y umbrales.
price
El precio tal como se muestra. Úsalo cuando necesites enseñar a un cliente exactamente lo que decía el catálogo; usa parsed_price cuando necesites calcular.
currency
La moneda en la que se indica el precio. Léela siempre en vez de suponerla: un catálogo de distribuidor puede servir una moneda distinta a otra cuenta o región.
availability
El estado de stock tal como se publica en la página. Trátalo como la afirmación del catálogo en el momento del scraping, no como un feed de inventario en vivo.
rating
La valoración media, cuando la página publica una. Un catálogo de distribuidor a menudo no lo hace, así que escribe el importador para que acepte una celda vacía en vez de fallar.
reviews
El número de reseñas, con la misma advertencia que rating. Donde las dos están presentes van juntas; una valoración sin recuento detrás no sirve para ordenar.
images
Todas las imágenes que lleva la página, en un solo campo. Sepáralo antes de guardar si necesitas una fila por recurso.
brand
El fabricante o la marca. Este es el campo por el que agrupar para trabajo de surtido: qué fabricantes lista un distribuidor y con qué profundidad cada línea.
sku
La referencia de artículo. La otra mitad de la pareja de identificadores con sku_code.
url
La dirección desde la que se produjo la fila. Compárala con query para detectar redirecciones y con product_url para detectar canonicalización.
image
La imagen principal por separado, para que el caso habitual -una miniatura por producto- no requiera partir cadenas.
status
Un indicador por fila escrito por nuestro exportador, no por BiggestBook. Informa de si la fila se recuperó. Las dos ejecuciones que hay detrás de esta página llevan aquí http 404, porque la URL enviada era un marcador que no existe.

Diecisiete columnas por fila · CSV, JSON o Excel

Detrás de esta página hay dos ejecuciones, del 14 y el 15 de julio de 2026, y sus cargas son idénticas byte a byte. Las dos enviaron https://www.example.com/product/123 -un marcador, no una dirección de BiggestBook- y las dos devolvieron una sola fila con http 404 y las catorce columnas de datos vacías. Así que podemos contarte el esquema con seguridad y no podemos contarte nada de los valores de BiggestBook, y esta página no finge lo contrario. Los diecisiete nombres aparecen en el mismo orden en nuestras exportaciones de CDW, AutoZone, Brady y Decathlon, y la de Decathlon está rellena en 66 filas, que es como sabemos que el esquema está vivo y no es un esbozo.

Flujos de trabajo habituales

Para qué sirve un catálogo de distribuidor.

Seguimiento de precios

Vigilar una línea, no un producto

Envía las URLs de los artículos que te importan de forma programada y guarda parsed_price, currency y la fecha de ejecución. El valor no está en ninguna cifra suelta sino en la serie: cuando un fabricante se mueve, suele mover una línea entera de golpe, y una tabla lo enseña donde una pestaña del navegador no.

Compras · Seguimiento de precios
Análisis de surtido

Ver qué marcas lleva realmente un distribuidor

Agrupa la exportación por brand y cuenta. La profundidad por fabricante te dice dónde se ha comprometido un distribuidor y dónde solo está probando: la misma pregunta que se hace un comprador antes de añadir un proveedor, respondida desde el propio catálogo.

Compras de categoría · Surtido
Enriquecimiento de catálogo

Rellenar los campos que faltan en tus registros

Las bases de datos de producto de los distribuidores suelen ser fuertes en identificadores y flojas en textos e imágenes. description, image e images cubren ese hueco contra un sku que ya tienes, sin volver a fotografiar nada.

Ops de ecommerce · Catálogo
Comprobación de disponibilidad

Saberlo antes de presupuestar

Lee availability en las líneas de un presupuesto antes de enviarlo. Es el estado publicado del catálogo y no un feed en vivo, así que trátalo como un sistema de aviso: suficiente para pillar la línea que lleva un mes agotada.

Ventas · Presupuestos
Precios

Paga solo por lo que realmente usas.

Plan gratuito

Las primeras 500 filas son gratis

Por única vez, al registrarte. Sin tarjeta y sin nada que cancelar después.

Por única vez, al registrarte
Tarifa

después 0,002 $ por fila

Se factura por filas realmente devueltas. Una fila que vuelve con un status distinto de uno correcto no es una fila de datos de producto, y no se te cobra como tal.

Facturado por filas devueltas
Sin suscripción

Nada recurrente

Los créditos no caducan en un ciclo mensual. Lanza un barrido de catálogo en marzo y nada más hasta septiembre si el trabajo tiene esa forma.

Sin caducidad mensual
10 % de descuento en tu primera ejecución de pago.Usa el código LIVESCRAPER10 al pagar.
Registrarse
Combina bien con

Otros catálogos, las mismas diecisiete columnas.

La parte legal

¿Es legal hacer scraping de BiggestBook?

Los hechos de producto en una página de acceso público son información competitiva corriente. Las advertencias que merece la pena señalar van sobre el acceso y la reutilización, no sobre los datos en sí.

Un precio, un nombre de producto, una marca y un estado de stock son hechos sobre bienes puestos a la venta. Leerlos de una página que se sirve a cualquier visitante es la misma actividad que un comprador hace a mano, a una velocidad útil. Nada en las diecisiete columnas describe a una persona: no hay nombre, ni correo, ni teléfono, ni cuenta, así que las cuestiones de protección de datos que marcan nuestros servicios sobre personas no se plantean aquí.

Dos advertencias merecen decirse con claridad. Primero, el acceso: BiggestBook está hecho para los distribuidores de Essendant, y partes de un catálogo de distribuidor -los precios por cuenta sobre todo- están detrás de un inicio de sesión. No iniciamos sesión, no usamos las credenciales de nadie y no saltamos ningún muro de pago, así que lo que este servicio alcanza es lo que alcanza un visitante anónimo. Si la cifra que necesitas solo aparece cuando estás dentro como un distribuidor concreto, esto no la producirá. Segundo, la reutilización: las descripciones y la fotografía de producto son material protegido de alguien. Usarlas internamente para seguimiento de precios, análisis de surtido o conciliación con tus propios registros es práctica corriente; republicarlas como catálogo propio es otra pregunta con otra respuesta.

Nuestras condiciones son las mismas que en cualquier otro servicio de aquí. Solo páginas de acceso público, nada detrás de un inicio de sesión, sin rastreadores de terceros en la capa de datos, y las exportaciones se eliminan automáticamente a los 30 días. Tus primeras 500 filas son gratis y no necesitan tarjeta.

livescraper.app · qué condiciona una ejecución
Una URL de producto por fila
La página se renderiza, no solo se descarga
Solo acceso anónimo
Los precios por cuenta quedan tras el inicio de sesión!
Las exportaciones se eliminan a los 30 días
Un catálogo de distribuidor enseña a un distribuidor identificado cifras distintas de las que ve un visitante anónimo. Este servicio es el visitante anónimo.
Preguntas frecuentes

Lo que la gente pregunta antes de registrarse.

¿Qué columnas contendrá la exportación?+
Diecisiete, en este orden: query, sku_code, product_url, name, description, parsed_price, price, currency, availability, rating, reviews, images, brand, sku, url, image y status. Una fila por URL de producto que envíes.
¿Hay datos de ejemplo de BiggestBook en esta página?+
No, y no vamos a inventarlos. Las dos ejecuciones que hay detrás enviaron una URL de marcador que devolvió http 404, así que todas las columnas de datos volvieron vacías. Eso basta para establecer los diecisiete nombres de columna y nada más, por eso esta página describe para qué sirve cada columna y nunca cómo son sus valores.
¿Por qué BiggestBook necesita más que una simple petición HTTP?+
Porque el catálogo es una aplicación JavaScript. Pedir https://www.biggestbook.com con un cliente normal devuelve HTTP 200 y unos 6,9 KB: un armazón de aplicación titulado «Biggestbook Web» con <base href="/ui"> y sin marcado de precio, SKU ni carrito por ninguna parte. Los productos se piden y se renderizan después, así que un scraper basado solo en un analizador de HTML ve una página vacía.
¿Podéis conseguir los precios por cuenta que muestra mi login de distribuidor?+
No. No iniciamos sesión, no usamos las credenciales de nadie y no saltamos muros de pago, así que este servicio ve lo que ve un visitante anónimo. Si una cifra solo aparece cuando estás dentro como un distribuidor concreto, queda fuera de alcance.
¿Por qué hay dos columnas de precio y dos de identificador?+
Una de cada pareja es para leer y otra para calcular. price es el precio tal como se muestra y parsed_price la misma cifra como número puro; sku y sku_code se rellenan de forma independiente en esta familia de esquemas, así que revisa los dos antes de elegir clave de cruce. Lo mismo aplica a image e images, y a url y product_url.
¿Qué significa la columna status?+
La escribe nuestro exportador, no BiggestBook, e informa de si esa fila se recuperó. Una fila fallida llega igualmente con el motivo, así que puedes conciliar la exportación con tu lista de entrada en vez de descubrir un hueco silencioso después. Las dos ejecuciones que hay detrás de esta página leen ahí http 404.
¿Cuánto cuesta?+
Tus primeras 500 filas son gratis, por única vez y sin tarjeta. Después son 0,002 $ por fila, facturadas por filas realmente devueltas, sin suscripción y sin caducidad mensual de créditos.
¿En qué formatos puedo exportar?+
CSV, JSON o Excel. Las diecisiete columnas y su orden son los mismos en los tres.

Lee el catálogo como una tabla.

Diecisiete columnas por producto, de una página que no las entrega a una petición HTTP normal. Tus primeras 500 filas son gratis, después 0,002 $ cada una.

Se activa al instante · sin tarjeta

Hacer scraping de datos de producto de BiggestBook

BiggestBook es el catálogo online que Essendant opera para sus clientes distribuidores, con material de oficina, mobiliario, informática y tecnología, sala de descanso y limpieza. Es un catálogo de distribuidor y no una tienda para consumidores, y por eso sus campos útiles se inclinan hacia lo que necesita un sistema de compras -identificador, marca, moneda, disponibilidad- y no hacia lo que usa una página de marketing.

El obstáculo práctico es cómo está construido el sitio. Una petición a https://www.biggestbook.com desde un cliente HTTP normal devuelve una respuesta correcta de unos 6,9 KB que contiene un armazón de aplicación Angular -<base href="/ui">, el título «Biggestbook Web», una hoja de estilos- y ningún marcado de producto: ni precio, ni SKU, ni botón de carrito. El catálogo lo pide y lo renderiza JavaScript después de que carga ese armazón. Cualquier cosa construida sobre una librería HTTP y un analizador de HTML leerá por tanto una página válida y no encontrará nada dentro, que es el motivo más común de que un scraper casero de BiggestBook parezca funcionar y devuelva filas vacías. Este servicio carga la página como lo hace un navegador, así que los productos están presentes cuando se lee algo.

La exportación son diecisiete columnas por URL de producto: query, sku_code, product_url, name, description, parsed_price, price, currency, availability, rating, reviews, images, brand, sku, url, image y status. Cuatro de ellas son parejas -precio como se muestra frente a precio como número, dos campos de identificador, imagen principal frente a todas las imágenes, URL pedida frente a URL canónica- y saber qué mitad usar antes de escribir el importador es la diferencia entre una carga limpia y una reescritura. Los mismos diecisiete nombres en el mismo orden son los que llevan nuestras exportaciones de CDW, AutoZone, Brady y Decathlon, así que un solo importador sirve a toda la familia B2B y de suministro.

Estamos siendo deliberadamente claros sobre los límites de lo que podemos enseñar. Las dos ejecuciones que hay detrás de esta página, del 14 y el 15 de julio de 2026, enviaron una dirección de marcador en vez de una de BiggestBook, y las dos volvieron con un 404 y todas las columnas de datos vacías. Eso establece el esquema -una cabecera es una cabecera real aunque no haya datos debajo- y no establece nada sobre los valores de BiggestBook, así que no encontrarás precios de ejemplo, recuentos de productos ni valoraciones en ninguna parte de esta página. El acceso también tiene un límite real: partes de un catálogo de distribuidor, los precios por cuenta en particular, están detrás de un inicio de sesión de distribuidor, y este servicio no inicia sesión, así que lo que alcanza es lo que alcanza un visitante anónimo. Solo páginas de acceso público, sin rastreadores de terceros en la capa de datos, y las exportaciones se eliminan automáticamente a los 30 días. Tus primeras 500 filas son gratis y no necesitan tarjeta.