Extractor de Productos de GlobalIndustrial

Bloqueado a las 03:43.
Bien a las 03:54.

La misma URL, con once minutos de diferencia, rechazada y luego servida. Ese es el hallazgo útil de aquí: el bloqueo es intermitente, así que un reintento vale más que un rodeo. El hallazgo menos cómodo es que la fila que sí obtuvimos no es una fila de producto, y esta página explica por qué antes de que construya nada sobre ella.

4 ejecuciones: 1 correcta, 3 bloqueadasla misma URL rechazada y luego servida 11 minutos despuésla fila correcta es una página de búsqueda, no un productofacturado por filas devueltas - una ejecución bloqueada no factura nada
Cómo funciona

Una lista de URL entra, una hoja de cálculo sale.

  1. PASO 1Inicie sesión en la plataforma.
  2. PASO 2Abra el GlobalIndustrial Products Scraper.
  3. PASO 3Pegue las URL de GlobalIndustrial que quiera, una por línea, y lea la nota de abajo sobre qué formas resuelven realmente a un producto.
  4. PASO 4Elija el formato de salida (CSV / JSON / XLSX).
  5. PASO 5Lance el trabajo.
  6. PASO 6Lea primero la columna status y vuelva a lanzar todo lo que volvió bloqueado.
Lo que realmente encontramos

Todo lo de abajo procede de nuestras propias ejecuciones y comprobaciones.

La misma URL, rechazada y luego servida

Este es el hallazgo que vale la pena. El 3 de julio de 2026 enviamos una URL de producto a las 03:43 y obtuvimos blocked (needs residential proxy); enviamos la URL idéntica a las 03:54 y obtuvimos ok. Once minutos. Nada más cambió. Donde en este catálogo un bloqueo parece permanente, aquí demostrablemente no lo es, y eso convierte el reintento en la respuesta correcta en vez de una fuente sustituta.

Pero la fila correcta no es una fila de producto

Preferimos señalarlo a dejar que pase inadvertido. Esa fila ok llenó cinco campos y dejó diez vacíos: sin identificador, sin marca, sin descripción, sin stock, sin imagen. Su name es el slug de la URL, guiones incluidos, en vez de un título de producto. Una fila que se llama a sí misma como su propia dirección es una fila que no encontró producto, y esta página la trata así.

Porque la URL redirige a una página de búsqueda

Lo comprobamos, y la explicación es limpia. Esa dirección no sirve ninguna página de producto: responde con una redirección permanente a una página de resultados de búsqueda para el mismo slug. El destino es un listado de muchos productos, y por eso la fila tiene un slug por nombre y por eso nueve de sus columnas están vacías. La cifra de su columna de precio aparece en esa página de búsqueda; no está establecido que sea el precio de la máquina que el slug nombra, y no la presentamos como tal.

Y la redirección aterriza en una ruta que el robots.txt excluye

El robots.txt del sitio se leyó sin problemas y no contiene ninguna exclusión general para rastreadores comunes. Pero comprobado con un comparador correcto, la ruta de producto está permitida mientras que la ruta de búsqueda está prohibida, y la URL permitida redirige a la prohibida. El ejemplo de entrada registrado en nuestro propio catálogo de servicios es esa misma URL de búsqueda. Señalamos la discrepancia en lugar de repetir el ejemplo como recomendación.

La columna de estado le da la instrucción

Dos de nuestras cuatro filas volvieron con blocked (intermittent - retry): el servicio diciéndole qué hacer y no solo qué pasó. Combinado con el experimento de once minutos de arriba, el cuadro es coherente: aquí un bloqueo es un momento y no un veredicto. Cuente las filas bloqueadas por ejecución, reinténtelas y concilie sobre status y no sobre el número de filas.

Una ejecución bloqueada no factura

La facturación sigue a las filas realmente devueltas, lo que hace barato aplicar el consejo del reintento: tres de nuestras cuatro ejecuciones no produjeron nada y no habrían costado nada. También es la razón de que esta página no se abra con un botón de registro. Una fila que resultó describir una página de búsqueda no es un resultado que vayamos a vender.

Lo que recupera

Diecisiete columnas, cinco de ellas llenas una vez.

Leídas de una exportación real, en el orden de la hoja. Donde aquí se dice que una columna llevaba un valor, se describe la única fila que devolvió ok, una fila de la que tenemos motivos para desconfiar, por la razón expuesta en la nota de abajo.

query
La URL de GlobalIndustrial que envió, devuelta. Llena en nuestras cuatro filas, incluidas las tres bloqueadas, que es lo que le permite volver a lanzar exactamente las entradas que fallaron.
sku_code
Prevista para la referencia propia de GlobalIndustrial. Vacía en nuestra fila correcta. Su ausencia es parte de por qué leemos esa fila como una página de búsqueda y no como un producto.
product_url
Prevista para la página canónica del producto. Vacía en nuestra fila correcta: la dirección se quedó en url y nada resolvió a un producto.
name
El título del producto. En nuestra fila correcta esto es el slug de la URL, con los guiones intactos, en vez de un título comercial. Trate un valor en minúsculas y con guiones aquí como señal de que la ejecución no llegó a una página de producto.
description
Prevista para el texto del producto. Vacía en nuestra fila correcta.
parsed_price
El precio como número desnudo. Llena en nuestra fila correcta, pero lea la nota de abajo antes de usarlo. La cifra aparece en la página de búsqueda a la que redirige la URL; no está establecido que sea el precio del artículo que el slug nombra.
price
La misma cifra con símbolo de moneda. Llena en nuestra fila correcta, con la misma salvedad.
currency
La moneda en que se expresa el precio. Llena como un valor en dólares estadounidenses en nuestra fila correcta.
availability
Prevista para el estado de disponibilidad. Vacía en nuestra fila correcta.
rating
Prevista para una valoración media. Vacía en nuestra fila correcta.
reviews
Prevista para el número de reseñas. Vacía en nuestra fila correcta.
images
Prevista para las imágenes de la ficha. Vacía en nuestra fila correcta: otra señal de que no se alcanzó ninguna página de producto.
brand
Prevista para el fabricante. Vacía en nuestra fila correcta.
sku
Prevista para un segundo identificador. Vacía en nuestra fila correcta, así que no podemos decirle si este sitio la llena de forma distinta a sku_code.
url
La dirección de la que salió la fila. Llena en las cuatro filas, porque es lo que enviamos.
image
Prevista para la imagen principal por separado. Vacía en nuestra fila correcta.
status
Un indicador por fila que escribe nuestro exportador, no GlobalIndustrial, y la columna más informativa de este servicio. En cuatro ejecuciones tomó tres valores: ok una vez, blocked (needs residential proxy) una vez y blocked (intermittent - retry) dos veces. El último es una instrucción, y el experimento de once minutos de arriba dice que es buena.

Diecisiete columnas por fila · CSV, JSON o Excel

Lo más útil de esta página es una advertencia sobre sus propios datos. Nuestra única fila correcta lleva un nombre que es el slug de la URL, un precio, una moneda y diez columnas vacías. Comprobamos por qué, y la respuesta es que la dirección que enviamos no es una página de producto: responde con una redirección permanente a una página de resultados de búsqueda para el mismo slug. Una página de búsqueda no tiene un único título de producto, y por eso el nombre recayó en el slug, ni un único identificador, descripción, marca, valor de stock o imagen, y por eso esas columnas están vacías. La cifra del precio sí aparece en esa página de búsqueda, pero una página de búsqueda lista muchos productos, así que nada la establece como el precio de la máquina que el slug nombra, y por eso esta página nunca la presenta como tal. Hay una segunda advertencia relacionada: el robots.txt del sitio permite la ruta de producto y prohíbe la de búsqueda, así que la URL que puede pedir redirige a una que se le pide no rastrear. El ejemplo de entrada registrado en nuestro propio catálogo de servicios es esa URL de búsqueda. Envíe URL de producto reales, lea status primero y reintente todo lo bloqueado.

Qué hacer con esto

Dónde deja esto su proyecto.

Reintente, no sustituya

Programe un segundo intento, no un rodeo

El resultado de los once minutos es la conclusión práctica. Aquí un bloqueo es un momento y no un veredicto, así que meta un reintento en la programación y cuente las filas bloqueadas por ejecución. Los reintentos no cuestan nada cuando fallan, porque la facturación sigue a las filas devueltas.

Operaciones · Programación
Compruebe la forma

Envíe URL de producto y revise el nombre

Si un name devuelto parece un slug de URL -en minúsculas, con guiones, coincidiendo con la dirección-, la ejecución no llegó a un producto. Es una comprobación de una línea que merece estar en su importador, y en este servicio habría cazado nuestra propia mejor fila.

Calidad de datos · Ingeniería
Ojo con la redirección

Sepa dónde aterriza realmente su URL

Una dirección que redirige permanentemente a una página de búsqueda devolverá datos de página de búsqueda, y el propio robots.txt del sitio pide a los rastreadores comunes que se mantengan fuera de esa ruta. Resuelva sus URL de entrada antes de encolarlas, no después de leer los resultados.

Cumplimiento · Planificación
Fuentes adyacentes

Ponga precio a la categoría donde sí hay filas detrás

Si la pregunta es cuánto cuestan los suministros industriales y de instalaciones y no cuánto cobra este minorista en concreto, nuestros servicios de Uline, Gemplers y Fastenal cubren ese terreno con las mismas diecisiete columnas, y esas páginas informan de recuentos de relleno reales a partir de ejecuciones reales.

Compras · Sustitución
Precios

Filas devueltas, no intentos hechos.

Nivel gratuito

Las primeras 500 filas son gratis

Por única vez, al registrarse. Sin tarjeta y sin nada que cancelar después.

Por única vez, al registrarse
Tarifa

luego 0,002 $ por fila

Se factura por filas realmente devueltas, que es lo que hace barato el consejo del reintento de esta página: tres de nuestras cuatro ejecuciones no produjeron nada y no habrían costado nada.

Facturado por filas devueltas
Sin suscripción

Nada recurrente

El saldo no caduca en un ciclo mensual, así que una programación construida alrededor de reintentos no consume nada en silencio entre intentos.

Sin caducidad mensual
10 % de descuento en su primera ejecución de pago.Use el código LIVESCRAPER10 al pagar.
Registrarse
Pruebe también estos

Las mismas diecisiete columnas, con filas más llenas.

La parte legal

¿Es legal hacer scraping de GlobalIndustrial?

Los precios y las referencias en una página pública de catálogo son hechos comerciales corrientes. Lo que aquí merece cuidado no es el permiso en general, sino una ruta concreta, y una redirección que la cruza.

Un precio, un nombre de producto y un número de catálogo son hechos sobre mercancía puesta a la venta, leídos de una página que se sirve a cualquier visitante. Nada en las diecisiete columnas describe a una persona: ni nombre, ni correo, ni teléfono, ni cuenta, así que las cuestiones de protección de datos que definen nuestros servicios de datos personales no se plantean aquí.

Dos cosas son específicas de este sitio. Primera, el bloqueo, que es real y demostrablemente intermitente: la misma URL fue rechazada y once minutos después servida, y dos de nuestras filas llevan un estado que literalmente aconseja reintentar. Sacamos el bloqueo a la columna de estado y ahí nos detenemos, en vez de sortearlo, y preferimos que programe un segundo intento a que dé por cerrada la fuente. Segunda, y más delicada: el robots.txt del sitio se leyó sin problemas y no contiene ninguna exclusión general, pero su grupo general prohíbe la ruta de búsqueda mientras permite las rutas de producto, y la URL de producto que enviamos responde con una redirección permanente hacia esa ruta de búsqueda. Una dirección que tiene permiso para pedir puede, por tanto, aterrizar donde se le ha pedido no rastrear. Lo informamos en vez de tratar la redirección como permiso, y sugeriríamos resolver sus URL de entrada antes de encolarlas. El ejemplo de entrada registrado en nuestro propio catálogo de servicios es esa URL de búsqueda, que es exactamente por lo que lo señalamos en vez de repetirlo.

Nuestras propias condiciones son las mismas que en cualquier otro servicio de aquí. Solo páginas de acceso público, nada detrás de un inicio de sesión, ningún rastreador de terceros en la capa de datos, y las exportaciones se eliminan automáticamente a los 30 días. La facturación sigue a las filas devueltas, así que un intento bloqueado no es un cargo.

livescraper.app · lo que devolvieron nuestras ejecuciones
La misma URL: bloqueada a las 03:43, correcta a las 03:54
3 de 4 filas bloqueadas; dos de ellas aconsejan reintentar
La fila correcta es una página de búsqueda, no un producto
robots.txt permite la ruta de producto y prohíbe la de búsqueda
Facturado por filas devueltas - las ejecuciones bloqueadas no costaron nada
Ninguna cifra de nuestra única fila correcta se presenta como el precio del producto que su slug nombra.
Preguntas frecuentes

Lo que se pregunta la gente antes de registrarse.

¿GlobalIndustrial está bloqueado?+
A veces, y podemos ser precisos. De nuestras cuatro ejecuciones, tres volvieron bloqueadas y una volvió ok, y la bloqueada y la correcta enviaron la misma URL, con once minutos de diferencia, el 3 de julio de 2026. Así que el bloqueo es un momento y no un veredicto. Dos de las filas bloqueadas llevan incluso un estado que lee blocked (intermittent - retry).
¿Entonces el servicio funciona?+
Devolvió una fila, pero no una útil, y preferimos decirlo a contarlo como una victoria. La fila correcta llenó cinco campos y dejó diez vacíos, y su name es el slug de la URL en vez de un título de producto. Así se ve una ejecución que no llega a una página de producto.
¿Por qué no llegó a una página de producto?+
Porque la URL no lo es. Lo comprobamos el 12 de agosto de 2026: esa dirección responde con una redirección permanente a una página de resultados de búsqueda para el mismo slug. Una página de búsqueda lista muchos productos, así que no hay un único título, identificador, marca, descripción, valor de stock ni imagen que registrar, que es exactamente la forma de la fila que obtuvimos.
¿Y el precio de esa fila?+
La cifra sí aparece en la página de búsqueda a la que redirige la URL. Pero esa página lista muchos productos, así que nada la establece como el precio del artículo que el slug nombra, y por eso no la imprimimos en ningún lugar de esta página como el precio de ese producto. Trátela como un valor leído de una página de listado y verifíquelo antes de usarlo.
¿Qué URL debería enviar?+
URL de producto reales, y resuélvalas primero. El robots.txt del sitio permite las rutas de producto y prohíbe la de búsqueda, y la URL con forma de producto que usamos redirige a esa ruta de búsqueda. El ejemplo de entrada registrado en nuestro propio catálogo para este servicio es la URL de búsqueda, y por eso lo señalamos en vez de repetirlo.
¿Cómo debería gestionar el bloqueo?+
Reintentando. Cuente las filas bloqueadas por ejecución, vuelva a enviarlas y concilie sobre status y no sobre el número de filas. La facturación sigue a las filas realmente devueltas, así que los intentos que fallan no cuestan nada, que es lo que hace de una programación de reintentos la respuesta barata aquí.
¿La lista de columnas es real?+
Sí. Las diecisiete columnas salen de la fila de cabecera de una exportación auténtica y son idénticas al esquema que usan nuestros servicios de Uline, Gemplers, CDW, Waxie, Otto, Newegg y Decathlon, así que un importador escrito contra cualquiera de ellos lee un archivo de GlobalIndustrial sin cambios.
¿Me costará algo una ejecución bloqueada?+
No. La facturación sigue a las filas realmente devueltas. Tres de nuestras cuatro ejecuciones no produjeron filas utilizables y no habrían costado nada.
¿En qué formatos puedo exportar?+
CSV, JSON o Excel. Las diecisiete columnas y su orden son las mismas en los tres.

Reinténtelo. Y compruebe el nombre.

Aquí el bloqueo es intermitente -la misma URL falló y once minutos después funcionó-, así que un segundo intento vale más que un rodeo. Solo asegúrese de que la URL resuelve a un producto, porque la nuestra no. Una ejecución bloqueada no factura nada.

Facturado por filas devueltas · un intento bloqueado no es un cargo

Hacer scraping de datos de productos de GlobalIndustrial

GlobalIndustrial vende equipamiento industrial, de manipulación de materiales y de instalaciones, y nuestra exportación contiene cuatro ejecuciones: una que tuvo éxito y tres bloqueadas. Lo más útil de ese pequeño conjunto de datos es una coincidencia temporal que resulta no serlo. El 3 de julio de 2026 enviamos una URL con forma de producto a las 03:43 y la ejecución volvió bloqueada, indicando que hacía falta un proxy residencial. Enviamos la URL idéntica a las 03:54 y volvió con éxito. Once minutos, sin que nada más cambiara. Dos de nuestras otras filas llevan un estado que dice, con todas las letras, que el bloqueo es intermitente y que la petición debe reintentarse. En conjunto, el cuadro es coherente y accionable: en este sitio un bloqueo es un momento y no un veredicto, y una programación de reintentos gana a un rodeo.

La mitad menos cómoda de la historia es la propia fila correcta, y preferimos empezar por el problema a enterrarlo. Esa fila llenó cinco de diecisiete campos -la dirección enviada, la dirección otra vez, un precio, una moneda y un nombre- y dejó diez vacíos. No había identificador, ni marca, ni descripción, ni valor de stock, ni imagen. Y el nombre no es un título de producto: es el slug de la URL, en minúsculas y con guiones, idéntico a la cola de la dirección que enviamos. Una fila que se llama a sí misma como su propia URL es una fila que nunca encontró un producto.

Comprobamos por qué, y la explicación es limpia. El 12 de agosto de 2026 esa dirección no servía ninguna página de producto. Respondía con una redirección permanente a una página de resultados de búsqueda para el mismo slug: un listado de muchos productos, medio megabyte de marcado, el término de búsqueda apareciendo decenas de veces. Eso explica todas las rarezas de la fila: una página de búsqueda no tiene un único título, así que el nombre recayó en el slug; no tiene un único identificador, marca, descripción, valor de stock ni imagen, así que esas columnas están vacías. La cifra del precio sí aparece en esa página de búsqueda. Pero una página que lista muchos productos no establece a cuál pertenece una cifra, así que no la reproducimos en ningún lugar de esta página como el precio de la máquina que el slug nombra. Si se lleva una sola cosa de esta página a su propio importador, que sea la comprobación: un name que parece un slug de URL significa que la ejecución no llegó a un producto.

Una cosa más merece decirse en vez de suavizarse. El robots.txt del sitio se leyó sin problemas y no contiene ninguna exclusión general para rastreadores comunes, pero leído con un comparador de grupos correcto permite la ruta de producto y prohíbe la de búsqueda, y la URL con forma de producto que enviamos redirige a esa ruta de búsqueda. Una dirección que tiene permiso para pedir puede, por tanto, aterrizar en una que se le ha pedido no rastrear, lo cual es una buena razón para resolver las URL de entrada antes de encolarlas y no después de leer los resultados. El ejemplo de entrada registrado en nuestro propio catálogo de servicios para este scraper resulta ser esa URL de búsqueda, que es precisamente por lo que señalamos la discrepancia en vez de reproducirla como recomendación. La facturación sigue a las filas realmente devueltas, así que tanto los intentos bloqueados como los reintentos no cuestan nada cuando fallan. Solo páginas de acceso público, ningún rastreador de terceros en la capa de datos, las exportaciones se eliminan automáticamente a los 30 días, y sus primeras 500 filas son gratis sin tarjeta de crédito.