Extractor de Baidu Maps

El mapa de China,
como una tabla de lugares.

Indícale las categorías o marcas que buscas y las ciudades donde mirar, y recibe los lugares como filas: el nombre, la dirección, el teléfono, la etiqueta de categoría, una latitud y una longitud, y el identificador propio de Baidu para el lugar. Nueve columnas, una fila por lugar. Una cosa que conviene saber antes de empezar: Baidu Maps está alojado en China y bloquea las IP de centros de datos fuera de China, así que este scraper necesita un proxy residencial -idealmente con salida en China- para devolver algo.

500 filas gratis, una sola vezdespués 0,002 $ por fila9 columnasCSV · XLSX · JSON
Cómo funciona

Entran categorías y ciudades,
salen lugares.

Dos cajas en lugar de una: qué buscas y dónde. La plataforma las combina, así que cada categoría se busca en cada ubicación.

  1. PASO 1Inicia sesión en la plataforma.
  2. PASO 2Abre el Baidu Maps Scraper.
  3. PASO 3Introduce las categorías o marcas que quieras, una por línea.
  4. PASO 4Introduce las ubicaciones, una por línea, o sube un archivo CSV, XLSX, TXT o Parquet.
  5. PASO 5Fija un límite por consulta, o ponlo a 0 para llevártelo todo.
  6. PASO 6Haz clic en Get Data.

Las dos listas se combinan en un producto cartesiano, así que diez categorías contra veinte ciudades son doscientas búsquedas, no treinta. Lee la nota que hay bajo el diccionario antes de pegar una lista larga en cualquiera de las dos cajas.

Por qué lo usan los equipos

El mapa que hay detrás
del Gran Cortafuegos.

La fuente que de verdad cubre China

Los productos cartográficos occidentales van escasos de fichas de la China continental. En Baidu es donde están esos lugares, lo que lo convierte en el único punto de partida práctico para un conjunto de datos de lugares dentro de China.

Categorías por ciudades, en un solo trabajo

Le das dos listas y recorre la cuadrícula. Un barrido de categorías por veinte ciudades es un trabajo con un archivo de salida, en lugar de veinte trabajos que luego tienes que coser.

Un identificador estable por lugar

Cada fila lleva el identificador propio de Baidu para el lugar. Eso es lo que hace que una segunda ejecución sea comparable con la primera, en vez de un montón nuevo de nombres que emparejar de forma aproximada.

Lo que recibes

Nueve columnas -
y una respuesta franca sobre ellas.

El conjunto de columnas de abajo es firme. Lo que contienen las celdas no es algo que esta página vaya a adivinar, y el motivo merece dos párrafos de tu tiempo.

Los nueve nombres y su orden salen de la fila de cabecera de cinco exportaciones de ejecución distintas, hechas con quince días de diferencia, que coinciden exactamente. Es la prueba más sólida que tenemos para este scraper, y es una fuente en lugar de dos, lo que conviene decir con claridad: a diferencia de la mayoría de páginas de aquí, no hay una lista de columnas publicada con la que contrastarla.

Lo que no tenemos es una exportación con datos. Baidu Maps está alojado en China y bloquea las IP de centros de datos fuera de China, y todas las ejecuciones archivadas aquí se hicieron sin un proxy con salida en China, así que cada una volvió como una fila de cabecera sin nada debajo. Es el comportamiento documentado, no un fallo. Significa que esta página puede decirte para qué sirve cada columna, y no puede decirte qué forma tienen sus valores, así que no encontrarás abajo ni un tipo, ni una unidad, ni un formato, ni un ejemplo. Apunta una ejecución con tu propio proxy a una sola categoría en una sola ciudad y lee el primer archivo que obtengas.

Diccionario de datos

Nueve columnas,
en orden de exportación.

La fila de cabecera de la exportación, en orden. Las descripciones dicen para qué sirve cada campo; deliberadamente no afirman nada sobre su formato, unidades o vocabulario: mira la nota de arriba.

category
La categoría o marca que enviaste, repetida en cada fila que salió de ella. Una mitad del par que produjo la búsqueda.
location
La ubicación que enviaste, repetida en cada fila que salió de ella. La otra mitad del par: junto con category te dice a cuál de tus búsquedas pertenece una fila.
name
El nombre del lugar.
address
La dirección tal como la da la ficha. Llega como un único campo; no hay columnas separadas de ciudad, distrito o código postal por las que agrupar.
phone
El teléfono que consta en la ficha.
tag
La clasificación propia de Baidu para el lugar. Es la etiqueta de la plataforma, no la category que pediste, así que las dos pueden diferir en la misma fila.
latitude
La coordenada norte-sur. Averigua en qué sistema de coordenadas están estos valores antes de representarlos o cruzarlos: mira la nota de abajo.
longitude
La coordenada este-oeste. Se aplica la misma precaución.
uid
El identificador de Baidu para el lugar. Es la columna por la que indexar cuando repitas una búsqueda y quieras saber qué ha cambiado, y el único campo de aquí que se mantiene estable cuando un negocio se cambia el nombre.

Lee esto antes de planificar en torno a la tabla de arriba. Todas las exportaciones de ejecución que tenemos para este scraper volvieron vacías: cada una un libro de cálculo con esta fila de cabecera y ninguna fila de datos debajo. La causa no es un fallo: Baidu Maps está alojado en China y bloquea las IP de centros de datos fuera de China, y una ejecución sin un proxy residencial -idealmente con salida en China- termina y no devuelve absolutamente nada en lugar de lanzar un error. Así que los nueve nombres son sólidos; nada más de aquí lo es. No publicamos tasas de relleno, ni valores de ejemplo, ni formato para ninguna columna. Eso incluye las coordenadas, y son las que van a morder. Los servicios cartográficos no publican todos las posiciones sobre el mismo datum, y soltar dos números sobre un mapa base GPS es una operación de una línea que produce un mapa confiadamente equivocado cuando el datum difiere. Esta página no te va a decir en qué sistema están, porque no hemos visto una celda con datos: contrasta un puñado de direcciones que conozcas con tu propio mapa base en tu primera ejecución real, antes de que nada aguas abajo dependa de la respuesta.

Controles de ejecución

Se ajusta en el trabajo,
no en la hoja de cálculo.

Dos listas de entrada y un límite. Las listas se combinan en un producto cartesiano, así que el límite es por búsqueda y no por ejecución: ese es el número que decide lo que cuesta un trabajo.

Categorías o marcas Ubicaciones Combinadas como producto cartesiano Límite por consulta 0 para todo Subida CSV Subida XLSX Subida TXT Subida Parquet Proxy con salida en China
Flujos de trabajo habituales

Tres tareas que se ejecutan
aquí más que ninguna otra.

Algunos ejemplos de cómo los equipos usan datos de lugares de China para responder a una pregunta que de verdad tienen.

Expansión

Contar la competencia ciudad por ciudad

Una categoría contra una lista de ciudades te da un recuento comparable por mercado en un único archivo. Como las dos mitades del par están en cada fila, la agrupación ya viene hecha: no hay que deducir de qué búsqueda salió cada lugar.

Expansión · Estrategia
Presencia

Cartografiar la red de tiendas de una marca en el continente

La caja de entrada acepta marcas igual de bien que categorías, así que los locales de una cadena en un conjunto de ciudades vuelven como una tabla con un identificador estable por local, que es lo que convierte la siguiente ejecución en una comparación y no en un punto de partida nuevo.

Retail
Cobertura

Cubrir el hueco de China en un conjunto global de lugares

Los conjuntos de datos de lugares construidos con fuentes occidentales se adelgazan mucho dentro de China. Lanzar aquí la misma lista de categorías y añadir el resultado es la forma práctica de cerrar ese hueco, una vez resuelta la cuestión de las coordenadas de arriba.

Ingeniería de datos
Precios

Paga solo por los lugares
que realmente extraes.

Sin suscripción, sin mínimo, sin factura recurrente. Tus primeras 500 filas corren de nuestra cuenta; después pagas por uso, a la misma tarifa plana que cualquier otro scraper de aquí.

Nivel gratuito

500 filas gratis - 0 $

En cada cuenta nueva, una sola vez. Sin tarjeta de crédito. Límites por consulta, subida de archivos y todos los formatos de exportación incluidos.

0 $ para siempre
Pago por uso

0,002 $ por fila tras el nivel gratuito

Unos 2 $ por cada 1.000 lugares. El estimador previo muestra el número de filas y el coste en créditos antes de que arranque una ejecución: aquí merece un segundo vistazo, porque dos listas de entrada se multiplican y dan más búsquedas de las que la gente espera.

El más elegido
Volumen

A medida · gran volumen

Precios por volumen, workers dedicados y un SLA para monitorización continua o descargas históricas muy grandes. Dinos tus cifras y preparamos un presupuesto.

Habla con nosotros
10 % de descuento en tu primera ejecución de pago.Usa el código LIVESCRAPER10 al pagar.
Registrarse
Combina bien con

Un mapa,
y los de al lado.

La parte legal

¿Es legal hacer scraping
de Baidu Maps?

Respuesta corta: las fichas son información pública de negocios, pero este es un servicio chino con datos chinos, y eso cambia por qué reglas deberías preguntar.

Una ficha de Baidu Maps se muestra a cualquiera que ejecute la búsqueda: el nombre, la dirección, el teléfono y la categoría son justo aquello por lo que el lugar se publica para ser encontrado. Recopilar fichas de negocios públicamente visibles para investigación de mercado es una práctica asentada desde hace tiempo, y este scraper no toca ningún inicio de sesión, ninguna cuenta y ningún muro de pago.

Lo que cambia aquí es la jurisdicción. El servicio está alojado en China, los datos describen negocios de China, y los propios términos de Baidu restringen el acceso automatizado, así que esto es tanto una cuestión de términos como legal, y no son los términos a los que está acostumbrada la mayoría de quienes leen este sitio. Si vas a sacar los resultados de China, la transferencia transfronteriza es una cuestión real con sus propias reglas y no un detalle posterior, y conviene planteársela a alguien cualificado antes de que un pipeline dependa de la respuesta. No somos las personas indicadas para dar ese consejo, y este párrafo no lo es.

Por el lado de los datos personales, las filas son fichas de negocio, lo que deja casi todo esto al margen, pero phone sigue siendo un número de contacto, y en un autónomo o una tienda pequeña ese número suele llegar a una persona concreta. Si tu análisis va de cobertura y ubicación y no de contacto, descarta la columna al importar y la cuestión deja de ser tuya. No ejecutamos rastreadores de terceros en la capa de datos y tus exportaciones se borran solas a los 30 días.

livescraper.app · principios
Solo fichas públicas de negocios
Sin inicios de sesión, sin tocar cuentas
La transferencia transfronteriza la resuelves tú
phone puede ser dato personal: descártalo si no lo usas
Las exportaciones se borran solas (30 días)
Revisa los términos propios de Baidu antes de escalar.
Preguntas frecuentes

Lo que pregunta la gente
antes de registrarse.

Las preguntas que más nos hacen. ¿Alguna más? Habla con nosotros: las respuestas las escriben personas, no bots.

¿Cómo hago scraping de Baidu Maps?+
Con el Baidu Maps Scraper:
  1. Inicia sesión en la plataforma.
  2. Abre el Baidu Maps Scraper.
  3. Introduce las categorías o marcas que quieras, una por línea.
  4. Introduce las ubicaciones, una por línea, o sube un archivo CSV, XLSX, TXT o Parquet.
  5. Fija un límite por consulta, o ponlo a 0 para llevártelo todo.
  6. Haz clic en Get Data.
¿Por qué mi ejecución volvió vacía?+
Casi con seguridad, por el proxy. Baidu Maps está alojado en China y bloquea las IP de centros de datos fuera de China, así que sin un proxy residencial -idealmente con salida en China- el trabajo termina con normalidad y no devuelve absolutamente nada. No hay ningún error que leer, y eso es lo que lo hace confuso. Apunta la ejecución a un proxy adecuado y prueba con una categoría en una ciudad antes de hacer nada más grande.
¿Cómo funcionan juntas las dos cajas de entrada?+
Se multiplican. Cada categoría se busca en cada ubicación, así que diez categorías contra veinte ciudades son doscientas búsquedas en lugar de treinta. Eso es útil cuando quieres una cuadrícula y caro cuando no te habías dado cuenta de que habías pedido una, así que consulta el estimador antes de lanzar una ejecución construida a partir de dos listas largas.
¿Qué se recibe de cada lugar?+
Nueve columnas: la categoría y la ubicación que enviaste, el nombre, la dirección, el teléfono, la etiqueta de categoría propia de Baidu, una latitud y una longitud, y el identificador de Baidu para el lugar. Una fila por lugar, y las nueve están en el CSV y el XLSX igual que en el JSON.
¿En qué sistema de coordenadas están la latitud y la longitud?+
No te lo vamos a decir, porque no hemos visto una exportación con datos. Esto importa más que las otras columnas: los servicios cartográficos no publican todos las posiciones sobre el mismo datum, y representar dos números en un mapa base GPS es una operación de una línea que produce un mapa confiadamente equivocado cuando el datum difiere. Contrasta unos cuantos lugares que conozcas con tu propio mapa base en tu primera ejecución real, y resuélvelo ahí antes de que nada aguas abajo dependa de ello.
¿Por qué la columna tag no coincide con la categoría que pedí?+
Porque son cosas distintas. La columna category repite lo que enviaste; la columna tag es la clasificación propia de Baidu para el lugar. Una búsqueda de un término puede devolver lugares que la plataforma archiva bajo algo adyacente, así que las dos difieren legítimamente en la misma fila. Agrupa por aquella de la que trate de verdad tu pregunta.
¿Es legal hacer scraping de Baidu Maps?+
Las fichas son información pública de negocios y esto no lee nada más: sin inicio de sesión, sin cuenta, sin muro de pago. Pero el servicio está alojado en China y los términos de Baidu restringen el acceso automatizado, así que es tanto una cuestión de términos como legal, y sacar los resultados de China plantea reglas de transferencia transfronteriza sobre las que conviene asesorarse bien. Las filas son fichas de negocio y no personas, aunque la columna del teléfono es una excepción que conviene descartar si no la necesitas.
¿Cuánto cuesta?+
Las primeras 500 filas son gratis y de una sola vez, sin tarjeta de crédito. Después son 0,002 $ por fila -unos 2 $ por cada 1.000 lugares-, la misma tarifa plana que cualquier otro scraper de la plataforma. El estimador muestra el coste de una ejecución antes de que arranque, algo que aquí conviene leer porque dos listas de entrada se multiplican.

Tus primeros 500 lugares,
invita la casa.

500 filas gratis de una sola vez en cada cuenta nueva, sin fecha de caducidad. Después, 0,002 $ por fila y pago por uso: sin tarjeta guardada hasta que tú lo digas.

Activo al instante · sin tarjeta

Hacer scraping de datos de lugares de Baidu Maps a escala

El Baidu Maps Scraper de Livescraper convierte búsquedas de mapa en datos de lugares. Le das dos listas -las categorías o marcas que buscas y las ubicaciones donde mirar- y la plataforma las combina, buscando cada categoría en cada ubicación. Las ubicaciones se pueden escribir una por línea o subir como archivo CSV, XLSX, TXT o Parquet. Limita las filas por búsqueda y descarga los resultados como un CSV, un Excel o un JSON limpios.

Cada fila lleva nueve columnas: la categoría y la ubicación que enviaste, el nombre del lugar, la dirección, el teléfono, la etiqueta de categoría propia de Baidu, una latitud y una longitud, y el identificador de Baidu para el lugar. Esa última columna es la que convierte una ejecución repetida en una comparación y no en un punto de partida nuevo, porque sobrevive a que un negocio se cambie el nombre.

Los equipos de expansión lanzan una categoría contra una lista de ciudades para obtener un recuento comparable por mercado en un único archivo. Los equipos de retail ponen una marca en la misma caja para cartografiar los locales de una cadena en el continente. Los ingenieros de datos lo usan para cerrar el hueco de China en un conjunto de lugares montado con fuentes occidentales, donde la cobertura continental se adelgaza mucho.

Hay dos cosas que conviene saber antes de construir sobre esto. Este scraper necesita un proxy residencial, idealmente con salida en China: Baidu Maps está alojado en China y bloquea las IP de centros de datos fuera de China, y sin uno una ejecución termina y no devuelve absolutamente nada en lugar de lanzar un error. Y como todas las exportaciones archivadas aquí volvieron como una fila de cabecera sin datos debajo, esta página nombra las nueve columnas y dice para qué sirve cada una sin afirmar un tipo, una unidad o un formato para ninguna, incluidas las coordenadas, cuyo datum deberías establecer con tu propia primera ejecución antes de cruzarlas con datos GPS. Empieza gratis: tus primeras 500 filas no cuestan nada y no requieren tarjeta de crédito, y después es una tarifa plana de 0,002 $ por fila.