Extractor de Eventos de Google: recopilar fichas de eventos a escala
Google mantiene una vertical dedicada a eventos: pregunte qué hay en una ciudad este fin de semana y obtendrá una lista ordenada de resultados en lugar de páginas web corrientes. Para cualquiera cuyo trabajo dependa de saber qué ocurre y dónde -responsables de marketing de eventos eligiendo una fecha, promotores mapeando una región, sitios de destino y editores locales manteniendo al día una página de "qué hacer"-, esa vertical es la vista única del calendario más cómoda que existe. Leerla consulta a consulta en un navegador es el cuello de botella. El Extractor de Eventos de Google lo elimina: envíe hasta 1.000 consultas en una ejecución, fije idioma y país, elija hasta qué profundidad llegar por consulta y llévese los resultados en CSV, JSON o Excel, con los resultados de cada consulta bien diferenciados.
Hay algo que merece decirse directamente en esta página, porque las canalizaciones se construyen sobre suposiciones. La referencia publicada de este endpoint documenta el lado de la solicitud por completo pero no especifica las columnas de resultado, así que la lista de ocho columnas de esta página no viene de ahí: es la fila de cabecera de exportaciones reales de eventos de Livescraper, idéntica en siete ejecuciones distintas. Nada en esta página es una conjetura sobre lo que una fila de evento "debería" contener. El límite de esa evidencia también merece decirse: esas siete exportaciones llegaron con la fila de cabecera y sin filas de datos, así que podemos nombrar cada columna y no podemos enseñarle una con contenido. La recomendación que sigue es concreta y no vaga: ejecute una sola consulta contra las 500 filas gratuitas de única vez y abra el archivo. Un minuto de trabajo y ningún dinero le muestran valores reales en cada una de las ocho columnas, que es mejor base que una tabla de aspecto seguro en una página de marketing.
Lo que la ejecución sí controla está bien definido. La amplitud llega a 1.000 consultas, lo que encaja especialmente bien con la investigación de eventos, ya que la unidad natural es una ciudad, un recinto o un género y casi nunca quiere solo uno. La profundidad son páginas por consulta y está por defecto en una sola página, normalmente la muestra honesta, porque una página es lo que ve de verdad alguien que planifica su sábado. La configuración regional son idioma y país como ajustes independientes, y en esta vertical es el ajuste que más importa: un evento es algo que sucede en un lugar, así que desde dónde busca moldea los resultados más de lo que lo haría con una consulta de texto. El consejo práctico que se deriva es nombrar el lugar también en la consulta, ya que "conciertos de jazz Lisboa" y un escueto "conciertos de jazz" ejecutado desde Portugal no son la misma pregunta.
Los flujos de trabajo típicos adoptan tres formas. Los equipos de programación extraen lo que ya hay en las fechas candidatas y eligen el fin de semana sin un festival o un partido que choque. Los equipos de desarrollo de negocio barren un género por una región y leen los recintos y promotores recurrentes como una lista de socios construida a partir de contrataciones reales. Los equipos de contenido y viajes fijan un conjunto de consultas de ciudad y las reejecutan con una cadencia, tratando la diferencia entre exportaciones como su cola de actualizaciones. Los tres son trabajo de señalización: aprende qué existe y dónde mirar a continuación, que es exactamente para lo que sirve una página de resultados. No se reserva ni se compra nada, no se toca nada detrás de un inicio de sesión y las exportaciones se autoeliminan a los 30 días. Empiece gratis: sus primeras 500 filas no cuestan nada y no necesitan tarjeta de crédito.