Extractor de Reseñas de Google Play - el historial de reseñas de una app en filas estructuradas
Play Store te muestra una media de estrellas y las reseñas que él decide que son más relevantes. Ninguna de las dos sirve de mucho para trabajar: la media aplana una distribución que normalmente es de todo menos plana, y las reseñas que ves son un puñado rotatorio elegido por otro. El Extractor de Reseñas de Google Play devuelve en cambio las reseñas subyacentes como tabla - una fila por reseña, con el texto tal como se escribió, la valoración en estrellas, la fecha, el recuento de votos útiles, la versión de la app que usaba quien reseñó, la respuesta del desarrollador cuando existe y un id estable de la propia reseña. Envía IDs de apps o enlaces de Play Store, hasta 1.000 por ejecución, elige cuántas reseñas por app y cómo ordenarlas, y exporta en CSV, JSON o Excel.
Las diez columnas de esta página están medidas, no supuestas. Son la cabecera de la exportación, idéntica en 11 ejecuciones, y cada cifra citada sale de las 842 filas que esas ejecuciones devolvieron - 559 reseñas distintas de tres apps. Ocho de las diez estaban presentes en cada fila. Dos no, y conviene conocer ambas antes de construir: app_version apareció en 702 de 842 en conjunto, pero su cobertura iba del 90 % en una app al 14 % en otra, y reply apareció en solo 15 filas en total. Un límite de la evidencia debe decirse con claridad: esas ejecuciones cubrieron tres apps, lo que basta para establecer la forma de la salida y cómo se comportan las columnas, y no basta para predecir qué devolverá una app concreta tuya. Para eso está el plan gratuito.
Lo que hace que valga la pena conectar este servicio a algo permanente es el id de reseña. En las 842 filas hubo 559 ids distintos, y ninguna ejecución contuvo un duplicado propio - cada repetición fue entre ejecuciones, exactamente como cabe esperar de extraer la misma app dos veces. Eso convierte al id en una clave de deduplicación fiable: une tus exportaciones, descarta los ids que ya tengas, y tendrás un historial de reseñas que crece en lugar de una carpeta de fotos solapadas. La referencia documenta además un parámetro cutoff que toma una marca de tiempo mínima, así que una extracción recurrente no necesita traer el archivo cada vez. Eso importa más de lo que parece, porque el archivo es profundo - nuestra muestra se remontaba a agosto de 2016.
Otras dos cosas condicionan cómo se lee este dato. La primera es la polarización: las valoraciones de nuestra muestra se repartían en torno al 35 % en una estrella y al 35 % en cinco, con solo un 7 % en cuatro, así que el centro de la escala está casi vacío y cualquier media calculada sobre él no describe casi a nadie. El contenido interesante está en los dos extremos, que es el argumento para leer el texto y no la nota. La segunda es que este es el único extractor de aquí sin columna query - la app enviada vuelve como app_id, así que ese es el campo por el que agrupar cuando envías varias. Ten en cuenta también que los nombres de columna de la exportación son los suyos propios; la referencia de la API describe los mismos datos con nombres distintos para su respuesta en bruto, así que construye contra la cabecera que realmente recibes. Empieza gratis: tus primeras 500 filas no cuestan nada y no necesitan tarjeta.