Extrator de Avaliações do Google Play - o histórico de avaliações de um app em linhas estruturadas
A Play Store mostra uma média de estrelas e as avaliações que ela decide serem mais relevantes. Nenhuma das duas serve muito para trabalhar: a média achata uma distribuição que costuma ser tudo menos plana, e as avaliações que você vê são um punhado rotativo escolhido por outra pessoa. O Extrator de Avaliações do Google Play devolve em vez disso as avaliações subjacentes como tabela - uma linha por avaliação, carregando o texto como foi escrito, a nota em estrelas, a data, a contagem de votos úteis, a versão do app que a pessoa usava, a resposta do desenvolvedor quando existe, e um id estável da própria avaliação. Envie IDs de apps ou links da Play Store, até 1.000 por execução, escolha quantas avaliações por app e como ordená-las, e exporte em CSV, JSON ou Excel.
As dez colunas desta página são medidas, não presumidas. São o cabeçalho da exportação, idêntico em 11 execuções, e cada número citado vem das 842 linhas que essas execuções devolveram - 559 avaliações distintas de três apps. Oito das dez estavam presentes em cada linha. Duas não estavam, e vale conhecer ambas antes de construir: app_version apareceu em 702 de 842 no total, mas a cobertura ia de 90% num app a 14% em outro, e reply apareceu em apenas 15 linhas ao todo. Um limite da evidência deve ser dito com clareza: essas execuções cobriram três apps, o que basta para estabelecer o formato da saída e como as colunas se comportam, e não basta para prever o que um app específico seu vai devolver. O plano gratuito existe para isso.
O que faz este serviço valer a pena conectar a algo permanente é o id da avaliação. Nas 842 linhas havia 559 ids distintos, e nenhuma execução continha uma duplicata sua - toda repetição foi entre execuções, exatamente como se espera de extrair o mesmo app duas vezes. Isso torna o id uma chave de deduplicação confiável: una suas exportações, descarte os ids que já tem, e você terá um histórico de avaliações que cresce em vez de uma pasta de retratos sobrepostos. A referência documenta também um parâmetro cutoff que recebe um carimbo de tempo mais antigo, então uma extração recorrente não precisa buscar o arquivo toda vez. Isso importa mais do que parece, porque o arquivo é profundo - nossa amostra chegava a agosto de 2016.
Outras duas coisas moldam como esses dados se leem. A primeira é a polarização: as notas da nossa amostra se dividiam em cerca de 35% em uma estrela e 35% em cinco, com apenas 7% em quatro, então o meio da escala está quase vazio e qualquer média calculada sobre ele não descreve quase ninguém. O conteúdo interessante está nas duas pontas, que é o argumento para ler o texto e não a nota. A segunda é que este é o único extrator aqui sem coluna query - o app enviado volta como app_id, então é esse o campo pelo qual agrupar quando você envia vários. Note também que os nomes de coluna da exportação são dela própria; a referência da API descreve os mesmos dados com nomes diferentes para a resposta bruta, então construa contra o cabeçalho que você de fato recebe. Comece grátis: suas primeiras 500 linhas não custam nada e não precisam de cartão.