Extrator de Vagas do Glassdoor

Uma busca no Glassdoor,
como linhas ordenadas.

Cole uma busca de vagas do Glassdoor e receba os resultados como tabela - o cargo, a empresa, a localização, o salário anunciado, o link da vaga e um trecho da descrição, com cada linha marcada com a posição que ocupou nos resultados.

500 linhas grátis, uma única vezdepois US$ 0,002 por linhauma linha por resultado, com a posiçãoCSV · JSON · Excel
Leia isto primeiro

Nesta página estamos sendo
incomumente cautelosos.

A maioria das páginas daqui cita taxas de preenchimento vindas de milhares de linhas e muitas entradas. Esta não pode, e fingir o contrário seria o jeito mais fácil de enganar você.

Nossa evidência é uma execução com dados de 100 linhas vinda de uma única busca no Glassdoor. Outras cinco execuções não devolveram nada. Os doze nomes de coluna são sólidos - o cabeçalho da planilha e as chaves do JSON coincidem exatamente e são idênticos nas seis execuções - mas qualquer afirmação sobre com que frequência uma coluna é preenchida descreve aquela busca, não o serviço.

Essa distinção pesa mais do que parece. Duas colunas foram perfeitamente constantes nos nossos dados: company_rating estava vazia em todas as linhas, e easy_apply dizia Yes em todas. Qualquer uma das duas pode ser uma propriedade do serviço, ou simplesmente uma propriedade da busca que por acaso rodamos. Com uma única consulta não dá para distinguir, então não afirmamos nenhuma das duas.

Também não existe referência publicada para este endpoint - o Glassdoor não aparece em lugar nenhum da documentação da API. Por isso, ao contrário dos outros extratores deste site, esta página não cita nenhum limite de lote, nenhuma configuração de idioma ou região e nenhuma ordenação, porque não há fonte para nada disso. O que segue é o que vimos, e nada mais.

livescraper.app · o que podemos e não podemos dizer
Nomes de coluna: verificados contra linhas reais
Estrutura dos resultados: verificada
Taxas de preenchimento: apenas uma busca!
Colunas constantes: causa desconhecida!
Não existe referência publicada!
O plano gratuito é como você confere a sua própria busca.
Como funciona

Uma URL de busca entra,
os resultados dela saem.

O que rodamos foi uma URL de busca de vagas do Glassdoor, e os resultados voltaram como linhas.

  1. PASSO 1Faça login na plataforma.
  2. PASSO 2Abra o Extrator de Vagas do Glassdoor.
  3. PASSO 3Cole uma URL de busca de vagas do Glassdoor - cargo, localização e filtros já aplicados.
  4. PASSO 4Escolha o formato e clique em Get Data.
  5. PASSO 5Confira a primeira exportação antes de escalar - veja a ressalva acima.

Monte a busca primeiro no Glassdoor, com os filtros que quiser, e então envie essa URL. Os filtros definidos lá são o que molda o conjunto de resultados.

Dicionário de dados

Doze colunas,
de uma exportação real.

Os nomes são o cabeçalho da exportação, coincidindo exatamente com as chaves do JSON e idênticos nas seis execuções. Os números ao lado vêm da nossa única execução com dados, de 100 linhas - trate-os como uma observação, não como uma taxa.

query
A URL de busca do Glassdoor que você enviou, devolvida em cada linha. Um único valor em toda a nossa execução, porque enviamos uma busca.
job_title
O cargo anunciado. Nas 100 linhas nossas, com 52 títulos distintos.
company
A empresa contratante. Nas 100, com 31 nomes distintos.
company_rating
A nota do empregador no Glassdoor. Vazia nas 100 linhas nossas. Não sabemos se ela nunca preenche ou se simplesmente não preencheu para esta busca - veja a nota abaixo.
location
Onde a vaga fica. Nas 100, com 13 valores distintos, todos dentro da área que nossa busca cobria.
salary
A faixa anunciada, com a fonte acrescentada - $120K - $170K (Employer provided). Nas 100 linhas nossas, mas veja a nota abaixo antes de supor que isso vale em geral.
date_posted
Há quanto tempo a vaga está no ar, como string relativa do tipo 30d+, 24h ou 13d. Nunca uma data de verdade. Em 71 das nossas 100.
easy_apply
Se a vaga aceita candidatura em um clique. Dizia Yes nas 100 linhas nossas - o que, vindo de uma única busca, diz menos do que parece.
job_url
Um link para a vaga. Nas 100 linhas, mas só 53 deles distintos.
snippet
Um trecho da descrição da vaga, não o texto completo. Nas 100.
logo
O logotipo da empresa. Em 88 das nossas 100.
position
A posição que a vaga ocupou nos resultados. Um número inteiro de 1 a 100, e os 100 eram distintos - ou seja, é a ordenação, não um identificador.

Os nomes estão verificados; os números são uma busca. O cabeçalho da planilha coincide exatamente com as chaves do JSON e é o mesmo nas seis execuções, então as doze colunas são reais. Todo o resto desta página veio de uma única exportação de 100 linhas, e o plano gratuito é o jeito honesto de descobrir como a sua própria busca se comporta antes de construir em cima.

Antes de construir

Quatro coisas que aquela
única exportação mostrou.

Duas valem para qualquer busca. Duas são avisos contra ler demais numa única execução - inclusive na nossa.

A mesma vaga aparece em várias posições

Nossas 100 linhas continham apenas 53 valores distintos de job_url. Vinte e sete links apareceram mais de uma vez, um deles quatro vezes, cada um numa position diferente. Então contagem de linhas não é contagem de vagas. Deduplique por job_url antes de informar quantas vagas uma busca encontrou, ou você vai exagerar em cerca da metade.

date_posted é uma idade, não uma data

Os valores que vimos foram 24h, 3d, 13d, 30d+ e semelhantes - uma idade relativa no momento da execução, não um carimbo de tempo. Não dá para fazer parse como data, não dá para ordenar de forma significativa contra outra execução, e 30d+ é um balde aberto em vez de um valor. Se você precisa de datas reais, registre você mesmo a data da execução e derive.

salary diz de onde o número veio

Todo salário na nossa exportação terminava com a procedência: 96 de 100 diziam (Employer provided) e o resto (Glassdoor est.). Essa distinção importa - um é o que o empregador escreveu, o outro é o palpite de um modelo - e está dentro da mesma string que a faixa, então extraia em vez de descartar. Se o salário é tão bem preenchido em outras buscas, com uma só não dá para dizer.

Duas colunas foram constantes - e não sabemos por quê

company_rating estava vazia em todas as linhas e easy_apply dizia Yes em todas. Uma busca filtrada para candidaturas em um clique produziria exatamente esse segundo padrão, e uma coluna que sempre diz Yes também. Uma consulta não separa as duas. Confira ambas na sua própria primeira exportação em vez de tomar a nossa como regra - é exatamente para isso que existe o plano gratuito.

Fluxos de trabalho comuns

Três tarefas que as pessoas
mais executam aqui.

Para que serve uma busca ordenada e exportável.

Benchmark salarial

Ler a faixa anunciada, e a fonte dela

Como salary carrega a procedência na mesma string, dá para separar o que os empregadores realmente publicaram do que o Glassdoor estimou. Um benchmark montado só com números informados pelo empregador é um número muito diferente - e bem mais defensável - do que um que mistura saída de modelo.

People ops · Remuneração
Visibilidade na busca

Ver onde uma vaga ranqueia, não só que ela existe

A coluna position registra a ordem em que os resultados voltaram. Para quem anuncia uma vaga, essa é a diferença entre estar no site e ser visto nele - e reexecutar a mesma URL de busca transforma isso num movimento que você pode acompanhar.

Recrutamento · Marketing
Mapeamento de mercado

Transformar uma busca numa lista de empresas

Nossa única busca de 100 linhas cobria 31 empresas distintas contratando para um cargo numa cidade. Deduplicada por empregador, é uma lista pronta de quem está ativo num mercado agora - um ponto de partida melhor que um diretório que pode ter anos.

Estratégia · BD
Preços

Pague só pelas linhas
que você realmente extrai.

Sem assinatura, sem mínimo, sem licença por usuário. Suas primeiras 500 linhas são por nossa conta - depois, pague conforme o uso.

Plano gratuito

500 linhas grátis - US$ 0

Para cada conta nova, uma única vez. Sem cartão de crédito. Todos os extratores liberados. Neste serviço em particular as linhas grátis são o ponto: uma busca sua diz o que a nossa única exportação não conseguiu.

US$ 0 para sempre
Pague conforme o uso

US$ 0,002 por linha, após o plano gratuito

Cerca de US$ 2 por 1.000 linhas. Vale lembrar que linhas são resultados e não vagas distintas - as nossas eram cerca de metade duplicatas - então orce pela contagem de resultados que você vê, não pelo número de vagas que espera.

Mais popular
Enterprise

Sob medida · acompanhamento agendado

Preços por volume, SLAs, workers dedicados e onboarding sob medida para times que acompanham contratações em muitas buscas e mercados. Diga-nos seus números e faremos um orçamento.

Fale conosco
10% de desconto na sua primeira execução paga.Use o código LIVESCRAPER10 no checkout.
Cadastre-se
Combina bem com

Um site nunca é
o mercado inteiro.

O Glassdoor é um dos vários lugares onde uma vaga é anunciada, e a sobreposição raramente é completa.

A parte legal

É legal coletar
anúncios de vagas?

Resposta curta: sim. São anúncios, publicados para serem encontrados pelo maior número possível de pessoas.

Uma página de busca de vagas é pública. Qualquer um pode navegar nela sem conta, e coletar anúncios publicamente visíveis para pesquisa é prática estabelecida há muito tempo. Desde que os dados estejam disponíveis publicamente e o processo não perturbe o site, não há leis federais que o proíbam.

Anúncios de vagas se encaixam bem aqui. O objeto de um anúncio é um cargo numa empresa, não uma pessoa nomeada - nada nestas doze colunas descreve um indivíduo. Não há login, não há paywall, e nenhuma candidatura é enviada em seu nome.

Os termos do Glassdoor restringem o acesso automatizado, então isto continua sendo uma questão de termos. Não tocamos em nada atrás de um login, não rodamos rastreadores de terceiros na camada de dados, e suas exportações se apagam sozinhas depois de 30 dias.

livescraper.app · princípios
Apenas páginas de busca públicas
Nenhum dado pessoal em nenhuma coluna
Nenhuma candidatura enviada, ninguém contatado
Alinhado ao GDPR por padrão
Exportações se apagam sozinhas (30 dias)
Anúncios são publicados para serem encontrados.
Perguntas frequentes

O que as pessoas perguntam
antes de se cadastrar.

As perguntas que mais ouvimos. Mais alguma coisa? Fale conosco - quem escreve as respostas são humanos, não bots.

Quais colunas a exportação vai conter?+
Doze: query, job_title, company, company_rating, location, salary, date_posted, easy_apply, job_url, snippet, logo e position. Esses nomes são sólidos - o cabeçalho da planilha coincide exatamente com as chaves do JSON e é idêntico nas seis execuções nossas. Com que frequência cada uma é preenchida é outra questão, e só podemos responder para a única busca que rodamos.
Em quantos dados esta página se baseia?+
Em menos do que a maioria das páginas daqui, e preferimos dizer. Uma execução com dados de 100 linhas vinda de uma única busca no Glassdoor; outras cinco execuções não devolveram nada. Isso basta para confirmar os nomes de coluna e a estrutura dos resultados, e não basta para dizer como uma busca diferente vai se comportar.
Por que company_rating está vazia?+
Estava vazia nas 100 linhas nossas, e sinceramente não sabemos por quê. Pode ser uma coluna que nunca preenche, ou pode ser que a busca específica que rodamos não tenha devolvido empregadores com nota. Uma consulta não separa isso. Rode a sua no plano gratuito e veja.
Toda vaga tem mesmo candidatura em um clique?+
easy_apply dizia Yes em todas as linhas que vimos - mas nossa evidência é uma busca, e uma busca filtrada para candidaturas em um clique pareceria exatamente igual a uma coluna que sempre diz Yes. Não vamos chutar qual das duas. Trate como não verificado até a sua própria exportação mostrar outra coisa.
Por que há mais linhas do que vagas?+
Porque a mesma vaga pode aparecer em mais de uma posição num conjunto de resultados. Nossas 100 linhas continham só 53 valores distintos de job_url, com 27 links se repetindo e um aparecendo quatro vezes. Deduplique por job_url antes de contar vagas, e lembre que a cobrança segue linhas e não vagas distintas.
Consigo uma data de publicação de verdade?+
Não diretamente. date_posted é uma idade relativa no momento da execução - 24h, 13d, 30d+ - e não uma data, e 30d+ é um balde aberto sem borda superior. Se você precisa de datas reais, guarde a data em que rodou o job e subtraia.
Quanto custa?+
As primeiras 500 linhas de uma conta nova são grátis e de uso único; depois são US$ 0,002 por linha - cerca de US$ 2 por 1.000 linhas - pagando conforme o uso, sem assinatura. Os créditos não expiram e não há reinício mensal.

Rode uma busca
e veja você mesmo.

Cole uma URL de busca de vagas do Glassdoor e receba os resultados como linhas ordenadas. Suas primeiras 500 linhas são grátis - o que neste serviço é realmente o jeito certo de começar.

Extrator de Vagas do Glassdoor - uma busca como linhas ordenadas e exportáveis

A busca de vagas do Glassdoor é feita para navegar: você rola, você clica, e a ordem que determinou o que você viu desaparece no instante em que sai da página. O Extrator de Vagas do Glassdoor, em vez disso, pega uma URL de busca e devolve os resultados como tabela - uma linha por resultado, carregando o cargo, a empresa, a localização, o salário anunciado com a fonte, o link da vaga, um trecho da descrição, o logotipo da empresa e a posição que o resultado ocupou no ranking. Monte a busca no Glassdoor com os filtros que quiser, envie a URL, e leve os resultados como CSV, JSON ou Excel.

Esta página é mais cautelosa que as outras deste site, e a razão merece vir na frente. Nossa evidência é uma única execução com dados de 100 linhas vinda de uma busca; outras cinco execuções não devolveram absolutamente nada. Os doze nomes de coluna são firmes - o cabeçalho da planilha coincide exatamente com as chaves do JSON e é idêntico nas seis execuções - mas cada número ao lado descreve aquela única busca, e não o serviço. Também não há referência publicada para este endpoint: o Glassdoor não aparece em lugar nenhum da documentação da API, então esta página não cita limite de lote, configuração de idioma ou região nem ordenação, porque não existe fonte para eles. Onde outras páginas daqui podem contar o que acontece ao longo de milhares de linhas e muitas entradas, esta pode contar o que aconteceu uma vez, e diz isso.

Dois achados valem para qualquer busca. O primeiro é que linhas não são vagas: nossas 100 linhas continham apenas 53 URLs de vaga distintas, com vinte e sete links repetidos e um aparecendo quatro vezes em posições diferentes, então qualquer contagem de vagas precisa deduplicar antes - e a cobrança segue linhas, não cargos únicos. O segundo é que date_posted é uma idade e não uma data. Os valores eram 24h, 3d, 13d e 30d+, medidos no momento da execução, o que significa que não dá para fazer parse como data, não dá para comparar entre execuções e, no caso de 30d+, não há limite superior nenhum. Se você precisa de datas reais, registre quando rodou o job e derive.

Outros dois achados são genuinamente interessantes e genuinamente não resolvidos. O salário estava presente em todas as linhas da nossa busca, sempre com a procedência acrescentada - 96 de 100 marcadas como informadas pelo empregador e o resto como estimativa do Glassdoor - uma distinção que vale extrair em vez de descartar, já que uma é o que a empresa publicou e a outra é o palpite de um modelo. Mas company_rating estava vazia nas 100 linhas e easy_apply dizia Yes nas 100, e uma única consulta não pode dizer se isso são propriedades do serviço ou artefatos da busca que por acaso rodamos. Uma busca filtrada para candidaturas em um clique produziria exatamente o padrão que vimos. Não vamos resolver isso chutando, então a recomendação é concreta: rode uma busca sua contra as 500 linhas grátis e olhe essas duas colunas antes de construir qualquer coisa que dependa delas. Suas primeiras 500 linhas não custam nada e não precisam de cartão.