Extracteur d'Offres Glassdoor

Une recherche Glassdoor,
en lignes classées.

Collez une recherche d'emploi Glassdoor et récupérez ses résultats sous forme de tableau - l'intitulé, l'entreprise, le lieu, le salaire annoncé, le lien vers l'annonce et un extrait de la description, chaque ligne portant la position qu'elle occupait dans les résultats.

500 lignes gratuites, une seule foispuis 0,002 $ par ligneune ligne par résultat, rang inclusCSV · JSON · Excel
À lire d'abord

Sur cette page nous sommes
inhabituellement prudents.

La plupart des pages ici citent des taux de remplissage tirés de milliers de lignes et de nombreuses entrées. Celle-ci ne le peut pas, et prétendre le contraire serait le moyen le plus simple de vous induire en erreur.

Notre preuve est une exécution renseignée de 100 lignes issue d'une seule recherche Glassdoor. Cinq autres exécutions n'ont rien renvoyé du tout. Les douze noms de colonnes sont solides - l'en-tête du tableur et les clés du JSON correspondent exactement et sont identiques sur les six exécutions - mais toute affirmation sur la fréquence de remplissage d'une colonne décrit cette recherche, pas le service.

Cette distinction pèse plus lourd qu'il n'y paraît. Deux colonnes étaient parfaitement constantes dans nos données : company_rating était vide sur chaque ligne, et easy_apply indiquait Yes sur chaque ligne. L'une comme l'autre pourrait être une propriété du service, ou simplement une propriété de la recherche que nous avons lancée. Une seule requête ne permet pas de trancher, nous n'affirmons donc ni l'une ni l'autre.

Il n'existe pas non plus de référence publiée pour cet endpoint - Glassdoor n'apparaît nulle part dans la documentation de l'API. Contrairement aux autres extracteurs de ce site, cette page ne cite donc aucune limite de lot, aucun réglage de langue ou de pays et aucun ordre de tri, parce qu'il n'existe de source pour rien de tout cela. Ce qui suit est ce que nous avons vu, et rien d'autre.

livescraper.app · ce que nous pouvons et ne pouvons pas dire
Noms de colonnes : vérifiés sur des lignes réelles
Structure des résultats : vérifiée
Taux de remplissage : une seule recherche!
Colonnes constantes : cause inconnue!
Aucune référence publiée n'existe!
L'offre gratuite est le moyen de tester votre propre recherche.
Comment ça marche

Une URL de recherche en entrée,
ses résultats en sortie.

Ce que nous avons lancé est une URL de recherche d'emploi Glassdoor, et les résultats sont revenus sous forme de lignes.

  1. ÉTAPE 1Connectez-vous à la plateforme.
  2. ÉTAPE 2Ouvrez l'Extracteur d'Offres Glassdoor.
  3. ÉTAPE 3Collez une URL de recherche d'emploi Glassdoor - poste, lieu et filtres déjà appliqués.
  4. ÉTAPE 4Choisissez votre format et cliquez sur Get Data.
  5. ÉTAPE 5Vérifiez le premier export avant de passer à l'échelle - voyez la mise en garde ci-dessus.

Construisez d'abord la recherche sur Glassdoor, avec les filtres voulus, puis soumettez cette URL. Ce sont les filtres réglés là-bas qui façonnent l'ensemble des résultats.

Dictionnaire de données

Douze colonnes,
issues d'un export réel.

Les noms sont l'en-tête de l'export, correspondant exactement aux clés du JSON et identiques sur les six exécutions. Les chiffres qui les accompagnent proviennent de notre unique exécution renseignée de 100 lignes - traitez-les comme une observation, pas comme un taux.

query
L'URL de recherche Glassdoor que vous avez soumise, renvoyée sur chaque ligne. Une seule valeur sur toute notre exécution, puisque nous avons soumis une recherche.
job_title
Le poste annoncé. Sur les 100 lignes que nous avons, avec 52 intitulés distincts.
company
L'entreprise qui recrute. Sur les 100, avec 31 noms distincts.
company_rating
La note employeur de Glassdoor. Vide sur les 100 lignes que nous avons. Nous ignorons si elle ne se remplit jamais ou si elle ne s'est simplement pas remplie pour cette recherche - voyez la note ci-dessous.
location
Où se situe le poste. Sur les 100, avec 13 valeurs distinctes, toutes dans la zone couverte par notre recherche.
salary
La fourchette annoncée, avec sa source ajoutée - $120K - $170K (Employer provided). Sur les 100 lignes que nous avons, mais voyez la note ci-dessous avant de supposer que cela vaut en général.
date_posted
Depuis combien de temps l'annonce est en ligne, sous forme de chaîne relative telle que 30d+, 24h ou 13d. Jamais une date réelle. Sur 71 de nos 100.
easy_apply
Si l'annonce accepte une candidature en un clic. Indiquait Yes sur les 100 lignes que nous avons - ce qui, à partir d'une seule recherche, dit moins qu'il n'y paraît.
job_url
Un lien vers l'annonce. Sur les 100 lignes, mais seulement 53 d'entre eux distincts.
snippet
Un extrait de la description du poste, pas le texte complet. Sur les 100.
logo
Le logo de l'entreprise. Sur 88 de nos 100.
position
Le rang qu'occupait l'annonce dans les résultats. Un entier de 1 à 100, et les 100 étaient distincts - c'est donc l'ordre, pas un identifiant.

Les noms sont vérifiés ; les chiffres sont une recherche. L'en-tête du tableur correspond exactement aux clés du JSON et est le même sur les six exécutions : les douze colonnes sont donc réelles. Tout le reste de cette page provient d'un unique export de 100 lignes, et l'offre gratuite est la façon honnête de découvrir comment se comporte votre propre recherche avant de bâtir dessus.

Avant de construire

Quatre choses que
ce seul export a montrées.

Deux valent quoi que vous cherchiez. Deux sont des avertissements contre l'excès de lecture d'une exécution unique - y compris la nôtre.

La même annonce apparaît à plusieurs positions

Nos 100 lignes ne contenaient que 53 valeurs distinctes de job_url. Vingt-sept liens apparaissaient plus d'une fois, l'un d'eux quatre fois, chacun à une position différente. Un nombre de lignes n'est donc pas un nombre d'annonces. Dédupliquez sur job_url avant d'annoncer combien d'offres une recherche a trouvées, sinon vous les surestimerez d'environ la moitié.

date_posted est un âge, pas une date

Les valeurs que nous avons vues étaient 24h, 3d, 13d, 30d+ et similaires - un âge relatif au moment de l'exécution, pas un horodatage. Cela ne se parse pas comme une date, ne se trie pas de façon sensée face à une autre exécution, et 30d+ est un seau ouvert plutôt qu'une valeur. S'il vous faut de vraies dates, notez vous-même la date d'exécution et déduisez-les.

salary vous dit d'où vient le chiffre

Chaque salaire de notre export se terminait par sa provenance : 96 sur 100 indiquaient (Employer provided) et le reste (Glassdoor est.). Cette distinction compte - l'un est ce que l'employeur a écrit, l'autre l'estimation d'un modèle - et elle se trouve dans la même chaîne que la fourchette : extrayez-la plutôt que de la jeter. Si le salaire est aussi bien renseigné sur d'autres recherches, une seule ne permet pas de le dire.

Deux colonnes étaient constantes - et nous ignorons pourquoi

company_rating était vide sur chaque ligne et easy_apply indiquait Yes sur chaque ligne. Une recherche filtrée sur les candidatures en un clic produirait exactement ce second motif, et une colonne qui dit toujours Yes aussi. Une requête ne peut pas les distinguer. Vérifiez les deux sur votre propre premier export plutôt que de prendre le nôtre pour règle - c'est précisément à cela que sert l'offre gratuite.

Cas d'usage courants

Trois tâches que l'on
exécute le plus souvent ici.

À quoi sert une recherche classée et exportable.

Benchmark salarial

Lire la fourchette annoncée, et sa source

Parce que salary porte sa provenance dans la même chaîne, vous pouvez séparer ce que les employeurs ont réellement publié de ce que Glassdoor a estimé. Un benchmark bâti uniquement sur des chiffres fournis par l'employeur est un nombre très différent - et bien plus défendable - que celui qui y mêle des sorties de modèle.

People ops · Rémunération
Visibilité dans la recherche

Voir où se classe une annonce, pas seulement qu'elle existe

La colonne position enregistre l'ordre dans lequel les résultats sont revenus. Pour qui publie un poste, c'est la différence entre figurer sur le site et y être vu - et relancer la même URL de recherche en fait un mouvement que vous pouvez suivre.

Recrutement · Marketing
Cartographie de marché

Transformer une recherche en liste d'entreprises

Notre unique recherche de 100 lignes couvrait 31 entreprises distinctes recrutant pour un poste dans une ville. Dédupliquée par employeur, c'est une liste prête à l'emploi de qui est actif sur un marché en ce moment - un meilleur point de départ qu'un annuaire qui peut avoir des années.

Stratégie · BD
Tarifs

Ne payez que les lignes
que vous extrayez vraiment.

Pas d'abonnement, pas de minimum, pas de licence par siège. Vos 500 premières lignes sont pour nous - ensuite, paiement à l'usage.

Offre gratuite

500 lignes gratuites - 0 $

Pour chaque nouveau compte, une seule fois. Sans carte bancaire. Tous les extracteurs débloqués. Sur ce service en particulier, les lignes gratuites sont l'essentiel : une recherche à vous vous dira ce que notre unique export n'a pas pu.

0 $ pour toujours
Paiement à l'usage

0,002 $ par ligne, après l'offre gratuite

Environ 2 $ pour 1 000 lignes. Rappelez-vous que les lignes sont des résultats et non des annonces distinctes - les nôtres étaient environ à moitié des doublons - budgétez donc sur le nombre de résultats affiché, pas sur le nombre d'offres attendu.

Le plus populaire
Enterprise

Sur mesure · suivi planifié

Tarifs au volume, SLA, workers dédiés et onboarding sur mesure pour les équipes qui suivent le recrutement sur de nombreuses recherches et marchés. Donnez-nous vos chiffres et nous établirons un devis.

Parlons-en
10 % de remise sur votre première exécution payante.Utilisez le code LIVESCRAPER10 au paiement.
S'inscrire
Se combine bien avec

Un site n'est
jamais tout le marché.

Glassdoor est l'un des divers endroits où un poste est publié, et le recouvrement est rarement complet.

Le point juridique

Est-il légal de collecter
des offres d'emploi ?

Réponse courte : oui. Ce sont des annonces, publiées pour être trouvées par le plus grand nombre.

Une page de recherche d'emploi est publique. N'importe qui peut la parcourir sans compte, et collecter des annonces publiquement visibles à des fins de recherche est une pratique établie de longue date. Tant que les données sont publiquement disponibles et que le processus ne perturbe pas le site, aucune loi fédérale ne l'interdit.

Les annonces d'emploi s'y prêtent bien. Le sujet d'une annonce est un poste dans une entreprise, pas une personne nommée - rien dans ces douze colonnes ne décrit un individu. Il n'y a pas de connexion, pas de paywall, et aucune candidature n'est déposée en votre nom.

Les conditions de Glassdoor restreignent l'accès automatisé, cela reste donc une question de conditions. Nous ne touchons à rien derrière une connexion, n'exécutons aucun traceur tiers sur la couche de données, et vos exports s'auto-suppriment au bout de 30 jours.

livescraper.app · principes
Uniquement des pages de recherche publiques
Aucune donnée personnelle dans aucune colonne
Aucune candidature déposée, personne contacté
Conforme au RGPD par défaut
Les exports s'auto-suppriment (30 jours)
Les annonces sont publiées pour être trouvées.
Questions fréquentes

Ce que l'on demande
avant de s'inscrire.

Les questions que nous entendons le plus. Autre chose ? Parlons-en - ce sont des humains, pas des bots, qui écrivent les réponses.

Quelles colonnes l'export contiendra-t-il ?+
Douze : query, job_title, company, company_rating, location, salary, date_posted, easy_apply, job_url, snippet, logo et position. Ces noms sont solides - l'en-tête du tableur correspond exactement aux clés du JSON et est identique sur les six exécutions que nous avons faites. La fréquence de remplissage de chacune est une autre question, à laquelle nous ne pouvons répondre que pour la seule recherche que nous avons lancée.
Sur combien de données cette page repose-t-elle ?+
Moins que la plupart des pages ici, et nous préférons le dire. Une exécution renseignée de 100 lignes issue d'une seule recherche Glassdoor ; cinq autres exécutions n'ont rien renvoyé. C'est assez pour confirmer les noms de colonnes et la structure des résultats, et pas assez pour vous dire comment se comportera une recherche différente.
Pourquoi company_rating est-elle vide ?+
Elle était vide sur les 100 lignes que nous avons, et nous ignorons sincèrement pourquoi. Ce pourrait être une colonne qui ne se remplit jamais, ou simplement que la recherche précise que nous avons lancée n'a renvoyé aucun employeur noté. Une requête ne permet pas de les séparer. Lancez la vôtre sur l'offre gratuite et regardez.
Toutes les annonces ont-elles vraiment la candidature en un clic ?+
easy_apply indiquait Yes sur chaque ligne que nous avons vue - mais notre preuve est une seule recherche, et une recherche filtrée sur les candidatures en un clic ressemblerait exactement à une colonne qui dit toujours Yes. Nous n'allons pas deviner laquelle. Traitez-le comme non vérifié jusqu'à ce que votre propre export montre autre chose.
Pourquoi y a-t-il plus de lignes que d'offres ?+
Parce que la même annonce peut apparaître à plus d'une position dans un ensemble de résultats. Nos 100 lignes ne contenaient que 53 valeurs distinctes de job_url, avec 27 liens répétés et un apparaissant quatre fois. Dédupliquez sur job_url avant de compter les offres, et rappelez-vous que la facturation suit les lignes et non les annonces distinctes.
Puis-je obtenir une vraie date de publication ?+
Pas directement. date_posted est un âge relatif au moment de l'exécution - 24h, 13d, 30d+ - plutôt qu'une date, et 30d+ est un seau ouvert sans borne supérieure. S'il vous faut de vraies dates, enregistrez la date à laquelle vous avez lancé le job et soustrayez.
Combien ça coûte ?+
Les 500 premières lignes d'un nouveau compte sont gratuites et uniques ; ensuite c'est 0,002 $ par ligne - environ 2 $ pour 1 000 lignes - au paiement à l'usage, sans abonnement. Les crédits n'expirent pas et il n'y a pas de remise à zéro mensuelle.

Lancez une recherche,
et voyez par vous-même.

Collez une URL de recherche d'emploi Glassdoor et récupérez ses résultats en lignes classées. Vos 500 premières lignes sont gratuites - ce qui, sur ce service, est vraiment la bonne façon de commencer.

Extracteur d'Offres Glassdoor - une recherche d'emploi en lignes classées et exportables

La recherche d'emploi de Glassdoor est faite pour être parcourue : vous faites défiler, vous cliquez, et l'ordre qui a déterminé ce que vous avez vu disparaît dès que vous quittez la page. L'Extracteur d'Offres Glassdoor prend au contraire une URL de recherche et renvoie ses résultats sous forme de tableau - une ligne par résultat, portant l'intitulé du poste, l'entreprise, le lieu, le salaire annoncé avec sa source, le lien vers l'annonce, un extrait de la description, le logo de l'entreprise et la position que le résultat occupait dans le classement. Construisez la recherche sur Glassdoor avec les filtres que vous voulez, soumettez l'URL, et repartez avec les résultats en CSV, JSON ou Excel.

Cette page est plus prudente que les autres de ce site, et la raison mérite d'être placée d'emblée. Notre preuve est une unique exécution renseignée de 100 lignes issue d'une recherche ; cinq autres exécutions n'ont rien renvoyé du tout. Les douze noms de colonnes sont fermes - l'en-tête du tableur correspond exactement aux clés du JSON et est identique sur les six exécutions - mais chaque chiffre à côté décrit cette seule recherche et non le service. Il n'existe pas non plus de référence publiée pour cet endpoint : Glassdoor n'apparaît nulle part dans la documentation de l'API, donc cette page ne cite aucune limite de lot, aucun réglage de langue ou de pays et aucun ordre de tri, faute de source. Là où d'autres pages ici peuvent vous dire ce qui se passe sur des milliers de lignes et de nombreuses entrées, celle-ci peut vous dire ce qui s'est passé une fois, et le dit.

Deux constats valent quoi que vous cherchiez. Le premier : les lignes ne sont pas des annonces. Nos 100 lignes ne contenaient que 53 URL d'annonces distinctes, avec vingt-sept liens répétés et un apparaissant quatre fois à des positions différentes ; tout comptage d'offres doit donc dédupliquer d'abord - et la facturation suit les lignes, pas les postes uniques. Le second : date_posted est un âge et non une date. Les valeurs étaient 24h, 3d, 13d et 30d+, mesurées au moment de l'exécution, ce qui signifie qu'elles ne se parsent pas comme des dates, ne se comparent pas d'une exécution à l'autre et, dans le cas de 30d+, n'ont aucune borne supérieure. S'il vous faut de vraies dates, notez quand vous avez lancé le job et déduisez-les.

Deux autres constats sont réellement intéressants et réellement non résolus. Le salaire était présent sur chaque ligne de notre recherche, toujours avec sa provenance ajoutée - 96 sur 100 marquées comme fournies par l'employeur et le reste comme estimation Glassdoor - une distinction à extraire plutôt qu'à jeter, puisque l'une est ce qu'une entreprise a publié et l'autre l'estimation d'un modèle. Mais company_rating était vide sur les 100 lignes et easy_apply indiquait Yes sur les 100, et une seule requête ne peut pas vous dire s'il s'agit de propriétés du service ou d'artefacts de la recherche que nous avons lancée. Une recherche filtrée sur les candidatures en un clic produirait exactement le motif que nous avons vu. Nous n'allons pas trancher en devinant, la recommandation est donc concrète : lancez une recherche à vous sur les 500 lignes gratuites et regardez ces deux colonnes avant de bâtir quoi que ce soit qui en dépende. Vos 500 premières lignes ne coûtent rien et ne nécessitent pas de carte bancaire.