Glassdoor求人スクレイパー

Glassdoorの検索を、
順位付きの行に。

Glassdoorの求人検索を貼り付けると、その結果が表として返ります。職種、企業、勤務地、提示給与、掲載へのリンク、説明の抜粋。各行には、その結果が検索結果で占めていた順位が付きます。

一度きりの無料500行以降は1行あたり0.002ドル1件の結果につき1行、順位付きCSV · JSON · Excel
まず読むところ

このページでは
いつになく慎重に書いています。

ここのほとんどのページは、何千行・多数の入力にわたる充足率を示します。このページはそれができません。できるふりをすることが、あなたを誤らせる最も簡単な方法です。

当社の根拠は1回のGlassdoor検索から得られた、データのある100行の実行1件です。ほかの5回の実行は何も返しませんでした。12のカラム名は確かです - 表計算のヘッダーとJSONのキーが厳密に一致し、6回の実行すべてで同一でした - しかしカラムがどれだけ埋まるかについての記述は、サービスではなくその検索を述べているにすぎません。

この違いは聞こえる以上に重要です。当社のデータでは2つのカラムが完全に一定でした。company_ratingは全行で空、easy_applyは全行でYes。どちらもサービスの性質かもしれませんし、たまたま実行した検索の性質にすぎないかもしれません。1件のクエリでは区別がつかないので、どちらも主張しません。

このエンドポイントには公開リファレンスもありません - GlassdoorはAPIドキュメントのどこにも出てきません。したがってこのページは、当サイトの他のスクレイパーとは違い、バッチの上限も、言語や地域の設定も、並び順も一切示しません。どれについても出典がないからです。以下に書かれているのは当社が見たものであり、それ以外ではありません。

livescraper.app · 言えることと言えないこと
カラム名:実際の行で検証済み
結果の構造:検証済み
充足率:検索1件のみ!
一定だったカラム:原因不明!
公開されたリファレンスは存在しません!
無料枠が、ご自身の検索を確かめる手段です。
仕組み

検索URLを入れて、
その結果を出す

当社が実行したのはGlassdoorの求人検索URLで、結果は行として返ってきました。

  1. ステップ 1プラットフォームにログインします。
  2. ステップ 2Glassdoor求人スクレイパーを開きます。
  3. ステップ 3Glassdoorの求人検索URLを貼り付けます - 職種、勤務地、絞り込みはすでに適用済みの状態で。
  4. ステップ 4形式を選んでGet Dataをクリックします。
  5. ステップ 5規模を広げる前に最初のエクスポートを確認してください - 上の注意書きをご覧ください。

まずGlassdoor上で望みの絞り込みを適用して検索を組み立て、そのURLを送信してください。そこで設定した絞り込みが結果の中身を決めます。

データ辞書

12カラム、
実際のエクスポート1件から。

名前はエクスポートのヘッダーで、JSONのキーと厳密に一致し、6回の実行すべてで同一です。隣の数字は、データのあった唯一の実行100行から取ったものです - 率ではなく、1件の観測として扱ってください。

query
送信したGlassdoorの検索URLが各行に返ります。当社の実行では一貫して1つの値でした。検索を1件しか送信していないからです。
job_title
掲載されている職種。当社の100行すべてに存在し、52種類の名称がありました。
company
採用している企業。100行すべてに存在し、31種類の社名がありました。
company_rating
Glassdoorの企業評価。当社の100行すべてで空でした。まったく埋まらないのか、この検索でたまたま埋まらなかっただけなのかは分かりません - 下の注記をご覧ください。
location
その職務の所在地。100行すべてに存在し、13種類の値がありました。いずれも当社の検索が対象とした地域内です。
salary
掲載されている給与レンジ。出所が付きます - $120K - $170K (Employer provided)。当社の100行すべてに存在しましたが、それが一般に当てはまると考える前に下の注記をご覧ください。
date_posted
掲載からの経過。30d+24h13dのような相対的な文字列です。本物の日付になることはありません。当社の100行中71行に存在。
easy_apply
ワンクリック応募に対応しているか。当社の100行すべてでYesでした - 1件の検索から言えることは、見た目ほど多くありません。
job_url
掲載へのリンク。100行すべてにありますが、そのうち異なるものは53件だけです。
snippet
職務内容の抜粋であり、全文ではありません。100行すべてに存在。
logo
企業のロゴ画像。当社の100行中88行に存在。
position
その掲載が検索結果で占めた順位。1から100までの整数で、100個すべてが異なっていました - つまり識別子ではなく並び順です。

名前は検証済み。数字は1件の検索です。表計算のヘッダーはJSONのキーと厳密に一致し、6回の実行すべてで同じなので、12のカラムは実在します。このページのそれ以外はすべて、100行の単一エクスポートから来ています。ご自身の検索がどう振る舞うかを、その上に構築する前に知るための誠実な方法が無料枠です。

組み込む前に

その1件のエクスポート
示した4点。

2つは何を検索しても当てはまります。2つは、単一の実行から読み取りすぎることへの警告です - 当社のものも含めて。

同じ掲載が複数の順位に現れます

当社の100行に含まれていたjob_urlの異なる値は53件だけでした。27本のリンクが2回以上、うち1本は4回現れ、それぞれ別のpositionに付いていました。つまり行数は掲載数ではありません。検索が何件の求人を見つけたかを報告する前にjob_urlで重複を排除してください。さもないとおよそ倍に膨らませてしまいます。

date_postedは日付ではなく経過時間です

当社が見た値は24h3d13d30d+などでした。実行時点での相対的な経過であって、タイムスタンプではありません。日付として解析できず、別の実行と意味のある形で並べ替えることもできず、30d+は値というより上限のない区分です。本物の日付が必要なら、実行日をご自身で記録して差し引いてください。

salaryはその数字の出所を教えます

当社のエクスポートの給与はすべて出所付きで終わっていました。100件中96件が(Employer provided)で、残りが(Glassdoor est.)です。この区別は重要です - 一方は雇用主が書いたもの、もう一方はモデルの推定です - しかもレンジと同じ文字列の中にあるので、捨てずに切り出してください。他の検索でも給与がこれほど埋まるかは、1件からは言えません。

2つのカラムが一定でした - 理由は分かりません

company_ratingは全行で空、easy_applyは全行でYesでした。ワンクリック応募で絞り込んだ検索なら、まさにこの2つ目のパターンになりますし、常にYesを返すカラムでも同じです。1件のクエリでは切り分けられません。当社のものを規則として受け取るのではなく、ご自身の最初のエクスポートで両方を確認してください - 無料枠があるのは、まさにそのためです。

よくあるワークフロー

ここで最もよく
実行される3つの用途。

順位付きで書き出せる検索が何に役立つか。

給与のベンチマーク

提示レンジと、その出所を読む

salaryが同じ文字列の中に出所を持つので、雇用主が実際に公開した数字と、Glassdoorが推定した数字を切り分けられます。雇用主提供の数字だけで作ったベンチマークは、モデルの出力が混ざったものとはまったく別の - そしてはるかに擁護しやすい - 数字になります。

ピープルオプス · 報酬
検索での見え方

掲載があるかだけでなく、何位かを見る

positionカラムは結果が返ってきた順序を記録します。求人を出す側にとって、それは「掲載されている」と「そこで見られている」の違いです。同じ検索URLを再実行すれば、追跡できる動きになります。

採用 · マーケティング
市場のマッピング

1件の検索を企業リストに変える

当社の100行の検索1件で、ある都市のある職種を採用中の31社が含まれていました。雇用主で重複を排除すれば、いまその市場で動いている企業のリストがそのまま得られます。何年も古いかもしれない名簿より良い出発点です。

戦略 · BD
料金

実際に取得した行の分
だけお支払い。

サブスクリプションも最低額もシート課金もありません。最初の500行は当社負担で、その後は従量課金です。

無料枠

無料500行 - 0ドル

新規アカウントごとに一度きり。クレジットカードは不要です。すべてのスクレイパーが利用可能。特にこのサービスでは無料行こそが要点です。ご自身の検索1件が、当社の単一エクスポートには分からなかったことを教えてくれます。

ずっと0ドル
従量課金

無料枠以降は1行0.002ドル

1,000行あたりおよそ2ドル。行は結果であって異なる掲載ではないことにご注意ください - 当社のものは約半分が重複でした - ですから見込みの求人数ではなく、表示される結果数で見積もってください。

最も人気
Enterprise

カスタム · 定期的な追跡

多くの検索と市場にわたって採用動向を追うチーム向けに、ボリューム価格、SLA、専用ワーカー、個別のオンボーディングをご用意します。数量をお知らせいただければお見積もりします。

ご相談ください
初回の有料実行が10%オフ。お会計時にコードLIVESCRAPER10をご利用ください。
登録する
組み合わせると便利

1つの掲載サイトが
市場のすべてであることはありません。

Glassdoorは求人が掲載される複数の場所のひとつであり、重なりが完全であることはめったにありません。

法的な話

求人掲載を収集するのは
合法ですか?

短く答えると、はい。これらは広告であり、できるだけ多くの人に見つけられるために公開されています。

求人検索のページは公開されています。誰でもアカウントなしで閲覧できますし、公開されている掲載を調査目的で収集することは長く確立された慣行です。データが公に入手可能で、その過程がサイトを妨害しないかぎり、それを禁じる連邦法はありません。

求人広告はここに無理なく収まります。掲載の対象は企業内の職務であって氏名のある個人ではなく、この12のカラムに人を記述するものは何もありません。ログインも有料の壁もなく、あなたの代わりに応募が行われることもありません。

Glassdoorの利用規約は自動アクセスを制限しているので、これは引き続き規約上の論点です。当社はログインの内側には一切触れず、データ層でサードパーティのトラッカーを動かすこともなく、エクスポートは30日後に自動削除されます。

livescraper.app · 原則
公開された検索ページのみ
どのカラムにも個人データはありません
応募は行わず、誰にも連絡しません
既定でGDPRに準拠
エクスポートは自動削除(30日)
広告は見つけられるために公開されています。
よくある質問

登録前によく
寄せられる質問。

最もよくいただく質問です。ほかにもあれば ご連絡ください - 回答を書くのはボットではなく人間です。

エクスポートにはどのカラムが含まれますか?+
12個です。queryjob_titlecompanycompany_ratinglocationsalarydate_postedeasy_applyjob_urlsnippetlogoposition。これらの名前は確かです - 表計算のヘッダーはJSONのキーと厳密に一致し、当社の6回の実行すべてで同一でした。それぞれがどれだけ埋まるかは別の問題で、当社が実行した1件の検索についてしかお答えできません。
このページはどれだけのデータに基づいていますか?+
ここの多くのページより少なく、それを隠さずに申し上げます。1回のGlassdoor検索から得られた、データのある100行の実行1件。ほかの5回の実行は何も返しませんでした。カラム名と結果の構造を確かめるには十分ですが、別の検索がどう振る舞うかをお伝えするには足りません。
なぜcompany_ratingは空なのですか?+
当社の100行すべてで空でしたが、理由は本当に分かりません。まったく埋まらないカラムなのかもしれませんし、実行した特定の検索が評価付きの企業を返さなかっただけかもしれません。1件のクエリではそれを切り分けられません。無料枠でご自身の検索を実行して確かめてください。
本当にすべての掲載がワンクリック応募に対応しているのですか?+
easy_applyは当社が見た全行でYesでした - しかし根拠は1件の検索であり、ワンクリック応募で絞り込んだ検索は、常にYesを返すカラムとまったく同じに見えます。どちらなのかを当社は推測しません。ご自身のエクスポートが別のことを示すまでは、未検証として扱ってください。
なぜ求人数より行数が多いのですか?+
同じ掲載が1つの結果集合の中で複数の順位に現れることがあるからです。当社の100行に含まれるjob_urlの異なる値は53件だけで、27本のリンクが繰り返し、1本は4回現れました。求人数を数える前にjob_urlで重複を排除してください。また課金は異なる掲載ではなく行に従うことも覚えておいてください。
本物の掲載日は取得できますか?+
直接には取得できません。date_postedは実行時点での相対的な経過 - 24h13d30d+ - であって日付ではなく、30d+は上限のない区分です。本物の日付が必要なら、ジョブを実行した日付を保存して差し引いてください。
費用はいくらですか?+
新規アカウントの最初の500行は無料で一度きりです。以降は1行0.002ドル - 1,000行あたりおよそ2ドル - の従量課金で、サブスクリプションはありません。クレジットに有効期限はなく、毎月のリセットもありません。

1件検索して、
ご自身で確かめてください。

Glassdoorの求人検索URLを貼り付ければ、その結果が順位付きの行として返ります。最初の500行は無料です - このサービスでは、それが本当に正しい始め方です。

Glassdoor求人スクレイパー - 求人検索を順位付きで書き出せる行に

Glassdoorの求人検索は眺めるために作られています。スクロールし、クリックし、そして何を見たかを決めていた並び順は、ページを離れた瞬間に消えます。Glassdoor求人スクレイパーは代わりに検索URLを受け取り、その結果を表として返します。1件の結果につき1行、職種、企業、勤務地、出所付きの提示給与、掲載へのリンク、説明の抜粋、企業ロゴ、そしてその結果が並び順の中で占めた位置。望みの絞り込みでGlassdoor上に検索を組み立て、URLを送信し、結果をCSV・JSON・Excelで持ち帰ってください。

このページは当サイトの他のページより慎重で、その理由は先に述べる価値があります。当社の根拠は、1件の検索から得られたデータのある100行の実行1件です。ほかの5回の実行は何も返しませんでした。12のカラム名は揺るぎません - 表計算のヘッダーはJSONのキーと厳密に一致し、6回の実行すべてで同一です - しかしその隣の数字はどれも、サービスではなくその1件の検索を述べています。このエンドポイントには公開リファレンスもありません。GlassdoorはAPIドキュメントのどこにも現れないため、このページはバッチの上限も、言語や地域の設定も、並び順も示しません。出典がないからです。ここの他のページが何千行・多数の入力にわたって何が起きるかを語れるのに対し、このページが語れるのは一度何が起きたかであり、それをそのまま書いています。

2つの発見は、何を検索しても当てはまります。1つ目は、行は掲載ではないということ。当社の100行に含まれる求人URLの異なる値は53件だけで、27本のリンクが繰り返し、1本は別々の順位に4回現れました。したがって求人数の集計はまず重複を排除しなければなりません。そして課金は固有の職務ではなく行に従います。2つ目は、date_postedが日付ではなく経過時間だということ。値は24h、3d、13d、30d+で、実行時点で測られたものです。つまり日付として解析できず、実行をまたいで比較できず、30d+に至っては上限がまったくありません。本物の日付が必要なら、ジョブを実行した時点を記録して差し引いてください。

さらに2つの発見は、本当に興味深く、本当に未解決です。給与は当社の検索の全行に存在し、常に出所が付いていました - 100件中96件が雇用主提供、残りがGlassdoorの推定 - この区別は捨てずに切り出す価値があります。一方は企業が公開したもので、もう一方はモデルの推測だからです。しかしcompany_ratingは100行すべてで空、easy_applyは100行すべてでYesであり、1件のクエリでは、それがサービスの性質なのか、たまたま実行した検索の産物なのかを判断できません。ワンクリック応募で絞り込んだ検索なら、当社が見たのとまったく同じパターンになります。推測で片づけるつもりはないので、推奨は具体的です。無料の500行でご自身の検索を1件実行し、その2つのカラムを見てから、それに依存するものを作ってください。最初の500行は費用がかからず、クレジットカードも不要です。