イベントを先に探す必要はありません。探しているものを入力すれば、ジョブが掲載を返します。どの行にも、それを主催するグループが付いてきます。
1 イベント 1 行で、どの行にも取得元のクエリが付きます。十数個の検索キーワードをまたぐ実行でも、入力リストと突き合わせられます。
入力は普通の検索キーワード、つまり Meetup 自体に打ち込むのと同じものです。すでに絞り込んでいるなら検索 URL でもかまいません。先に見つけておかなければならない 1 ページではなく、1 行がイベントのリストになります。そのリストをどこまで下るかはクエリごとの上限が決めます。
これらの列の半分以上は、イベントではなく、それを主催するグループを説明しています。名称、urlname とリンク、拠点、タイムゾーン、トピックカテゴリとトピック、参加方式、メンバー数、写真。グループのブロックは、そのグループが主催するすべてのイベント行に繰り返されます。つまり 1 回の取得で、何が開かれているかと、誰が開き続けているかの両方が分かります。
開始・終了時刻は、イベント自身の UTC オフセットを備えた完全な ISO-8601 タイムスタンプで届き、IANA のタイムゾーン名も独立した列に入ります。会場ブロックには緯度と経度が十進度で入っています。手作業でのパースなしに、出力をそのまま地図やカレンダーに落とすには十分です。
各行は Meetup が公開しているとおりのイベント 1 件で、その末尾に主催グループのプロフィールが非正規化されて付きます。
各フィールドはページのレイアウトではなく、掲載自体が公開する構造化データから読み取ります。だからこそ結果セット全体で形が同じままになります。幅が広い理由もそこにあります。Meetup 自身のイベントレコードは深く入れ子になっており、エクスポートはその入れ子を列に平坦化するため、会場や注目写真のようなブロックは接頭辞を共有する複数の列になります。いくつかの列は入れ子そのもので、JSON としてセルに残ります。ホストやトピックのリストを固定列に平坦化するには、いくつあるかを推測しなければならないからです。下の辞書は 125 列すべてをエクスポート順に挙げ、どれがどれかを示します。パーサーを書く前に、その下の注記をお読みください。
エクスポートのヘッダー行を順番どおりに、プラットフォームが公開している列一覧と突き合わせたものです。入れ子のブロックが接頭辞を共有する複数の列に平坦化される場合は、そのまとまりを 1 件として挙げ、構成する列名を説明の中で示します。
**土曜日** のような Markdown 風の強調や独自の改行を含むことがあります。プレーンテキストだと決めてかからず、意識して描画するか取り除いてください。event_group_name と同じ文字列です。イベントを運営している人が必要なら、event_hosts にあります。_typename で終わる列がエクスポート中に複数現れるのも同じ理由で、イベントに関するデータではなく、自分が属するブロックを示しています。event_id と同じ値が入っていました。PHYSICAL はその 1 つです。単体で信頼するより会場の列と併せて読むのが賢明です。会場列の注記をご覧ください。_typename、_id、_source、_base_url。_source はフルサイズ画像への直接の https リンクで、_base_url はどの行でも同じ固定の CDN 接頭辞です。2026-07-18T17:30:00-07:00 がその形です。地域をまたいで正しく並べ替えるのに変換は要りません。_typename、_id、_name、_address、_city、_state、_country、_lat、_lng。座標は十進度です。見込んでおくべき点が 3 つあります。このブロックは丸ごと埋まるか丸ごと空になります。すべての行で埋まっているわけではなく、種別の列が物理開催としている行にも空のものがあるため、イベント種別は住所の保証にはなりません。そして国コードの大文字・小文字が揃っていません。同じコードの小文字形と大文字形がどちらも現れるので、これで集計する前に正規化してください。_state は米国の会場では埋まり、それ以外では空でした。event_series_typename と event_series_description です。_typename と _total_count。数だけで、このエクスポートに参加者の身元は含まれません。event_waiting は、手元のすべての行で _total_count と同じ数値でした。_typename と _edges で、後者は独自の ID と名称を持つトピックオブジェクトの JSON 配列としてセルに残ります。JSON としてパースしてください。カンマで分割してはいけません。_typename、_rsvp_open_time、_rsvp_close_time。event_organizer がしばしば取り違えられる、本来の列です。event_network_event_typename、_rsvp_count、_group_count。event_speaker_details_typename、_name、_description、_photo、_social_networks、_photo_typename、_photo_id、_photo_base_url。event_social_proof_insights_typename、_is_trending_event、_total_interested_users、_interested_users_sample。サンプルが必要でなければ平坦化された列をお使いください。event_women_friendly_info_typename と _source から、参加割合やサンプルアバターのフィールドを経て、_female_host_* のまとまりまでです。_typename、_id、_name、_urlname、_link、_is_private、_join_mode、_status、_timezone、_country、_state、_city、_topic_category_* のまとまりと _topics の JSON 配列、グループ規模を示す _stats_member_counts_all、さらに _needs_photo、_needs_questions、_questions、_dues_settings、_featured_event、_sponsors_*、_group_photo_*、_pro_network_*、_is_in_cumulative_impact_treatment を含みます。_link は meetup.com に urlname を付けたものなので、urlname がグループの安定したキーです。このブロック全体はグループが主催するすべてのイベント行に繰り返されます。グループを数える前に _id で重複を除いてください。America/Los_Angeles のような IANA 名で表したもの。タイムスタンプ列のオフセットと対になります。手元のすべての行でグループのタイムゾーンと一致していました。event_waiting_count_* をご覧ください。event_fee_settings を読んでください。ここでは 2 つの習慣が作業の大半を省いてくれます。1 つ目は、1 行を 2 つのレコード、すなわちイベントと、それを主催するグループとして扱うことです。event_group_ で始まるものはすべてグループを説明しており、そのグループが開催するすべてのイベント行に繰り返されます。グループについて何かを数える前に event_group_id で、イベントを数える前に event_id で重複を除いてください。2 つ目は、どのセルが値ではなく JSON を保持しているかを知っておくことです。event_hosts、event_topics_edges、event_group_topics、event_group_questions、event_fee_settings、event_group_dues_settings、そして関心を示した人のサンプルは、いずれも Meetup 自身の入れ子構造をセルの中に保っています。ホストやトピックの数が固定ではなく、固定列では収められないからです。これらは JSON としてパースしてください。カンマでの分割はうまくいきません。そのほかに、event_organizer はグループの名称であって個人の名前ではありません。会場ブロックは種別の列が物理開催としている場合でも丸ごと空になることがあり、国コードは大文字・小文字が混在して届きます。query はスクレイパー自身が書き込む唯一の列なので、掲載が何を公開していたかにかかわらず全行に入ります。それ以外は掲載の内容とちょうど同じだけ揃っています。作り込む前に、無料枠で検索キーワードを 1 つ実行して最初の数行を見てください。
検索キーワードのリストと上限だけです。入力欄は Meetup 自体に打ち込むものをそのまま受け付け、上限が実行の規模とコストを決めます。
コミュニティイベントのデータを使って、実際に抱えている疑問に答えている例をいくつか挙げます。
関心のあるトピックで検索し、結果をイベント単位ではなくグループ単位でまとめます。メンバー数、トピックカテゴリ、参加方式、そのグループが何件のイベントに現れるか。すべてが同じ取得で返るので、どこにも足を運ばずに長いコミュニティのリストを順位付けできます。
会場ブロックが緯度と経度を持ち、タイムスタンプが自前のオフセットを備えているため、ある地域全体をキーワードで検索した結果はそのまま地図やカレンダーに載ります。掲載のリンクとグループのリンクを行に残しておけば、どのピンも取得元のページまでたどれます。
RSVP 数、補欠リスト、関心の数値は、行を収集した時点について正しい値であり、確定した事実ではなくスナップショットです。ダウンロードごとに日付を刻んで定期的に再実行すれば、取得どうしの差分こそが本当に求めていたシグナルになります。
サブスクリプションも、最低利用額も、毎月の請求もありません。最初の500行は当社負担 - その後は従量課金で、ここにある他のスクレイパーと同じ均一料金です。
新規アカウントごとに初回のみ。クレジットカード不要。クエリごとの上限、ファイルアップロード、すべてのエクスポート形式を含みます。
イベント 1,000 件あたり約 2 ドル。実行前の見積もりが、開始前に行数とクレジット費用を表示します。想定外の請求も、換算が必要な計算単位もありません。
継続的な監視や非常に大規模なイベント取得のための、ボリューム価格、専用ワーカー、SLA。数量をお知らせいただければお見積もりします。
LIVESCRAPER10 をご利用ください。短い答え。公開されている掲載については、はい。そしてこのエクスポートに参加者の身元は含まれません。
ここで収集するフィールドは、イベントページが自身の公開掲載の構造化データとして、検索エンジンやカレンダーツールに読ませるために公開しているものです。タイトル、時刻、会場、トピック、背後のグループは、ログインの有無にかかわらずページを開いた人すべてに表示されます。公開された掲載を収集することは長く確立された実務であり、ここではログインにもアカウントにも一切触れません。
個人データについては、まったく無いと言い切るのではなく、境界を正確に述べておくべきでしょう。RSVP の数値は集計値、つまり何人が参加予定で何人が待っているかであり、その背後の参加者リストはこのスキーマにありません。一方でこのエクスポートが持っているのは、公開されている主催側の情報です。主催グループ自身の名称と、ホストのフィールドに入る、Meetup が掲載上で公開しているメンバー名と ID です。これらは人にあたるので、その列は個人データとして扱い、ご自身に適用される規則のもとで管理してください。
Meetup 自身の利用規約は自動化されたアクセスを制限しているため、これは法律の問題であると同時に規約の問題でもあります。プラットフォーム上で主催している場合や商業的な関係がある場合は、規約をご確認ください。当社はデータ層でサードパーティのトラッカーを一切動かしておらず、エクスポートは 30 日後に自動削除されます。
最もよくいただく質問です。ほかにご不明な点は お問い合わせください - 回答を書いているのはボットではなく人間です。
Livescraper の Meetup スクレイパーは、検索キーワードをイベントの表に変えます。キーワードを 1 行に 1 件ずつ入力するか、Meetup の検索 URL を貼り付けるか、CSV・XLSX・TXT・Parquet ファイルとしてアップロードし、クエリごとの行数に上限を設けて、結果を整った CSV・Excel・JSON ファイルとしてダウンロードします。リクエストはご自身のアドレスではなく共有プロキシプールから出ていき、並べ替えの設定はありません。クエリ、任意のファイル、上限がフォームのすべてです。
各行は 1 件のイベントです。名称と説明、イベント自身の UTC オフセットを備えた ISO-8601 タイムスタンプの開始・終了時刻、住所と座標を伴う会場、トピック、写真、チケットの上限と RSVP のルール、そして何人が参加予定か、何人が待っているか。それらの隣に、主催するグループのプロフィール、すなわち名称・urlname とリンク、都市とタイムゾーン、トピックカテゴリとトピック、参加方式とメンバー数が並びます。1 行が実質 2 つのレコードであり、エクスポートが 125 列に及ぶのはそのためです。
作り込む前に知っておきたいことが 2 つあります。主催の列に入るのは個人の名前ではなく主催グループの名称です。人はホストのフィールドにあり、そこは Meetup 自身の入れ子構造を JSON としてセルに保っています。トピック、グループの質問、料金設定も同様です。そして会場ブロックは丸ごと埋まるか丸ごと空になり、種別の列が物理開催としている一部のイベントでも空になります。つまりイベント種別は住所の保証にはなりません。国コードも大文字・小文字が混在して届くので、集計の前に正規化してください。
各フィールドは掲載が公開する構造化データから読み取ります。これにより結果セット全体で形が同じままになり、同時に範囲も決まります。掲載が公開していないフィールドは、そもそも収集する対象として存在しません。パーサーを書く前に、無料枠で検索キーワードを 1 つ実行し、最初の数行を見てください。最初の 500 行は無料でクレジットカードも不要、それ以降は 1 行 0.002 ドルの均一料金です。