入力はレビューではなく施設です。評判を知りたいホテルを指定して並び順を選べば、ジョブが宿泊者の書いたものを集めます。
1 レビューにつき 1 行で、どのクエリから来たかが各行に記録されます。50 施設をまとめて実行しても、入力リストと必ず突き合わせられます。
関連度順、新着順、評価の高い順、評価の低い順。並び順を低い順にして上限を小さくすれば、ファイルの先頭に来るのは苦情--どのみち読むつもりだった部分--です。あとから全レビュー履歴をふるいにかける必要はありません。
宿泊者は短い結論を書き、それから理由を説明します。その 2 つは別々の列で届きます--title と review。本文は前処理なしでそのまま返るので、後段の感情分析が読むのは私たちの言い換えではなく宿泊者自身の言葉です。
このエクスポートにホテル名の列も施設 ID もありません。6 列だけで、行を施設に結びつけるのは query だけです。テーブル設計の前に知っておく価値があります--送信した URL を残してください。多数のホテルをまとめて実行したとき、突き合わせの軸になるのはそれです。
各行は Hotels.com が表示しているとおりのレビューです。誰が書いたか、評価、日付、見出し、本文。
レビュー本文は前処理を一切かけずそのまま返ります。下の列一覧はプラットフォーム自身のもので、JSON と Excel の 2 つのダウンロード経路がどちらも同じ順序でそれを通すため、どちらのボタンを押してもファイルはこの 6 つの名前を持ちます。パーサーを書く前に表の下の注記を読んでください。名前は裏付けがあり、値の形式にはありません。
プラットフォーム自身の列一覧をエクスポート順に並べたもので、JSON と Excel のダウンロード経路で同一であることを確認済みです。説明は各項目が何のためのものかを述べるだけで、形式については何も主張しません--下の注記をご覧ください。
この辞書は名前の一覧として読んでください。中身の保証ではありません。6 つの名前とその順序は確実です。プラットフォームが公開している列一覧に由来し、JSON と Excel のダウンロードがどちらも同じ一覧を同じ順序で通します。定まっていないのは値の形です。保存済みの Hotels Reviews エクスポートが空のものすら一件もないためで、このページは日付の書式も、評価の尺度や範囲も、どの列の充足率も主張しません。query だけは仕組みが保証する例外で、スクレイパーがページから読むのではなく自ら書き込むため、全行に入ります。ほかのことを仮定する前に、無料枠で 1 回走らせて最初の数行を読んでください。
クエリごとの上限が、実行の費用とファイルに入る量を決めます。並び順は、その上限をどのレビューに使うかを決めます--どちらもジョブの開始前に選びます。
宿泊者レビューのデータを、現場が実際に抱えている問いに答えるために使っている例をいくつか。
自社施設を評価の低い順にし、上限は控えめにして取得します。苦情が全履歴の末尾ではなくファイルの先頭に来るので、読む量は少なく、クレジットは問題のある場所に使われます。
一本の通りや一地区のホテルをすべてエクスポートし、宿泊者が実際に書いたものを並べて比べます。改装前に役立ち、改装後も、本当にどこへ予約を取られているのかを知るのに役立ちます。
数十施設にわたる原文のレビューは、繰り返し起きる不具合を--うるさい、古い、割高--繰り返される言い回しとして可視化します。評価が 0.1 下がったという形ではありません。見出しの列は、そのまま各レビューの要約としても使えます。
サブスクリプションも、最低利用額も、毎月の請求もありません。最初の500行は当社負担 - その後は従量課金で、ここにある他のスクレイパーと同じ均一料金です。
新規アカウントごとに初回のみ。クレジットカード不要。クエリごとの上限、すべての並び順、ファイルアップロード、すべてのエクスポート形式を含みます。
1,000レビューあたり約 $2。事前見積もりが実行開始前に行数とクレジット費用を表示します - 想定外の請求も、換算が必要な計算ユニットもありません。
継続的なモニタリングや非常に大規模な過去データの取得向けに、ボリューム料金、専用ワーカー、SLA をご用意します。ご希望の規模をお知らせいただければお見積もりします。
LIVESCRAPER10 をご利用ください。短い答え: 公開されているレビュー内容についてははい - そしてこのエクスポートには、その背後にある予約の情報は一切含まれません。
Hotels.com の宿泊者レビューは読まれるために公開されています。評価、見出し、レビュー本文、日付は、ログインの有無にかかわらず施設ページを開いた誰にでも表示されています。公開されている評判を調査目的で収集することは長く確立された実務であり、ここではログインも予約もペイウォールも一切扱いません。
投稿者の項目はサイト自身が公開しているもの、つまり完全な身元ではなく表示名です。この出力にメールアドレスも住所もありません。レビューの背後にある滞在についても何も収集しません--支払額も、日程も、部屋も。EU 域内でレビュー本文を処理する場合、その後の取り扱いには通常の規則がそのまま適用されます。
Hotels.com の利用規約は自動アクセスを制限しているため、これは法律の問題であると同時に契約の問題でもあります。同プラットフォームと契約関係がある場合は規約を確認してください。データ層でサードパーティのトラッカーは一切動かしておらず、エクスポートは 30 日で自動的に削除されます。
最もよくいただく質問です。ほかにご不明な点は お問い合わせください - 回答を書いているのはボットではなく人間です。
Livescraper の Hotels Reviews Scraper は、施設のリストをレビューデータに変えます。Hotels.com のホテル URL を 1 行に 1 件入力するか、CSV、XLSX、TXT、Parquet でアップロードし、クエリあたりの行数に上限をかけるか、すべて取るなら上限を空欄のままにして、並び順を選び、宿泊者が書いたものを整った CSV、Excel、JSON ファイルとしてダウンロードします。
各行は Hotels.com が表示しているとおりのレビューです。投稿者、評価、日付、見出し、レビュー本文。見出しと本文は別々の列のままなので、宿泊者が説明の上に書く短い結論だけを単独で扱えます。本文は前処理なしでそのまま届くので、後段の感情分析が読むのは私たちの言い換えではなく宿泊者の言葉です。
実行の価値を決めるのは並び順です。関連度順、新着順、評価の高い順、評価の低い順--低い順にして上限を控えめにすれば、苦情は全履歴の末尾ではなくファイルの先頭に来ます。ホテルはそれで自社の最も厳しい声から読み、戦略チームは通り一本をまるごとエクスポートして宿泊者が実際に書いたものを比べ、研究者は数十施設の原文レビューを読みます。そこでは繰り返し起きる不具合が、0.1 下がった評価としてではなく、繰り返される言い回しとして現れます。
先に実務上の注記を一つ。このページは 6 列とその順序を説明しており、それはプラットフォームの公開列一覧と 2 つのダウンロード経路が完全に一致している点ですが、日付の書式も評価の尺度も充足率も一切主張していません。根拠となる保存済みの Hotels Reviews エクスポートがないためです。作り込む前に、無料枠で 1 回走らせて最初の数行を読んでください。最初の 500 行は無料でクレジットカードも不要、以降は 1 行 0.002 ドルの均一料金です。