それが他の2つのTrustpilotサービスとの違いのすべてであり、データの形も請求額も変わります。
TrustpilotスクレイパーとTrustpilot検索スクレイパーは企業ごとに1行を返し、評価とレビューの件数を含みます。こちらはその件数の背後にあるレビューを返します。タイトル、本文全体、星、日付、そして投稿者です。
したがって計算が違います。100社はそれらのサービスでは100行ですが、ここでは既定が1社につき最大100件のレビューなので、最大1万行になりえます。それは欠点ではなく、レビューデータとはそういうものだというだけです。ただ、大きなリストを投入する前に知っておく価値があります。
結果は1つの平坦な塊ではなく企業ごとにグループ化されて返るため、多数の会社を対象とした実行でも、こちらで並べ替え直さずとも整理された状態が保たれます。
入力は参照サービスと同じ - ドメインかTrustpilotのページリンクです。
再実行で役立つのはカットオフです - 下の範囲設定をご覧ください。
ほとんどのレビューデータセットは感情を与えてくれます。この2つはもっと稀なもの - それを重み付けする手段を与えてくれます。
author_reviews_numberは、その人がどこかで書いたレビューの総数です。author_reviews_number_same_domainは、そのうち今見ている企業に対するものの数です。合わせて読むと多くが分かります。多数の会社にわたる長いレビュー履歴を持つ人は、目の前の1件が唯一のレビューであるアカウントとは異なる種類の情報源です。そして同じ企業について複数のレビューを書いている人は、さらに別のケースです。
そのどれも単独では何も証明しませんし、証明するふりもしません。初めてレビューを書く人は、たいてい単に初めて書いているだけです。しかし、5つ星の連続や1つ星の集中が本当の顧客体験を反映しているかを判断するとき、投稿者の履歴が同じ行にあることは、感情を読むことと感情を精査することの差になります。review_dateと組み合わせれば、不自然に近い時期に届いたレビューを見つけられます。
4つの設定が実行を形づくります。カットオフは、これを一度きりの取得から安く繰り返せるものへと変える設定です。
主要なコスト調整レバーです。下げない限り1社で最大100行になるので、1,000ドメインのリストを既定のまま実行すると非常に大きなジョブになります。分析が実際に必要とする値に設定してください。
関心のある最も古い日付を設定すると、実行はそこで止まります。後日、前回収集した日をカットオフにして再実行すれば、新しい分だけの費用で済みます。レビューデータセットを最新に保つ最も安価な方法です。
1社のレビューをより深くたどるためのものです。スキップの値は20の倍数でなければならない点を知っておく価値があります。半端な数では期待どおりに動かず、これは半日を溶かす類の細部です。
1つの言語に絞ることも、すべてを取ることもできます。文書化されている選択肢は、既定と「すべて」に加えて英語、スペイン語、ドイツ語です。新しい順の並べ替えが文書化されたオプションです。
言語フィルターについて一言。リファレンスに名前が挙がっているのはその3言語だけなので、他の言語が 必要なら、想定で進めずに無料枠で確認してください。2万行ではなく2行で気づいていただくほうが よいからです。
3つとも文書化されたレスポンスから直接得られたものです。
日付はUnixタイムスタンプです。review_dateは読める日付ではなく秒数として届きます。しかも一部のレビューサービスと違い、整形済みの対応フィールドは併記されていません。取り込み時に変換してください。さもないと、作るグラフはどれも正しく並び、意味のないラベルが付くことになります。
total_reviewsを合計しないでください。これは企業全体のレビュー件数で、その企業のすべてのレビュー行に同じ値が繰り返されています。100件のレビューにわたって不用意に集計すると、実際の100倍の数字を報告することになります。企業ごとに最初の値を取るか、Trustpilotスクレイパーから取得してください。あちらはまさにこの問題が起きないよう、企業ごとに1行を返します。
レビューは企業ごとにグループ化されて届きます。レスポンスは単一の平坦なリストではなく、クエリごとに1つのコレクションを入れ子にします。パイプラインが行を期待しているなら、意図的にフラット化してください。利点はqueryがすべてのレビューに付いていることで、フラット化した後も曖昧さは残りません。
各行は1件のレビューで、そのレビューが属する企業も併せて持ちます。したがってエクスポートは、プロフィールへの結合なしにそれ自体で成立します。
半数の行にはレビュー本文がありません。実際の出力100行のうち、reviewが埋まっていたのは50%、titleは94%でした。見出しと星評価だけを残し、他は書かない人が多いのです。感情分析やキーワード分析を行うなら、まずreviewが空でないことで絞り込んでください。さもないと分母が誤ります。replyは43%に存在します。
スコアよりもテキストが重要になる場面です。
評価は問題があることを教えてくれますが、どの問題かはテキストが教えてくれます。自社と競合のレビューを取得し、繰り返し現れるテーマを読むと、顧客が本当に気にしている具体的な失敗が浮かび上がります。たいていは社内の想定より短く、意外な一覧になります。
競合の否定的なレビューは、彼らの製品がどこで壊れ、どの約束を守れないかについての無料の調査資料です。それはポジショニングの材料であると同時に、やってはいけないことの一覧でもあり、顧客調査のごく一部の費用で手に入ります。
スコアが企業の評判と食い違って見えるとき、投稿者の履歴フィールドを使えばきちんと確認できます。投稿者がどれだけ定着しているか、この会社だけについて書いた人が何人いるか、レビューが集中して届いていないか。デューデリジェンスにも、自社の掲載を守るためにも役立ちます。
サブスクリプションも最低額もシート課金もありません。最初の500行は当社負担で、その後は従量課金です。
新規アカウントごとに一度きり。クレジットカードは不要です。このサービスでは数百件のレビューに相当し、1社をきちんと読み、規模を広げる前に言語フィルターが機能するか確認するには十分です。
1,000件のレビューあたり約2ドル。ここでの1行は企業ではなくレビューなので、1社あたりのレビュー数の設定が主要なレバーです。そして再実行時のカットオフ日が、継続的な収集を安く保ちます。
ボリューム料金、SLA、専用ワーカー、そして多数の企業のレビュー感情を継続的に追跡するチーム向けの個別オンボーディング。件数をお知らせいただければお見積もりします。
LIVESCRAPER10をご利用ください。顧客は同じ企業を複数の場所でレビューしており、2つの語られ方はしばしば異なります。
このサービスは他の2つのTrustpilotツールとは立ち位置が異なり、その答えを流用するのではなく、理由を述べる価値があります。
レビューは読まれるために公開されています。それがレビュープラットフォームの存在意義そのものであり、公開されている情報を調査目的で収集することは長く確立された慣行です。しかし企業プロフィールと違い、レビューには書き手がいます。出力には投稿者の表示名、識別子、国、レビュー履歴が含まれ、その組み合わせは、名前が下の名前とイニシャルだけであっても個人データです。
実務上の帰結は2つ。お客様はそのデータの管理者となるため、通常の義務が生じます。保持のための法的根拠と、異議申立てや削除請求が届く経路です。またレビューを再公開する場合、そのテキストは書き手自身の著作である点を忘れないでください。レビューを自社のマーケティングで引用することは、社内で分析することとは別の行為であり、出典表示も文脈も重要です。集計的な分析 - テーマ、時系列の感情、評価の分布 - が最も正当化しやすく、最も一般的な用途です。
当社自身の考え方は、保持するものを最小限にすることです。感情だけが必要なら投稿者のフィールドはほとんど不要であり、取り込み時にそれらを落とすのが義務を減らす最も簡単な方法です。当社はログインの背後にあるものには触れず、データ層でサードパーティのトラッカーを動かさず、エクスポートは30日後に自動削除されます。
最もよくいただく質問です。他にもあればご連絡ください - 回答を書いているのはボットではなく人間です。
review_idをお使いください。review_dateがUnixタイムスタンプ - 読める日付ではなく秒数 - であり、整形済みの対応フィールドが併記されていないからです。取り込み時に変換してください。並べ替えは生の値のままでも問題なく機能します。変換しない場合に読めなくなるのはラベルだけです。total_reviewsを合計したからです。これは企業全体の件数がすべてのレビュー行で繰り返されているもので、100件のレビューにわたって足し合わせると100倍になります。企業ごとに最初の値を取るか、企業ごとに1行を返すTrustpilotスクレイパーから取得してください。星評価は、顧客が考えたことすべてを1桁の数字に圧縮します。Trustpilotレビュースクレイパーはその残りを取り出します。ドメインやTrustpilotのページリンクを送信すると - 1回の実行につき最大1,000件 - 各企業がレビューを行として返し、そこには13のフィールドが含まれます。レビューの識別子、書かれたままのタイトルと本文全体、星評価、参考になったと評価した人数、日付、その企業のレビュー総件数、そして投稿者を説明する4つのフィールド、すなわち表示名、識別子、国、そして総計およびこの企業に対して書いたレビュー数です。結果は1つの平坦な塊ではなく企業ごとにグループ化されて届き、すべてのレビューがそれを生んだクエリを保持します。
最初に理解すべきは、これが他の2つのTrustpilotサービスとどれほど異なる振る舞いをするかです。どちらも企業ごとに1行を返し、評価とレビュー件数を含みます。ここでは1行がレビューであり、既定は1社につき最大100件のレビューです。したがって100ドメインは100行ではなく1万行になりえます。それは単にレビューデータの性質ですが、1社あたりのレビュー数の設定をこのページで最大のコスト調整レバーにします。これを補うのがカットオフ日です。関心のある最も古いレビューを実行に伝えればそこで止まるため、後日カットオフを前回の収集日に設定して再実行すれば、それ以降に現れた分だけの費用で済みます。重複排除のためのレビュー識別子と組み合わせれば、高価な一度きりの取得が安価な継続収集に変わります。スキップの設定は1社のレビューをより深くたどるためのもので、1つ知っておくべき癖があります - 値は20の倍数でなければなりません。
3つの細部がインポーターの書き直しを防ぎます。レビュー日は秒単位のUnixタイムスタンプで、整形済みの対応フィールドは併記されていません。取り込み時に変換しなければ、グラフは正しく並び、ラベルは読めなくなります。レビュー総件数は企業単位の数値で、その企業のすべてのレビュー行に同じ値が繰り返されるため、100件のレビューにわたって合計すると実際の100倍を報告することになります。企業ごとに最初の値を取るか、まさにこれが起きないよう企業ごとに1行を返すTrustpilotスクレイパーから読み取ってください。またレスポンスは平坦なリストではなくクエリごとに1つのコレクションを入れ子にするため、意図的にフラット化してください。言語フィルターについては、リファレンスに挙がっているのは既定と「すべて」に加えて英語、スペイン語、ドイツ語です。それ以外は想定せず無料枠で試す価値があります。
2つのフィールドが、このデータセットを際立って有用にしています。投稿者が総計で何件のレビューを書き、そのうち何件が目の前の企業に対するものかを知ることで、評価を単に記録するのではなく重み付けできます。今読んでいる1件が唯一のレビューであるアカウントは、長く多様な履歴より弱い証拠であり、時期が密に集中したレビューは検討に値します。どちらも単独では何も証明しませんし、初めてレビューを書く人はたいてい単に初めて書いているだけですが、タイムスタンプと組み合わせれば、感情を読むことは精査に近いものへと変わります。この能力には責任が伴い、それがこのページの法的な立場が姉妹ページと異なる理由です。レビューには書き手がいるため、名前が下の名前とイニシャルだけであっても、出力には個人データが含まれます。お客様はその管理者となり、通常の法的根拠と削除の義務を負いますし、レビュー本文の再公開は、社内分析では生じない出典表示の問題を生みます。実務的な助言はデータ最小化です。感情とテーマだけが必要なら、取り込み時に投稿者のカラムを落としてください。ログインの背後にあるものには触れず、エクスポートは30日後に自動削除されます。無料で始めましょう。最初の500行は無料で、クレジットカードも不要です。