入力はレビューではなく掲載です。評判を知りたいソフトウェアを指定して並び順を選べば、ジョブが購入者の書いたものを集めます。
1 レビューにつき 1 行で、どのクエリから来たかが各行に記録されます。50 製品をまとめて実行しても、入力リストと必ず突き合わせられます。
たいていのスクレイパーは、クエリが失敗したことを「何も返さない」という形で伝えます。それはレビューが 1 件もない製品と見分けがつきません。これはどちらの場合も行を書き、結果を読める文章として status に入れます。空の結果は、行数を推し量るのではなく列を読んで見分けられるということです。
rating、title、review、author、date は 1 件のレビューを表します。aggregate_rating と review_count は、そのレビューが載っている製品を表します。数百件の中の星 2 と 9 件の中の星 2 は別の事実であり、どちらを読んでいるかを教えてくれるのは後者の 2 列だけです。
参考になった順、新着順、評価の高い順、低い順--実行前に選びます。低い順に小さな上限を組み合わせれば、先頭の行が苦情になります。知っておく価値があるのは、上限が初期値 100 で埋まった状態で届くこと。すべて取るには、届いたままにするのではなく欄を空にする必要があります。
各行は Capterra が表示しているとおりのレビューと、それが属する製品と、それを取ってきたクエリの結果を持ちます。
レビュー本文は前処理を一切かけずそのまま返ります。下の列一覧は、この系統としては珍しく裏付けが厚めです--プラットフォームが公開している配列、保存済み実行の JSON キー、そのワークブックのヘッダー行が、いずれも同じ 10 個の名前を同じ順序で持っています。パーサーを書く前に表の下の注記を読んでください。名前が確かなことと、値が分かっていることは別だからです。
プラットフォーム自身の列一覧をエクスポート順に並べ、実際の実行の JSON キーおよびワークブックのヘッダー行と突き合わせたものです。説明は各項目が何のためのものかを述べるだけで、形式については何も主張しません--下の注記をご覧ください。
名前は確かです。値はここでは説明しません。それは意図的です。3 つの独立した情報源が同じ 10 個の名前を同じ順序で持っています--プラットフォームが公開している列の配列、保存済み実行の JSON キー、そのワークブックのヘッダー行。そのどれもが与えてくれないのがレビューそのものです。このスクレイパーの保存済み実行はいずれも、レビュー列が空のまま status にメッセージを載せて返ってきました。そのメッセージは、アンチボットの壁と住宅用プロキシに言及するものでした。プラットフォーム自身のフォーム上の注記も一般論として同じことを述べています--アンチボット系のサイトは、住宅用回線のみの無料プールではブロック状態を返す、と。ですからこのページは、日付の書式も、評価の尺度も、aggregate_rating や review_count の形式も、どの列の充足率も主張しません。中身が観測されていないからです。代わりに伝えるのは、どこを見ればよいかです--無料枠で 1 製品を走らせ、残りの上に何かを組み立てる前に最初の行の status を読んでください。
クエリごとの上限が、実行の費用とファイルに入る量を決めます。並び順は、その上限をどのレビューに使うかを決めます--どちらもジョブの開始前に選びます。
ソフトウェアレビューのデータを、現場が実際に抱えている問いに答えるために使っている例をいくつか。
競合する製品をすべて、評価の低い順で控えめな上限をかけて取得します。あるカテゴリで購入者が不満を述べる点は繰り返される傾向があり、その繰り返される不満は、自社の差別化点か、次のバグ報告のどちらかです。
各レビューの隣に aggregate_rating と review_count を残しておけば、4.5 という数字は単なる数字ではなくなります。称賛レビューが数件の新しい製品と、数千件を抱える定着した製品は比較になりません。このエクスポートは、それを同じ行の中で見えるようにします。
まず status で絞り込みます。レビューなしで返ってきたクエリも行は作っているので、この列にざっと目を通すだけで、本当に何もない製品と、通らなかったリクエストとを分けられます--どちらかが結論になってしまう前に。
サブスクリプションも、最低利用額も、毎月の請求もありません。最初の500行は当社負担 - その後は従量課金で、ここにある他のスクレイパーと同じ均一料金です。
新規アカウントごとに初回のみ。クレジットカード不要。クエリごとの上限、すべての並び順、ファイルアップロード、すべてのエクスポート形式を含みます。
1,000レビューあたり約 $2。事前見積もりが実行開始前に行数とクレジット費用を表示します - 想定外の請求も、換算が必要な計算ユニットもありません。
継続的なモニタリングや非常に大規模な過去データの取得向けに、ボリューム料金、専用ワーカー、SLA をご用意します。ご希望の規模をお知らせいただければお見積もりします。
LIVESCRAPER10 をご利用ください。短い答え--公開されているレビュー内容については合法です。そしてこのエクスポートには、掲載が既に示している以上の投稿者情報は含まれません。
Capterra のレビューは読まれるために公開されています。評価、見出し、レビュー本文、日付は、ログインの有無にかかわらず製品ページを開いた誰にでも表示されています。公開されている評判を調査目的で収集することは長く確立された実務であり、ここではログインもアカウントもペイウォールも一切扱いません。
投稿者の項目はサイト自身が公開しているもの、つまり完全な身元ではなく表示名です。この出力にメールアドレスも住所もありません。EU 域内でレビュー本文を処理する場合、その後の取り扱いには通常の規則がそのまま適用されます。
Capterra の利用規約は自動アクセスを制限しているため、これは法律の問題であると同時に契約の問題でもあります。同プラットフォームと契約関係がある場合は規約を確認してください。データ層でサードパーティのトラッカーは一切動かしておらず、エクスポートは 30 日で自動的に削除されます。
最もよくいただく質問です。ほかにご不明な点は お問い合わせください - 回答を書いているのはボットではなく人間です。
Livescraper の Capterra Reviews Scraper は、ソフトウェア掲載のリストをレビューデータに変えます。Capterra の製品ページ URL を 1 行に 1 件入力するか、CSV、XLSX、TXT、Parquet でアップロードし、クエリごとの上限を設定するか、すべて取るなら空にして、並び順を選び、購入者が書いたものを整った CSV、Excel、JSON ファイルとしてダウンロードします。
各行は Capterra が表示しているとおりのレビュー--投稿者、評価、見出し、本文、日付--に加えて、それが属する製品と、その製品自体の総合評価およびレビュー件数を持ちます。1 行に 2 つの粒度があることが、このエクスポートを分析可能にしています。数千件の中の低評価と 9 件の中の低評価は別の事実であり、どちらを読んでいるかを教えてくれるのは製品側の 2 列だけです。
知っておく価値があるのは 10 番目の列です。status はクエリ自体がどう処理されたかを読める文章で記録し、レビューを返さなかったクエリも消えるのではなく行を作ります。これにより、静かな失敗が「絞り込める対象」に変わります--だからこそ、ここでの誠実な最初の一手は、無料枠で 1 製品を走らせてこの列を読むことであり、残りの上に何かを組み立てるのはその後です。
先に実務上の注記を一つ。このページは 10 列とその順序を説明しており、それはプラットフォームの公開一覧、実際の実行の JSON キー、そのワークブックのヘッダー行が完全に一致している点です。日付の書式も評価の尺度も充足率も主張していません。根拠となるレビューを含む保存済み実行がないためで、いずれもレビュー列が空のまま status にメッセージを載せて返ってきました。プラットフォーム自身も、アンチボット系のサイトは住宅用回線のみの無料プールではブロック状態を返すと注記しています。最初の 500 行は無料でクレジットカードも不要、以降は 1 行 0.002 ドルの均一料金です。