Capterra レビュースクレイパー

ソフトウェアのレビューと、
何が起きたかを告げる列。

Capterra の製品ページを渡すと、その掲載のレビューが行データで返ります。製品、投稿者、評価、見出し、レビュー本文、日付。そして製品自体の総合評価とレビュー件数が横に並びます。10 番目の列 status は、クエリそのものがどう処理されたかを記録します--何も返らなかった実行が、その理由を文章で教えてくれるということです。

500 行無料、初回のみ以降は 1 行 0.002 ドル10 列CSV · XLSX · JSON
使い方

入力は製品のリスト、
出力はそのレビュー

入力はレビューではなく掲載です。評判を知りたいソフトウェアを指定して並び順を選べば、ジョブが購入者の書いたものを集めます。

  1. ステップ 1プラットフォームにログインします。
  2. ステップ 2Capterra Reviews Scraper を開きます。
  3. ステップ 3Capterra の製品ページ URL を 1 行に 1 件ずつ貼り付けます。CSV、XLSX、TXT、Parquet ファイルのアップロードでも構いません。
  4. ステップ 4クエリごとの上限を設定します。すべて取るなら欄を空にします。
  5. ステップ 5並び順を選びます--参考になった順、新着順、評価の高い順、低い順。
  6. ステップ 6Get Data をクリックします。

1 レビューにつき 1 行で、どのクエリから来たかが各行に記録されます。50 製品をまとめて実行しても、入力リストと必ず突き合わせられます。

チームが使う理由

静かな実行は、
黙っているわけではない。

status 列が返事をする

たいていのスクレイパーは、クエリが失敗したことを「何も返さない」という形で伝えます。それはレビューが 1 件もない製品と見分けがつきません。これはどちらの場合も行を書き、結果を読める文章として status に入れます。空の結果は、行数を推し量るのではなく列を読んで見分けられるということです。

1 行に 2 つの粒度

ratingtitlereviewauthordate は 1 件のレビューを表します。aggregate_ratingreview_count は、そのレビューが載っている製品を表します。数百件の中の星 2 と 9 件の中の星 2 は別の事実であり、どちらを読んでいるかを教えてくれるのは後者の 2 列だけです。

4 つの並び順と、請求額を決める上限

参考になった順、新着順、評価の高い順、低い順--実行前に選びます。低い順に小さな上限を組み合わせれば、先頭の行が苦情になります。知っておく価値があるのは、上限が初期値 100 で埋まった状態で届くこと。すべて取るには、届いたままにするのではなく欄を空にする必要があります。

取得できる内容

10 列、
1 レビューにつき 1 行

各行は Capterra が表示しているとおりのレビューと、それが属する製品と、それを取ってきたクエリの結果を持ちます。

レビュー本文は前処理を一切かけずそのまま返ります。下の列一覧は、この系統としては珍しく裏付けが厚めです--プラットフォームが公開している配列、保存済み実行の JSON キー、そのワークブックのヘッダー行が、いずれも同じ 10 個の名前を同じ順序で持っています。パーサーを書く前に表の下の注記を読んでください。名前が確かなことと、値が分かっていることは別だからです。

データ辞書

10 列と、
それぞれの中身

プラットフォーム自身の列一覧をエクスポート順に並べ、実際の実行の JSON キーおよびワークブックのヘッダー行と突き合わせたものです。説明は各項目が何のためのものかを述べるだけで、形式については何も主張しません--下の注記をご覧ください。

query
ジョブが要求した Capterra の製品 URL を、そこから得られた各行に繰り返し記録したものです。入力した文字列だけでなく実際に取得したものを反映しており--選んだ並び順が付加されます--要求の記録であると同時に結合キーでもあります。
product
そのレビューが属する製品を、掲載が呼んでいるとおりに。
author
レビューを書いた人を、サイトが公開しているとおりに。完全な身元ではなく表示名です。
rating
その投稿者が付けた点数。尺度は仮定せず、自分の最初の数行から読み取ってください。
title
レビューの見出し--投稿者が説明の上に書く短い結論です。
review
レビューの自由記述本文。そのまま、未加工で入ります。
date
レビューが投稿された日。
aggregate_rating
そのレビューではなく製品の総合点。その製品に属する全行で繰り返されるため、多数の中の低評価と少数の中の低評価を見分けられます。
review_count
その総合点が何件のレビューに基づいているか--これも行ではなく製品の属性です。
status
クエリそのものがどう処理されたかを、読める文章で。最初に確認すべき列です。クエリがレビューを返さなかった場合でも行は届き、その理由がここに書かれます。

名前は確かです。値はここでは説明しません。それは意図的です。3 つの独立した情報源が同じ 10 個の名前を同じ順序で持っています--プラットフォームが公開している列の配列、保存済み実行の JSON キー、そのワークブックのヘッダー行。そのどれもが与えてくれないのがレビューそのものです。このスクレイパーの保存済み実行はいずれも、レビュー列が空のまま status にメッセージを載せて返ってきました。そのメッセージは、アンチボットの壁と住宅用プロキシに言及するものでした。プラットフォーム自身のフォーム上の注記も一般論として同じことを述べています--アンチボット系のサイトは、住宅用回線のみの無料プールではブロック状態を返す、と。ですからこのページは、日付の書式も、評価の尺度も、aggregate_ratingreview_count の形式も、どの列の充足率も主張しません。中身が観測されていないからです。代わりに伝えるのは、どこを見ればよいかです--無料枠で 1 製品を走らせ、残りの上に何かを組み立てる前に最初の行の status を読んでください。

実行の設定

設定はジョブ側で、
表計算ではなく

クエリごとの上限が、実行の費用とファイルに入る量を決めます。並び順は、その上限をどのレビューに使うかを決めます--どちらもジョブの開始前に選びます。

Capterra の製品 URL 1 行に 1 件 クエリごとの上限、初期値 100 すべて取るなら空にする 参考になった順 新着順 評価の高い順 評価の低い順 プロキシプール経由 CSV アップロード XLSX アップロード TXT アップロード Parquet アップロード
よくある使い方

ここで最もよく実行される
3つの仕事。

ソフトウェアレビューのデータを、現場が実際に抱えている問いに答えるために使っている例をいくつか。

プロダクト

自分のカテゴリの星 1 レビューを読む

競合する製品をすべて、評価の低い順で控えめな上限をかけて取得します。あるカテゴリで購入者が不満を述べる点は繰り返される傾向があり、その繰り返される不満は、自社の差別化点か、次のバグ報告のどちらかです。

プロダクト · リサーチ
競合

背後の件数で評価を重み付けする

各レビューの隣に aggregate_rating と review_count を残しておけば、4.5 という数字は単なる数字ではなくなります。称賛レビューが数件の新しい製品と、数千件を抱える定着した製品は比較になりません。このエクスポートは、それを同じ行の中で見えるようにします。

戦略
運用

分析の前に status 列を確認する

まず status で絞り込みます。レビューなしで返ってきたクエリも行は作っているので、この列にざっと目を通すだけで、本当に何もない製品と、通らなかったリクエストとを分けられます--どちらかが結論になってしまう前に。

データ · オペレーション
料金

実際に取得したレビューの
分だけお支払い。

サブスクリプションも、最低利用額も、毎月の請求もありません。最初の500行は当社負担 - その後は従量課金で、ここにある他のスクレイパーと同じ均一料金です。

無料枠

500 行無料 - 0 ドル

新規アカウントごとに初回のみ。クレジットカード不要。クエリごとの上限、すべての並び順、ファイルアップロード、すべてのエクスポート形式を含みます。

ずっと 0 ドル
従量課金

無料枠のあとは 1 行 0.002 ドル

1,000レビューあたり約 $2。事前見積もりが実行開始前に行数とクレジット費用を表示します - 想定外の請求も、換算が必要な計算ユニットもありません。

一番人気
大量利用

カスタム · 大量利用

継続的なモニタリングや非常に大規模な過去データの取得向けに、ボリューム料金、専用ワーカー、SLA をご用意します。ご希望の規模をお知らせいただければお見積もりします。

お問い合わせ
初回の有料実行が 10% オフ。お支払い時にコード LIVESCRAPER10 をご利用ください。
登録する
組み合わせて使う

同じ購入者を、
別のディレクトリで。

法律について

Capterra のレビュー
スクレイピングするのは合法か

短い答え--公開されているレビュー内容については合法です。そしてこのエクスポートには、掲載が既に示している以上の投稿者情報は含まれません。

Capterra のレビューは読まれるために公開されています。評価、見出し、レビュー本文、日付は、ログインの有無にかかわらず製品ページを開いた誰にでも表示されています。公開されている評判を調査目的で収集することは長く確立された実務であり、ここではログインもアカウントもペイウォールも一切扱いません。

投稿者の項目はサイト自身が公開しているもの、つまり完全な身元ではなく表示名です。この出力にメールアドレスも住所もありません。EU 域内でレビュー本文を処理する場合、その後の取り扱いには通常の規則がそのまま適用されます。

Capterra の利用規約は自動アクセスを制限しているため、これは法律の問題であると同時に契約の問題でもあります。同プラットフォームと契約関係がある場合は規約を確認してください。データ層でサードパーティのトラッカーは一切動かしておらず、エクスポートは 30 日で自動的に削除されます。

livescraper.app · 方針
公開レビュー内容のみ
ログインなし、アカウントに触れない
表示名であって身元ではない
既定で GDPR に沿った設計
エクスポートは自動削除(30日)
規模を広げる前に Capterra の利用規約を確認してください。
よくある質問

登録前によく
寄せられる質問。

最もよくいただく質問です。ほかにご不明な点は お問い合わせください - 回答を書いているのはボットではなく人間です。

Capterra のレビューはどうやって取得しますか?+
Capterra Reviews Scraper を使います。
  1. プラットフォームにサインインします。
  2. Capterra Reviews Scraper を開きます。
  3. Capterra の製品ページ URL を 1 行に 1 件ずつ貼り付けます。CSV、XLSX、TXT、Parquet ファイルのアップロードでも構いません。
  4. クエリごとの上限を設定します。すべて取るなら欄を空にします。
  5. 並び順を選びます--参考になった順、新着順、評価の高い順、低い順。
  6. Get Data をクリックします。
レビュー1件につき何が返りますか。+
10 列です。クエリ、製品、投稿者、評価、見出し、レビュー本文、日付、製品の総合評価、そのレビュー件数、そしてクエリ自体の status。
status 列は何のためにありますか?+
クエリがどう処理されたかを、読める文章で記録します。レビューを返さなかったクエリでも行は作られ、その理由は推測に委ねられるのではなくこの列に書かれます。何も言うことがない製品と、通らなかったリクエストとを分けてくれるのがこれです。
レビューなしで実行が返ってきたら?+
作られた行の status 列を読んでください。プラットフォーム自身のフォーム上の注記によれば、リクエストはプロキシプールを通り、アンチボット系のサイトは住宅用回線のみの無料プールではブロック状態を返します。大きな取得を計画する前に、無料枠で 1 製品を走らせてこの列を見てください。
製品のレビューをすべて取るにはどうしますか?+
上限の欄を空にしてください。初期値 100 が入った状態で提供されるため、何も触らない初回の実行は完全ではなく上限つきになります。空にするのは意図的な一手で、空にするとプレースホルダーは「all」になります。
レビューが返る順序を選べますか?+
はい。実行前に設定します--参考になった順、新着順、評価の高い順、低い順。並び順と上限を組み合わせることで、ほしい範囲だけを買えます。低い順にして上限を小さくすれば、苦情がファイルの先頭に来ます。
rating と aggregate_rating の違いは何ですか?+
rating はその 1 件のレビューの点数です。aggregate_rating は製品の総合点、review_count はそれが何件のレビューに基づくかで、どちらもその製品の全行で繰り返されます。両者を並べておくことが、1 件の低評価を平均の背後にある厚みと比べて量る手段になります。
料金はいくらですか。+
最初の500行は初回のみ無料で、クレジットカードは不要です。その後は1行 $0.002 - 1,000レビューあたり約 $2 - で、プラットフォーム上の他のスクレイパーと同じ均一料金です。実行を開始する前に、見積もりが費用を表示します。

最初の500レビューは、
当社のおごり

新規アカウントごとに初回のみ500行無料 - 有効期限はありません。その後は1行 $0.002 の従量課金で、お客様が決めるまでカード情報の登録は不要です。

すぐに有効 · カード不要

Capterra のソフトウェアレビューを大規模に取得する

Livescraper の Capterra Reviews Scraper は、ソフトウェア掲載のリストをレビューデータに変えます。Capterra の製品ページ URL を 1 行に 1 件入力するか、CSV、XLSX、TXT、Parquet でアップロードし、クエリごとの上限を設定するか、すべて取るなら空にして、並び順を選び、購入者が書いたものを整った CSV、Excel、JSON ファイルとしてダウンロードします。

各行は Capterra が表示しているとおりのレビュー--投稿者、評価、見出し、本文、日付--に加えて、それが属する製品と、その製品自体の総合評価およびレビュー件数を持ちます。1 行に 2 つの粒度があることが、このエクスポートを分析可能にしています。数千件の中の低評価と 9 件の中の低評価は別の事実であり、どちらを読んでいるかを教えてくれるのは製品側の 2 列だけです。

知っておく価値があるのは 10 番目の列です。status はクエリ自体がどう処理されたかを読める文章で記録し、レビューを返さなかったクエリも消えるのではなく行を作ります。これにより、静かな失敗が「絞り込める対象」に変わります--だからこそ、ここでの誠実な最初の一手は、無料枠で 1 製品を走らせてこの列を読むことであり、残りの上に何かを組み立てるのはその後です。

先に実務上の注記を一つ。このページは 10 列とその順序を説明しており、それはプラットフォームの公開一覧、実際の実行の JSON キー、そのワークブックのヘッダー行が完全に一致している点です。日付の書式も評価の尺度も充足率も主張していません。根拠となるレビューを含む保存済み実行がないためで、いずれもレビュー列が空のまま status にメッセージを載せて返ってきました。プラットフォーム自身も、アンチボット系のサイトは住宅用回線のみの無料プールではブロック状態を返すと注記しています。最初の 500 行は無料でクレジットカードも不要、以降は 1 行 0.002 ドルの均一料金です。