入力は、あなたのリストにすでにあるものです。屋号、ウェブサイト、完全なURL - 3つとも同じ欄に、1行に1件で入れられます。
各行には由来したクエリが付きます。ここではそれが普段以上に重要です。1つのクエリが複数の企業に一致しうるからです。
3つとも同じ欄で受け付けます。1行に1件、またはCSV、XLSX、TXT、Parquetでのアップロードでも構いません。それがこのスクレイパーの意義です。手元のリストが最初から整ったCrunchbaseリンクであることはまずなく、それをリンクに変えるのがここです。
検索は名寄せではありません。複数の企業に一致するクエリは複数の行を生み、それぞれに由来したクエリが付きます - 曖昧さがそのまま見えるので、黙ってひとつの答えが選ばれるのではなく、あなたが判断できます。
CrunchbaseはCloudflareの背後にあり、データセンターのアドレスには応じません。このスクレイパーはジョブに設定されたレジデンシャルプロキシを必要とし、それがなければ実行は完了しても何も返しません。空のエクスポートで気づくより、ここで読んでいただくほうがよいと考えています。
各行は、Crunchbaseがあなたのクエリに一致させた企業です。保持されている名称、プロフィールへのリンク、パーマリンク、短い説明、そしてエンティティ種別。
下の列一覧は実際の実行エクスポートのヘッダー行であり、実行画面が描画する列配列によって裏付けられています - 両者は完全に一致します。ただしそれはサンプルではありません。これらのフィールドに対してコードを書く前に表の下の注記をお読みください。このスクレイパーについて何を確認できて何を確認できていないかが、そこに明記してあります。
名称は正確です - ワークブックのヘッダー行と実行画面の列配列であり、両者は一致しています。説明は各列が何のためのものかを述べます。書式については述べておらず、その理由は表の下の注記にあります。
上の表をもとに計画を立てる前に、これをお読みください。 このスクレイパーについて当社が保有する実行エクスポートは、すべて空で返ってきました - 2026年6月30日から7月15日にかけての4回の実行で、いずれもこのヘッダー行だけがあり、その下にデータ行はありません。原因は不具合ではありません。CrunchbaseはCloudflareの背後にあり、レジデンシャルプロキシなしの実行は完了しても何も返しません。したがって6つの名称は確かです - 独立した2つの情報源がこの順序で挙げています - が、ここにあるそれ以外は確かではありません。特に、permalink の書式も、entity_type の語彙も、1つのクエリが何件一致するかも、どの順序で返るかも、当社はお伝えしません。次の当然の一手は crunchbase_url を Crunchbaseスクレイパー に渡して完全なプロフィールを取ることであり、2つはそのための組み合わせです - ただし両者をつなぐ前に、ご自身の最初のファイルの形をご確認ください。ご自身のプロキシを設定した無料枠の実行を1社に向け、返ってきたものをお読みください。
このスクレイパーにはクエリ欄のほかに設定が一つだけあります - 1クエリあたりの行数上限で、ここでは1回の検索から取る一致件数の上限になります。あとは、リストをどう渡すかと、ジョブがどのプロキシを経由するかです。
手元の企業リストがまだリンクのリストになっていないとき、チームが何をするかの例をいくつか挙げます。
屋号やウェブサイトが並んだ表では、何も照会できません。1回の実行でそれぞれにCrunchbaseの識別子とプロフィールリンクが付き、以降のどの工程もそれを必要とします。
1つのクエリが「最有力の1件」ではなく一致ごとの行を返すので、行そのものがどの名前が曖昧かを教えてくれます。取り違えを今気づくか、あとでレポートの中で見つけるかの違いです。
まず検索、次にプロフィール。ここでリストを名寄せし、得られたCrunchbaseリンクをCrunchbaseスクレイパーに渡せば、各社の16列の完全なプロフィールが得られます。
サブスクリプションなし、最低利用額なし、継続請求なし。最初の500行は当社負担です。それ以降は従量課金で、ここにある他のスクレイパーとまったく同じ均一料金です。
すべての新規アカウントに初回限定で。クレジットカード不要。クエリ単位の上限、ファイルアップロード、すべてのエクスポート形式を含みます。このスクレイパーに必要なプロキシは、無料枠でもその後でも、お客様側でご用意いただきます。
プラットフォーム上の他のすべてのスクレイパーと同じ均一料金です。ここでの1行はクエリではなく一致である点にご注意ください。曖昧な名前は、明確な名前より費用がかかります。実行前に見積もりが費用を表示します。
継続的なモニタリングや非常に大規模な過去データ取得に向けた、ボリューム料金、専用ワーカー、SLA。ご希望の規模をお知らせいただければお見積もりします。
LIVESCRAPER10 をご利用ください。短い答え:あなたが読んでいるのは公開された検索結果です - そしてここでの制約は、プライバシーではなく技術面と規約面にあります。
Crunchbaseの検索結果は、ログインの有無にかかわらず検索を実行した誰にでも表示されます。会社名、リンク、1行の説明、種別は読まれるために公開されています。公開されている企業情報を調査目的で収集することは長年の確立した実務であり、ここではログインもペイウォールも一切扱いません。
このエクスポートは個人データではなく事業者データです - 企業と、そのプロフィールへの手がかりであって、氏名を持つ個人ではありません。レビューやプロフィールのエクスポートより軽い義務ですが、ゼロではありません。一人会社はやはり個人ですし、エンティティ種別の列が存在するのは、Crunchbase上のすべてが企業とは限らないからです。当社はその値を見ていないので、想定外の値が出たら決めつけず慎重に扱ってください。
計画に織り込むべき制約はCrunchbase側のものです。同サイトはCloudflareによって能動的に保護されており、利用規約は自動アクセスを制限しています - したがってこれは技術の問題であると同時に規約の問題でもあり、同社との契約やAPI利用がある場合は、規模を拡大する前に確認してください。当社はデータ層でサードパーティのトラッカーを一切動かしておらず、エクスポートは30日後に自動削除されます。
最も多くいただく質問です。ほかにご不明な点は? お問い合わせください - 回答を書くのはボットではなく人間です。
LivescraperのCrunchbase検索スクレイパーは、実際に手元にあるリストをCrunchbaseの識別子に変えます。会社名、ドメイン、URLを - 1行に1件入力するか、CSV、XLSX、TXT、Parquetファイルとしてアップロードして - 送信し、必要ならクエリごとの一致件数に上限を設けて、結果をきれいなCSV、Excel、JSONファイルとしてダウンロードします。3つの入力形式はすべて同じ欄に入り、そこが要点です。屋号やウェブサイトのリストは、名寄せされるまで何も照会できません。
各行は一致した企業です。送信したクエリ、Crunchbaseが保持する名称、プロフィールへのリンク、パーマリンク、短い説明、エンティティ種別。出力はクエリごとではなく一致ごとに1行なので、曖昧な名前は複数行を生み、ひとつの答えが勝手に選ばれるのではなく曖昧さがそのまま見えます。各行に自分のクエリが付いているので、入力リストへのグループ化も簡単です。
これは組み合わせのうち「検索」側です。検索でリストを名寄せしたあと、Crunchbaseスクレイパーが各組織ページを読み、16列の完全なプロフィール - 設立日、従業員数、業種、所在地、ランク、事業ステータス、SNSリンク - を返します。まず検索、次にプロフィール。多くのチームがこの順で使っています。
始める前に知っておくべきことが2つあります。CrunchbaseはCloudflareで保護されており、このスクレイパーは何かを返すためにレジデンシャルプロキシを必要とします。それがなければジョブは正常に終了し、エクスポートにはヘッダー行だけが含まれてデータはありません。そしてこのページは、どのフィールドについても例示値も書式も公開していません - パーマリンクの形も、エンティティ種別の語彙も、1つのクエリが何件一致するかも - 当社が保有する実行エクスポートがすべて0行を返したからであり、見ていない値は載せる価値のある値ではないからです。6つの列名は正確で相互に確認されています。それ以外は、あなたの最初の無料枠の実行が教えてくれます。無料で始められます。最初の500行は費用もクレジットカードも不要です。