入力は ZoomInfo の企業ページそのもの - 会社を開いたときに得られる zoominfo.com/c/<slug>/<id> の URL です。
1 社につき 1 行で、それぞれどのクエリから来たかのラベルが付きます。すべてのリクエストはご自身のアドレスではなくプロキシプールを経由します - ただし下のレジデンシャルプロキシに関する注記を読んでください。ここでは既定のプールでは Cloudflare を通過できません。
市・州・国が所在地の行と並んでそれぞれ専用の列を持つため、アカウントを地域でグループ化する作業が単一フィールドへの文字列の切り貼りから始まりません。
ウェブサイトが専用の列にあり、CRM と突き合わせるならこのフィールドです。社名はシステムごとに違いますが、ドメインはたいてい違いません。
プロフィール URL を 1 つ入れると 1 行が出てきて、それを生んだクエリのラベルが付きます。アカウントのリストはアカウントのリストのまま - あとで突き合わせ直す作業は発生しません。
下の列の一覧は確かです。セルに何が入っているかについて、このページは推測しません。その理由には 2 段落を割く価値があります。
14 の名前とその順序は二重に確認されています。実際の実行エクスポートのヘッダー行と、このスクレイパーの公開された列一覧です。両者は完全に一致しており、これはこのサイトの他のどのデータ辞書にも課している基準と同じです。
持っていないのは、データの入ったエクスポートです。ZoomInfo は Cloudflare で保護されており、ここに保管されている実行はすべてレジデンシャルプロキシなしで行われたため、ワークブックはヘッダー行だけでその下には何もない状態で返ってきました。つまりこのページは、各列が何のためのものかは伝えられますが、その値がどんな形をしているかは伝えられません。推測はしません。ですから以下に型も単位も通貨も例も見つかりません。ご自身のレジデンシャルプロキシを用意し、ジョブを 1 回実行して、そこから値を読んでください。
エクスポートのヘッダー行を、その順序で。説明は各フィールドが何のためのものかを述べるだけで、その形式、単位、値の種類については意図的に何も主張していません - 上の注記をご覧ください。
これを土台にする前に片づけるべきことが 2 つあります。上の列の集合は確かです - エクスポートの XLSX ヘッダー行と公開された列一覧が、この順序で 14 の名前すべてについて一致しています。確かでないのはセルの中身です。手元にあるエクスポートは下に行のないヘッダーなので、このページは型も単位も値の種類も述べません。あなたのスキーマも、実際に 1 回実行するまでは同じであるべきです。employees、revenue、founded は最も型を付けたい 3 つであり、まさに私たちが型を付けられない 3 つです。そして実行にはレジデンシャルプロキシが必要です。ZoomInfo は Cloudflare の背後にあります。プロキシがなければジョブは完了して何も返さず、それは壊れたスクレイパーのように見えますが、壊れてはいません。
クエリごとの上限が、1 回の実行の費用とファイルに入る量を決めます。企業リストの渡し方と合わせて、ジョブを開始する前に選びます。
チームが企業属性データの行を使って、実際に抱えている問いに答えている例をいくつか。
社名くらいしか入っていない CRM のエクスポートが、ウェブサイト、業種、従業員数、所在地の入った表になります。社名ではなくウェブサイトの列で突き合わせれば、統合作業は現実との接触に耐えます。
市・州・国が別々の列で届くので、リストをテリトリーに分けるのはパースの作業ではなく group by で済みます。番地が必要なときのために、所在地の行もそのまま残っています。
従業員数、売上高、業種がどの行でも隣り合っており、誰かがそれを相手にリストを組み始める前にセグメントの形を見るにはそれで十分です。
サブスクリプションも、最低利用額も、毎月の請求もありません。最初の 500 行は当社負担です。その後は従量課金で、ここにある他のスクレイパーとまったく同じ均一料金です。
新規アカウントごとに初回 1 回。クレジットカード不要。クエリごとの上限、ファイルアップロード、すべての書き出し形式を含みます。
1,000 社でおよそ 2 ドル。事前の見積り表示が、実行を開始する前に行数とクレジット費用を示します。想定外の請求も、換算の必要な計算ユニットもありません。
継続的なモニタリングや非常に大きな過去データの取得のための、ボリューム料金、専用ワーカー、SLA。ご要望の規模をお知らせいただければお見積りします。
LIVESCRAPER10 をご利用ください。短い答え:企業プロフィールのページは公開されており、これはそれ以外を読みません。ただし ZoomInfo は有料のデータベースであり、その事実がこのサイトの他のどこよりも答えを左右します。
zoominfo.com/c/<slug>/<id> にある ZoomInfo の企業プロフィールは、開いた人には誰にでも表示され、ページは検索エンジンにインデックスされています - ほとんどの人はそこ経由でたどり着きます。このスクレイパーはその公開ページを読み、それ以外は読みません。サインインもせず、あなたの認証情報も使わず、アカウントにも触れません。この最後の点ははっきり言っておく価値があります。このサイトの Apollo スクレイパー は実際にご自身のアカウントに対して動くもので、両者は取り違えやすいからです。
ここで違うのは、そのページを公開しているのが誰かという点です。ZoomInfo はこのデータを販売しており、利用規約は自動アクセスを制限しています。したがってこれは法律の問題であると同時に規約の問題でもあり、マーケットプレイスやレビューサイトの場合よりも輪郭がはっきりしています。あなたの組織が ZoomInfo の顧客であれば、締結した契約こそが何をしてよいかを定める文書であり、このページに書かれているどんな内容よりも優先します。前面に Cloudflare が置かれていることは、その立場の実務上の表れです。レジデンシャルプロキシがなければ、このスクレイパーは何も返しません。
返る行は人ではなく企業のレコードであり、その大半は個人データの問題の外にあります - ただし phone はやはり電話番号であり、EU では識別可能な個人につながる連絡先番号は、どの列で届こうと個人データです。分析の対象が企業属性であれば、取り込み時にその列を捨ててください。そうすればこの問題はあなたのものではなくなります。当社はデータ層でサードパーティのトラッカーを一切動かしておらず、書き出したファイルは 30 日で自動的に削除されます。
最もよくいただく質問です。ほかにもあれば ご連絡ください - 回答を書いているのはボットではなく人間です。
Livescraper の ZoomInfo スクレイパーは、企業プロフィールのページを企業属性データの行に変えます。zoominfo.com の企業プロフィール URL を送信し - 1 行に 1 件ずつ入力するか、CSV、XLSX、TXT、Parquet ファイルとしてアップロードします - 必要ならクエリごとに行数を制限し、結果をきれいな CSV、Excel、JSON としてダウンロードできます。1 社につき 1 行が、それを生んだクエリのラベル付きで返ります。
各行は 14 列を運びます。クエリ、会社とそのウェブサイト、電話番号、従業員数と売上高、業種、設立時期、市・州・国をそれぞれ独立した列に分けた所在地の行、株式ティッカー、ロゴ。14 列すべてが JSON だけでなくワークブックにも入ります。
セールスオペレーションのチームは、アカウントリストの穴を埋めるためにこれを使い、社名ではなくウェブサイトの列で突き合わせます。ドメインはシステム間の統合に耐えますが、名称は耐えないからです。計画チームは、分割された市・州・国の列を使って担当アカウントをテリトリーごとに切り分けます。調査に携わる人は、従業員数、売上高、業種を並べて、誰かがそれを相手にリストを組み始める前にセグメントの規模を測ります。
これを土台にする前に知っておくべきことが 2 つあります。このスクレイパーにはレジデンシャルプロキシが必要です。ZoomInfo は Cloudflare の背後にあり、プロキシがなければ実行はエラーを出すのではなく、完了して何も返しません。そして、ここに保管されているエクスポートがどれもデータのないヘッダー行として返ってきたため、このページは 14 列の名前を挙げてそれぞれが何のためのものかを述べる一方、いずれについても型や単位や形式を主張しません。これは覆い隠すよりも明言したい抑制です。無料で始められます。最初の 500 行は費用もクレジットカードも不要で、その後は 1 行 0.002 ドルの均一料金です。