検索ツール群のほかのものと同じ形です。クエリの一覧、ロケール、そしてどこまでさかのぼるかを指定します。
各行にはそれを生んだクエリが付与されるため、監視リスト全体にわたる実行でも入力と突き合わせられます。
ニュース結果1件につき7つのフィールドで、それぞれ1行、各行にはそれを見つけ出したクエリが付与されます。
news.google.com上のGoogleリダイレクトです。たどれば解決しますが正規URLではないため、これで重複排除もドメインの読み取りもできません。titleとsourceを繰り返します。1記事につき7列 - 無料枠を含むすべてのプランで、上記のすべての列が返ります。
掲載順位の列はない点にご注意ください。結果が返った順序を知る必要がある場合は、エクスポートの行順を保持してください。あとから復元することはできません。
2つの列は名前から受ける印象とは違う振る舞いをします。知っていればどちらも問題になりませんが、知らないとどちらも厄介です。
linkはリダイレクトです。すべてのURLは媒体ではなくnews.google.com/rss/articles/…を指して返ります。たどれば記事に解決しますが正規のアドレスではありません。つまり実行をまたいでこれで重複排除することも、ドメインを取り出すことも、リダイレクトをたどらずにページを取得することもできません。媒体にはsourceを使い、実際のURLが必要ならリダイレクトを解決してください。
snippetは見出しの繰り返しです。要約ではありません。実際にはタイトルに続いて媒体名が入る形で返るため、ほかの列がすでに与えている以上の情報はほとんど含みません。説明文に対して感情分析やキーワード分析を行う予定だったのであれば、このフィールドは該当しません。正直に言えば、このサービスが分析対象として提供するのは見出しです。
よい知らせは、最も面倒を起こしそうな列がそうならないことです。dateはGMTの絶対タイムスタンプなので、データセットの日付を特定可能に保つために実行時の記録管理は不要です。
ニュースのジョブでは2つの設定がほとんどの仕事をします。検索する期間と、検索の起点となるロケールです。
言語と国は Google Search Scraperと同様に別々の設定です。ドイツ語の媒体が何を 言っているのかを尋ねることも、ドイツ国内で何が報じられているのかを尋ねることもでき、この2つは同じ 問いではありません。対応範囲は全言語・全国です。
1クエリあたり何ページ返すかも設定できます。これが費用を左右する正直なレバーです。 1クエリあたりの深さが増えれば、行数も増えます。
チームがニュース結果をどう使っているかの例をいくつか挙げます。
自社ブランド、経営陣、製品名を過去1日のフィルターで実行すれば、クリッピングサービスの契約なしに報道記録が手に入ります。sourceと絶対値のdateが全行に返るため、報じられたかどうかだけでなく、どの媒体が扱い、正確にいつだったのかまで分かります。
同じクエリを一定の間隔で再実行すれば、その差分がどの媒体が話題を取り上げ、どの順序だったのかを示します。誰が最初に報じ、誰が続いたのかというこの流れは、記事数よりも多くを語ることがほとんどです。
国と言語を意図的に設定すれば、同じクエリが特定の法域に絞った監視になります。規制やサプライチェーンの監視に有効です。こうした領域では、現地で報じられる内容が英語圏の報道に先行することがよくあります。
サブスクリプションも、最低利用額も、キーワード単位のライセンスもありません。最初の500行は無料。その後は従量課金です。
新規アカウントごとに1回限り。クレジットカードは不要です。すべてのスクレイパーが機能制限なしで使えます。監視リストを試し、規模を広げる前に深さを調整するには十分です。
1,000件あたりおよそ2ドルです。実行前の見積もり機能が件数とクレジット費用を開始前に示します。クエリ数×ページ数は急速に増えるため、ここでは確認しておく価値があります。
大規模な監視リストを短い間隔で回すチーム向けに、ボリュームディスカウント、SLA、専用ワーカー、個別のオンボーディングをご用意します。件数をお知らせいただければお見積もりします。
LIVESCRAPER10をご利用ください。ニュースはGoogleが返す領域の1つです。あるテーマを追うチームは、たいてい複数の領域を見ています。
短い答えは、結果ページについては「はい」です。ただし記事そのものについては、区別しておく価値のある点が1つあります。
ニュースの結果ページは公開情報です。Googleはクエリに対する見出し、スニペット、リンクを、ログインの有無を問わず誰にでも表示します。公開されている結果をメディア監視や調査のために収集することは長く確立された実務であり、データが公開されていて処理がサイトを妨げない限り、それを禁じる連邦法はありません。
区別すべき点はこうです。得られるのは見出しとスニペットとリンクであって、記事ではありません。報道を監視すること、言及数を数えること、どの媒体が何を扱ったかを分析すること、スニペットを読むことは通常の利用です。記事を再公開すること、あるいはそこから相当量の本文を再現することは、お客様と発行元との間の著作権の問題であり、リンクはまさに読者が出典へ向かうために存在します。ページがそうでないかのように匂わせるよりは、そう申し上げます。
Googleの利用規約も自動アクセスを制限しているため、これは規約の問題でもあります。私たちはログインやペイウォールの背後にあるものには一切触れず、データ層で第三者のトラッカーを動かすこともなく、エクスポートは30日で自動削除されます。
特によくいただく質問です。ほかにご不明な点があればご連絡ください。回答を書いているのはボットではなく人間です。
query、title、source、date、link、snippet、imageで、それを見つけ出したクエリ、見出し、掲載媒体、GMTの絶対公開日時、リンク、スニペット、記事のメイン画像にあたります。掲載順位の列はないため、結果の順序が重要ならエクスポートの行順を保持してください。linkがGoogleのリダイレクトだからです。すべてのURLは媒体自身のアドレスではなくnews.google.com/rss/articles/…を指します。たどれば記事に解決しますが正規URLではないため、実行をまたいで重複排除することも、ドメインを取り出すこともできません。媒体にはsourceを使い、実際のURLが必要な運用ならリダイレクトを解決してください。LivescraperのGoogle検索ニューススクレイパーは、クエリの一覧を報道データに変えます。監視したい語を貼り付け、1回の実行につき最大千件まで指定し、言語、国、期間を設定し、1クエリあたり何ページ返すかを選び、結果をCSV、JSON、Excelでダウンロードします。
各行は7つのフィールドを持ちます。記事を見つけ出したクエリ、見出し、掲載媒体、公開日時、リンク、スニペット、記事のメイン画像です。実務上の注意が2つあり、聞こえる以上に重要です。日時は相対表記の「3日前」ではなくGMTの絶対タイムスタンプなので、実行時の記録管理なしにエクスポートの日付を無期限に特定できます。そしてリンクは発行元自身のアドレスではなくnews.google.comを指すGoogleのリダイレクトです。たどれば解決しますが正規URLではないため、媒体にはsource列を使い、実際のURLが必要ならリダイレクトを解決してください。
期間フィルターこそが、これを検索から監視へと変えるものです。過去1時間と過去1日は実行を小さく保ち、結果を本当に新しいものにします。それが日次のブランド監視を現実的にします。言語と国は別々の設定なので、ドイツ語の媒体が何を言っているのかを尋ねることと、ドイツ国内で何が報じられているのかを尋ねることは別のクエリです。現地の報道が英語圏の報道に先行することが多い規制やサプライチェーンの監視で役立ちます。
コミュニケーション担当のチームは、ブランド、経営陣、製品の語を過去1日のフィルターで実行し、クリッピングサービスの契約なしに報道記録を得ます。source列がどの媒体がどの話題を扱ったかを示します。競合分析のチームは一定の間隔でクエリを再実行し、その差分から誰がいつ話題を取り上げたのかを読み取ります。絶対日時のおかげでそれが容易になります。返るのは記事本文ではなく、見出し、媒体、日時、画像、リンクです。リンクは読者が発行元にたどり着くために存在します。まずは無料でお試しください。最初の500行は費用がかからず、クレジットカードも不要です。