Extracteur d'Actualités Google

La couverture médiatique,
en lignes.

Soumettez vos requêtes et récupérez les résultats d'actualité - titre, le média qui l'a publié, une date de publication absolue, un lien et l'image principale de l'article. Filtrez sur la dernière heure, le dernier jour, la dernière semaine, le dernier mois ou la dernière année, dans toutes les langues et tous les pays, et regroupez jusqu'à mille requêtes en une seule exécution.

500 lignes gratuites, une seule foispuis 0,002 $ par lignetoutes langues et tous paysCSV · JSON · Excel
Comment ça marche

Des requêtes en entrée,
de la couverture en sortie.

La même forme que le reste de la boîte à outils de recherche - une liste de requêtes, une locale, et jusqu'où vous voulez remonter.

  1. ÉTAPE 1Connectez-vous à la plateforme.
  2. ÉTAPE 2Ouvrez l'Extracteur d'Actualités Google.
  3. ÉTAPE 3Collez vos requêtes - jusqu'à 1 000 par exécution.
  4. ÉTAPE 4Réglez la langue, le pays et la plage de dates.
  5. ÉTAPE 5Choisissez le nombre de pages par requête.
  6. ÉTAPE 6Choisissez votre format et cliquez sur Get Data.

Chaque ligne porte la requête qui l'a produite, une exécution sur toute une liste de veille se réconcilie donc toujours avec votre entrée.

Ce que vous récupérez

Chaque colonne,
décrite proprement.

Sept champs par résultat d'actualité, une ligne chacun, chaque ligne étiquetée avec la requête qui l'a fait remonter.

query
Le terme de recherche qui a produit ce résultat, répété sur chaque ligne qu'il a renvoyée.
title
Le titre tel que publié.
source
Le média qui a publié l'article. Parfois un simple domaine, parfois un nom de marque - le format n'est pas cohérent, ne l'analysez donc pas comme un domaine.
date
Quand l'article a été publié, sous forme d'horodatage GMT absolu. Pas un « il y a 3 jours » relatif, un export reste donc datable indéfiniment.
link
URL de l'article - une redirection Google sur news.google.com plutôt que l'adresse propre de l'éditeur. Elle se résout quand on la suit, mais n'est pas canonique, vous ne pouvez donc ni dédupliquer dessus ni en extraire un domaine.
snippet
Texte affiché à côté du résultat. En pratique le titre suivi du nom du média, il reprend donc title et source au lieu de résumer l'article.
image
L'image principale de l'article, sous forme d'URL directe sur les serveurs de l'éditeur.

7 colonnes par article - chaque colonne ci-dessus sur toutes les offres, y compris la gratuite.

Notez qu'il n'y a pas de colonne de position dans le classement. S'il vous faut connaître l'ordre dans lequel les résultats sont revenus, conservez l'ordre des lignes de l'export - il n'est pas récupérable ensuite.

Bon à comprendre

Le lien n'est pas l'URL
de l'éditeur.

Deux colonnes se comportent autrement que leur nom ne le laisse croire. Aucune n'est un problème une fois qu'on le sait ; les deux sont gênantes sinon.

link est une redirection. Chaque URL revient en pointant vers news.google.com/rss/articles/… plutôt que vers le média. Elle se résout vers l'article quand on la suit, mais ce n'est pas l'adresse canonique - ce qui signifie que vous ne pouvez pas dédupliquer dessus d'une exécution à l'autre, ni en extraire un domaine, ni récupérer la page sans suivre le saut. Utilisez source pour le média et résolvez la redirection s'il vous faut l'URL réelle.

snippet reprend le titre. Ce n'est pas un résumé. En pratique il revient sous la forme du titre suivi du nom du média, il n'apporte donc quasiment aucune information que les autres colonnes ne donnent déjà. Si vous comptiez lancer une analyse de sentiment ou de mots-clés sur une description, ce n'est pas ce champ - la réponse honnête est que ce service vous donne des titres à analyser.

La bonne nouvelle, c'est que la colonne la plus susceptible de poser problème n'en pose pas : date est un horodatage GMT absolu, aucune comptabilité à l'exécution n'est donc nécessaire pour garder un jeu de données datable.

livescraper.app · comportement des colonnes
Les dates n'arrivent jamais sous la forme « il y a 2 heures »
Le nommage des médias est incohérent - domaine ou marque
Les images principales pointent directement vers l'éditeur
Les liens d'article redirigent via Google!
Les extraits redoublent le titre et le média!
Résolvez le lien s'il vous faut l'URL canonique.
Contrôles de périmètre

Jusqu'où remonter,
et depuis où.

Deux réglages font l'essentiel du travail sur un job d'actualité - la fenêtre que vous interrogez, et la locale depuis laquelle vous interrogez.

Dernière heure Dernier jour Dernière semaine Dernier mois Dernière année

La langue et le pays sont des réglages distincts, comme sur l' Google Search Scraper - vous pouvez donc demander ce que disent les médias germanophones, ou ce qui se dit en Allemagne, et ce ne sont pas les mêmes questions. La couverture s'étend à toutes les langues et tous les pays.

Vous pouvez aussi définir le nombre de pages à renvoyer par requête, et c'est le vrai levier sur le coût : plus de profondeur par requête signifie plus de lignes.

Cas d'usage courants

Trois tâches que l'on
exécute le plus souvent ici.

Quelques exemples d'utilisation des résultats d'actualité par les équipes.

Relations presse

Surveillez votre propre couverture

Lancez votre marque, vos dirigeants et vos noms de produits avec un filtre sur le dernier jour et vous obtenez une revue de presse sans abonnement à un service de coupures. Comme source et une date absolue reviennent sur chaque ligne, vous voyez non seulement si l'on a parlé de vous, mais quels médias l'ont fait et exactement quand.

Communication · RP
Concurrence

Suivez un sujet à mesure qu'il se propage

Relancez la même requête à une cadence fixe et l'écart montre quels médias ont repris un sujet, et dans quel ordre. Cette progression - qui a publié en premier, qui a suivi - est généralement plus instructive que le nombre d'articles.

Veille de marché
Risque

Surveillez un marché par juridiction

Réglez le pays et la langue délibérément et la même requête devient une veille propre à une juridiction. Utile pour le suivi réglementaire et de chaîne d'approvisionnement, où ce qui est rapporté localement précède souvent tout ce qui paraît dans la presse anglophone.

Recherche · Conformité
Tarifs

Ne payez que les lignes
que vous extrayez vraiment.

Sans abonnement, sans minimum, sans licence par mot-clé. Vos 500 premières lignes sont offertes - ensuite, paiement à l'usage.

Offre gratuite

500 lignes gratuites - 0 $

Chaque nouveau compte, une seule fois. Sans carte bancaire. Tous les extracteurs débloqués, fonctionnalités complètes - de quoi tester une liste de veille et calibrer la profondeur avant de passer à l'échelle.

0 $ pour toujours
Paiement à l'usage

0,002 $ par ligne, après l'offre gratuite

Environ 2 $ pour 1 000 résultats. L'estimateur préalable affiche le décompte et le coût en crédits avant le démarrage - cela vaut un coup d'œil ici, car requêtes × pages se multiplie vite.

Le plus populaire
Enterprise

Sur mesure · veille continue

Tarifs au volume, SLA, workers dédiés et accompagnement sur mesure pour de grandes listes de veille à cadence soutenue. Donnez-nous vos chiffres et nous vous ferons un devis.

Parlons-en
10 % de remise sur votre première exécution payante.Utilisez le code LIVESCRAPER10 au paiement.
S'inscrire
Se combine bien avec

Les mêmes requêtes,
une verticale différente.

L'actualité est l'une des verticales que Google renvoie. Les équipes qui suivent un sujet en surveillent généralement plusieurs.

Le volet juridique

Est-il légal de collecter
des résultats d'actualité ?

Réponse courte : oui pour la page de résultats - avec une distinction à poser sur les articles eux-mêmes.

Une page de résultats d'actualité est publique. Google montre à tout le monde les titres, extraits et liens correspondant à une requête, connecté ou non. Collecter des résultats publiquement visibles à des fins de veille média et de recherche est une pratique établie de longue date, et tant que les données sont accessibles publiquement et que le processus ne perturbe pas le site, aucune loi fédérale ne l'interdit.

La distinction : ce que vous obtenez, c'est un titre, un extrait et un lien - pas l'article. Surveiller la couverture, compter les mentions, analyser quels médias ont publié quoi et lire les extraits sont des usages ordinaires. Republier un article, ou en reproduire une part substantielle du texte, est une question de droit d'auteur entre vous et l'éditeur, et le lien est là précisément pour que les lecteurs aillent à la source. Nous préférons le dire plutôt que de laisser la page suggérer le contraire.

Les conditions de Google restreignent également l'accès automatisé, c'est donc aussi une question de conditions d'utilisation. Nous ne touchons à rien derrière une authentification ou un paywall, n'exécutons aucun traceur tiers sur la couche de données, et vos exports s'auto-suppriment au bout de 30 jours.

livescraper.app · résultats et articles
Surveiller la couverture est un usage ordinaire
Compter les mentions par média est un usage ordinaire
Analyser titres et extraits est un usage ordinaire
Republier un article relève de la décision de l'éditeur!
Titres, extraits et liens - jamais derrière un paywall.
Questions fréquentes

Ce que l'on demande
avant de s'inscrire.

Les questions que nous entendons le plus. Autre chose ? Parlons-en - les réponses sont écrites par des humains, pas par des bots.

Comment extraire les résultats Google Actualités ?+
Avec l'Extracteur d'Actualités Google :
  1. Connectez-vous à la plateforme.
  2. Ouvrez l'Extracteur d'Actualités Google.
  3. Collez vos requêtes - jusqu'à 1 000 par exécution.
  4. Réglez la langue, le pays et la plage de dates.
  5. Choisissez le nombre de pages par requête.
  6. Choisissez votre format et cliquez sur Get Data.
Quelles données reviennent pour chaque article ?+
Sept champs : query, title, source, date, link, snippet et image - la requête qui l'a fait remonter, le titre, le média qui l'a publié, une date de publication GMT absolue, un lien, un extrait et l'image principale de l'article. Il n'y a pas de colonne de position dans le classement, conservez donc l'ordre des lignes de l'export si l'ordre des résultats compte pour vous.
Pourquoi le lien ne mène-t-il pas à l'éditeur ?+
Parce que link est une redirection Google - chaque URL pointe vers news.google.com/rss/articles/… plutôt que vers l'adresse propre du média. Elle se résout vers l'article quand on la suit, mais n'est pas canonique, vous ne pouvez donc pas dédupliquer dessus d'une exécution à l'autre ni en extraire un domaine. Utilisez source pour le média, et résolvez la redirection si votre flux de travail a besoin de l'URL réelle.
Jusqu'où puis-je remonter dans le temps ?+
Vous pouvez filtrer sur la dernière heure, le dernier jour, la dernière semaine, le dernier mois ou la dernière année. La dernière heure et le dernier jour sont ce qui rend l'outil utilisable comme dispositif de veille et pas seulement comme moteur de recherche - une fenêtre serrée garde les exécutions courtes et les résultats réellement nouveaux.
Puis-je chercher des actualités non anglophones ?+
Oui - toutes les langues et tous les pays, et ce sont deux réglages distincts. Demander ce que disent les médias germanophones est une question différente de ce qui se dit en Allemagne, et vous pouvez poser l'une comme l'autre.
Combien de requêtes puis-je lancer d'un coup ?+
Jusqu'à 1 000 requêtes par exécution. Chaque ligne renvoyée porte la requête qui l'a produite, un export peut donc couvrir toute une liste de veille sans perdre quel résultat appartient à quel terme.
Est-ce que j'obtiens le texte intégral de l'article ?+
Non - vous obtenez le titre, l'extrait que Google affiche, et le lien. C'est ce que contient une page de résultats. Lire et analyser des extraits relève de la veille média ordinaire ; le lien est là pour que vous ou vos lecteurs alliez chez l'éditeur pour l'article lui-même.
Combien cela coûte-t-il ?+
Les 500 premières lignes sur un nouveau compte sont gratuites et offertes une seule fois ; ensuite c'est 0,002 $ par ligne, au paiement à l'usage et sans abonnement. Rappelez-vous que les requêtes se multiplient par les pages, l'estimateur vaut donc la lecture. Voir les tarifs pour les prix au volume.

Démarrez une liste de veille, gratuitement.

500 lignes gratuites en une fois sur chaque nouveau compte - sans expiration. Ensuite c'est 0,002 $ par ligne, au paiement à l'usage - aucune carte enregistrée tant que vous ne le décidez pas.

Activation immédiate · sans carte bancaire

Extraire les résultats Google Actualités à grande échelle

L'Extracteur d'Actualités Google de Livescraper transforme une liste de requêtes en données de couverture médiatique. Vous collez les termes à surveiller - jusqu'à mille par exécution - réglez la langue, le pays et la plage de dates, choisissez le nombre de pages à renvoyer par requête, et téléchargez les résultats en CSV, JSON ou Excel.

Chaque ligne porte sept champs : la requête qui a fait remonter l'article, le titre, le média qui l'a publié, la date de publication, un lien, un extrait et l'image principale de l'article. Deux remarques pratiques comptent plus qu'il n'y paraît. La date est un horodatage GMT absolu plutôt qu'un « il y a 3 jours » relatif, un export reste donc datable indéfiniment sans aucune comptabilité à l'exécution. Et le lien est une redirection Google pointant vers news.google.com plutôt que vers l'adresse propre de l'éditeur - elle se résout quand on la suit, mais elle n'est pas canonique : utilisez la colonne source pour le média et résolvez la redirection s'il vous faut l'URL réelle.

Le filtre de plage de dates est ce qui transforme cela d'une recherche en une veille. La dernière heure et le dernier jour gardent les exécutions courtes et les résultats réellement nouveaux, ce qui rend praticable une veille de marque quotidienne. La langue et le pays sont des réglages distincts : demander ce que disent les médias germanophones est donc une requête différente de demander ce qui se dit en Allemagne - utile pour le suivi réglementaire et de chaîne d'approvisionnement, où la presse locale devance fréquemment la presse anglophone.

Les équipes communication lancent des termes de marque, de dirigeants et de produits avec un filtre sur le dernier jour et obtiennent une revue de presse sans abonnement à un service de coupures, la colonne source indiquant quels médias ont publié chaque sujet. Les équipes concurrence relancent une requête à une cadence et lisent l'écart pour voir qui a repris un sujet et quand, ce que les dates absolues rendent simple. Ce qui revient, ce sont des titres, des médias, des dates, des images et des liens plutôt que le texte des articles - le lien est là pour que les lecteurs atteignent l'éditeur. Commencez gratuitement : vos 500 premières lignes ne coûtent rien et ne demandent aucune carte bancaire.