Extractor de Noticias de Google

La cobertura informativa,
como filas.

Envíe sus consultas y reciba los resultados de noticias: titular, el medio que la publicó, una fecha de publicación absoluta, un enlace y la imagen principal del artículo. Filtre por la última hora, día, semana, mes o año, en cualquier idioma y cualquier país, y agrupe hasta mil consultas en una sola ejecución.

500 filas gratis por única vezdespués, 0,002 $ por filatodos los idiomas y paísesCSV · JSON · Excel
Cómo funciona

Consultas dentro,
cobertura fuera.

La misma forma que el resto del conjunto de herramientas de búsqueda: una lista de consultas, una configuración regional y hasta qué punto atrás quiere mirar.

  1. PASO 1Inicie sesión en la plataforma.
  2. PASO 2Abra el Extractor de Noticias de Google.
  3. PASO 3Pegue sus consultas: hasta 1.000 por ejecución.
  4. PASO 4Fije idioma, país y rango de fechas.
  5. PASO 5Elija cuántas páginas por consulta.
  6. PASO 6Elija su formato y pulse Get Data.

Cada fila lleva la consulta que la produjo, así que una ejecución sobre toda una lista de vigilancia sigue reconciliándose con su entrada.

Lo que recibe

Cada columna,
descrita con claridad.

Siete campos por resultado de noticias, una fila cada uno, cada fila etiquetada con la consulta que lo sacó a la luz.

query
El término de búsqueda que produjo este resultado, repetido en cada fila que devolvió.
title
El titular tal como se publicó.
source
El medio que publicó la noticia. A veces un dominio a secas, a veces un nombre de marca: el formato no es consistente, así que no lo interprete como un dominio.
date
Cuándo se publicó el artículo, como marca de tiempo GMT absoluta. No un "hace 3 días" relativo, así que una exportación sigue siendo fechable indefinidamente.
link
URL del artículo: una redirección de Google en news.google.com en lugar de la dirección propia del editor. Se resuelve al seguirla, pero no es canónica, así que no puede deduplicar con ella ni leer un dominio a partir de ella.
snippet
Texto que se muestra junto al resultado. En la práctica, el titular seguido del nombre del medio, así que repite title y source en lugar de resumir el artículo.
image
La imagen principal del artículo, como URL directa en los servidores del propio editor.

7 columnas por artículo - todas las columnas de arriba en todos los planes, incluido el gratuito.

Tenga en cuenta que no hay columna de posición en el ranking. Si necesita saber en qué orden llegaron los resultados, conserve el orden de filas de la exportación: después no se puede recuperar.

Conviene entenderlo

El enlace no es la URL
del editor.

Dos columnas se comportan de forma distinta a como se leen. Ninguna es un problema una vez que lo sabe; ambas son incómodas si no.

link es una redirección. Cada URL vuelve apuntando a news.google.com/rss/articles/… y no al medio. Se resuelve al artículo cuando se sigue, pero no es la dirección canónica, lo que significa que no puede deduplicar con ella entre ejecuciones, ni extraer un dominio, ni descargar la página sin seguir el salto. Use source para el medio y resuelva la redirección si necesita la URL real.

snippet repite el titular. No es un resumen. En la práctica vuelve como el título seguido del nombre del medio, así que apenas aporta información que las otras columnas no le den ya. Si pensaba ejecutar análisis de sentimiento o de palabras clave sobre una descripción, este no es ese campo: la respuesta honesta es que los titulares son lo que este servicio le da para analizar.

La buena noticia es que la columna con más probabilidades de causar problemas no lo hace: date es una marca de tiempo GMT absoluta, así que no hace falta ninguna contabilidad en tiempo de ejecución para mantener fechable un conjunto de datos.

livescraper.app · comportamiento de las columnas
Las fechas nunca llegan como “hace 2 horas”
La denominación del medio es inconsistente: dominio o marca
Las imágenes principales apuntan directamente al editor
Los enlaces a artículos redirigen a través de Google!
Los extractos duplican el titular y el medio!
Resuelva el enlace si necesita la URL canónica.
Controles de alcance

Hasta cuándo atrás,
y desde dónde.

Dos ajustes hacen casi todo el trabajo en un trabajo de noticias: la ventana que busca y la configuración regional desde la que busca.

Última hora Último día Última semana Último mes Último año

El idioma y el país son ajustes independientes, igual que en el Google Search Scraper, así que puede preguntar qué dicen los medios en alemán, o qué se está informando en Alemania, y no son la misma pregunta. La cobertura abarca todos los idiomas y todos los países.

También puede fijar cuántas páginas devolver por consulta, que es la palanca honesta sobre el coste: más profundidad por consulta significa más filas.

Flujos de trabajo habituales

Tres tareas que la gente
ejecuta más a menudo aquí.

Algunos ejemplos de cómo los equipos usan los resultados de noticias.

Relaciones públicas

Vigile su propia cobertura

Ejecute su marca, sus directivos y sus nombres de producto con un filtro del último día y tendrá un registro de prensa sin una suscripción de recortes. Como source y una date absoluta vuelven en cada fila, puede ver no solo si le cubrieron, sino qué medios lo publicaron y exactamente cuándo.

Comunicación · RR. PP.
Competencia

Siga una noticia mientras se propaga

Vuelva a ejecutar la misma consulta con una cadencia fija y la comparación muestra qué medios recogieron una noticia y en qué orden. Esa progresión -quién la publicó primero, quién siguió- suele ser más informativa que el número de artículos.

Inteligencia de mercado
Riesgo

Vigile un mercado por jurisdicción

Fije país e idioma de forma deliberada y la misma consulta se convierte en una vigilancia específica de esa jurisdicción. Útil para el seguimiento regulatorio y de cadena de suministro, donde lo que se informa localmente a menudo precede a cualquier cosa en la prensa en inglés.

Investigación · Cumplimiento
Precios

Pague solo por las filas
que realmente extrae.

Sin suscripción, sin mínimo, sin licencia por palabra clave. Sus primeras 500 filas corren de nuestra cuenta; después, pago por uso.

Plan gratuito

500 filas gratis - 0 $

Cada cuenta nueva, por única vez. Sin tarjeta de crédito. Todos los extractores desbloqueados, con todas las funciones: suficiente para probar una lista de vigilancia y calibrar la profundidad antes de escalar.

0 $ para siempre
Pago por uso

0,002 $ por fila, tras el plan gratuito

Aproximadamente 2 $ por cada 1.000 resultados. El estimador previo muestra el recuento y el coste en créditos antes de que empiece una ejecución: merece un vistazo aquí, ya que consultas × páginas se multiplica rápido.

El más popular
Enterprise

A medida · seguimiento continuo

Precios por volumen, SLA, workers dedicados e incorporación a medida para listas de vigilancia grandes con una cadencia ajustada. Díganos sus cifras y le presupuestamos.

Hable con nosotros
10 % de descuento en su primera ejecución de pago.Use el código LIVESCRAPER10 al pagar.
Registrarse
Combina bien con

Las mismas consultas,
una vertical distinta.

Las noticias son una de las verticales que devuelve Google. Los equipos que siguen un tema suelen vigilar más de una.

La parte legal

¿Es legal recopilar
resultados de noticias?

Respuesta corta: sí para la página de resultados, con una distinción que conviene trazar sobre los artículos en sí.

Una página de resultados de noticias es pública. Google muestra a cualquiera los titulares, extractos y enlaces de una consulta, con sesión iniciada o sin ella. Recopilar resultados públicamente visibles para seguimiento de medios e investigación es una práctica establecida desde hace mucho, y mientras los datos estén disponibles públicamente y el proceso no perturbe el sitio, no hay leyes federales que lo prohíban.

La distinción: lo que obtiene es un titular, un extracto y un enlace, no el artículo. Seguir la cobertura, contar menciones, analizar qué medios publicaron qué y leer los extractos son usos ordinarios. Republicar un artículo, o reproducir texto sustancial de uno, es una cuestión de derechos de autor entre usted y el editor, y el enlace está ahí precisamente para que los lectores vayan a la fuente. Preferimos decirlo antes que dejar que la página dé a entender otra cosa.

Las condiciones de Google también restringen el acceso automatizado, así que esto es además una cuestión de condiciones. No tocamos nada detrás de un inicio de sesión ni de un muro de pago, no ejecutamos rastreadores de terceros en la capa de datos y sus exportaciones se autoeliminan a los 30 días.

livescraper.app · resultados frente a artículos
Seguir la cobertura es uso ordinario
Contar menciones por medio es uso ordinario
Analizar titulares y extractos es uso ordinario
Republicar un artículo lo decide el editor!
Titulares, extractos y enlaces: nunca detrás de un muro de pago.
Preguntas frecuentes

Lo que la gente pregunta
antes de registrarse.

Las preguntas que más oímos. ¿Alguna más? Hable con nosotros: las respuestas las escriben personas, no bots.

¿Cómo extraigo resultados de Google Noticias?+
Con el Extractor de Noticias de Google:
  1. Inicie sesión en la plataforma.
  2. Abra el Extractor de Noticias de Google.
  3. Pegue sus consultas: hasta 1.000 por ejecución.
  4. Fije idioma, país y rango de fechas.
  5. Elija cuántas páginas por consulta.
  6. Elija su formato y pulse Get Data.
¿Qué datos vuelven por cada artículo?+
Siete campos: query, title, source, date, link, snippet e image: la consulta que lo sacó a la luz, el titular, el medio que lo publicó, una fecha de publicación GMT absoluta, un enlace, un extracto y la imagen principal del artículo. No hay columna de posición en el ranking, así que conserve el orden de filas de la exportación si el orden de resultados le importa.
¿Por qué el enlace no lleva al editor?+
Porque link es una redirección de Google: cada URL apunta a news.google.com/rss/articles/… en lugar de a la dirección propia del medio. Se resuelve al artículo cuando se sigue, pero no es canónica, así que no puede deduplicar con ella entre ejecuciones ni extraer un dominio. Use source para el medio y resuelva la redirección si su flujo de trabajo necesita la URL real.
¿Hasta cuándo atrás puedo buscar?+
Puede filtrar por la última hora, día, semana, mes o año. La última hora y el último día son lo que hace esto usable como herramienta de seguimiento y no solo como búsqueda: una ventana estrecha mantiene las ejecuciones pequeñas y los resultados genuinamente nuevos.
¿Puedo buscar noticias que no estén en inglés?+
Sí: todos los idiomas y todos los países, y son ajustes independientes. Preguntar qué dicen los medios en alemán es una pregunta distinta de qué se está informando en Alemania, y puede plantear cualquiera de las dos.
¿Cuántas consultas puedo ejecutar a la vez?+
Hasta 1.000 consultas por ejecución. Cada fila devuelta lleva la consulta que la produjo, así que una exportación puede cubrir toda una lista de vigilancia sin perder qué resultado pertenece a qué término.
¿Recibo el texto completo del artículo?+
No: recibe el titular, el extracto que muestra Google y el enlace. Eso es lo que contiene una página de resultados. Leer y analizar extractos es seguimiento de medios ordinario; el enlace está ahí para que usted o sus lectores vayan al editor a por el artículo en sí.
¿Cuánto cuesta?+
Las primeras 500 filas de una cuenta nueva son gratis y por única vez; después son 0,002 $ por fila, de pago por uso y sin suscripción. Recuerde que las consultas se multiplican por páginas, así que merece la pena leer el estimador. Consulte precios para tarifas por volumen.

Empiece una lista de vigilancia, gratis.

500 filas gratis por única vez en cada cuenta nueva, sin caducidad. Después son 0,002 $ por fila, de pago por uso, sin tarjeta registrada hasta que usted lo diga.

Se activa al instante · sin tarjeta

Extraiga resultados de Google Noticias a escala

El Extractor de Noticias de Google de Livescraper convierte una lista de consultas en datos de cobertura informativa. Usted pega los términos que quiere vigilar -hasta mil por ejecución-, fija el idioma, el país y el rango de fechas, elige cuántas páginas devolver por consulta y descarga los resultados en CSV, JSON o Excel.

Cada fila lleva siete campos: la consulta que sacó a la luz el artículo, el titular, el medio que lo publicó, la fecha de publicación, un enlace, un extracto y la imagen principal del artículo. Dos apuntes prácticos importan más de lo que suenan. La fecha es una marca de tiempo GMT absoluta en lugar de un "hace 3 días" relativo, así que una exportación sigue siendo fechable indefinidamente sin contabilidad en tiempo de ejecución. Y el enlace es una redirección de Google que apunta a news.google.com en lugar de a la dirección propia del editor: se resuelve al seguirla, pero no es canónica, así que use la columna source para el medio y resuelva la redirección si necesita la URL real.

El filtro de rango de fechas es lo que convierte esto de una búsqueda en un monitor. La última hora y el último día mantienen las ejecuciones pequeñas y los resultados genuinamente nuevos, que es lo que hace práctica una vigilancia diaria de marca. El idioma y el país son ajustes independientes, así que preguntar qué dicen los medios en alemán es una consulta distinta de preguntar qué se está informando en Alemania: útil para el seguimiento regulatorio y de cadena de suministro, donde la información local precede con frecuencia a la prensa en inglés.

Los equipos de comunicación ejecutan términos de marca, directivos y productos con un filtro del último día y obtienen un registro de prensa sin suscripción de recortes, con la columna source mostrando qué medios publicaron cada noticia. Los equipos de competencia vuelven a ejecutar una consulta con una cadencia y leen la comparación para ver quién recogió una noticia y cuándo, algo que las fechas absolutas hacen sencillo. Lo que vuelve son titulares, medios, fechas, imágenes y enlaces, no texto de artículo: el enlace está ahí para que los lectores lleguen al editor. Empiece gratis: sus primeras 500 filas no cuestan nada y no necesitan tarjeta de crédito.