Scraper de Búsqueda de Reddit

Busca en Reddit,
quédate con los resultados.

Escribe un término de búsqueda - o pega una URL reddit.com/search/?q=… - y las publicaciones vuelven como una tabla: el título, en qué subreddit estaba, quién la publicó, su puntuación, cuántos comentarios tiene, cuándo se publicó y un enlace. Nueve columnas, una fila por publicación, ordenadas como tú elijas.

500 filas gratis, una sola vezdespués 0,002 $ por filauna fila por publicaciónCSV · JSON · Excel
Cómo funciona

Una búsqueda,
y una ordenación.

Un campo obligatorio y dos controles. La ordenación es lo que decide qué porción de Reddit pagas.

  1. PASO 1Inicia sesión en la plataforma.
  2. PASO 2Abre el Scraper de Búsqueda de Reddit.
  3. PASO 3Escribe términos de búsqueda, uno por línea - o pega URLs reddit.com/search/?q=…, o sube un archivo CSV, XLSX, TXT o Parquet.
  4. PASO 4Fija un límite por consulta si quieres. El campo admite un mínimo de 1 y viene con 100 por defecto.
  5. PASO 5Elige una ordenación: Relevance, Hot, Top, New o Comment count.
  6. PASO 6Haz clic en Get Data y descarga como CSV, JSON o Excel.

El límite es por consulta, no por ejecución: cinco términos de búsqueda con un límite de cien son cien publicaciones de cada uno, no cien en total.

Por qué es útil

Cinco ordenaciones,
y una que rara vez encuentras.

Una búsqueda leída en el navegador es lo que Reddit decidió enseñarte. Una exportación ordenada es una muestra que elegiste tú.

Ordena por número de comentarios, no solo por puntuación

Comment count es la ordenación que encuentra discusiones. Una publicación con una puntuación modesta y cientos de comentarios es un hilo donde la gente discrepó - que suele ser justo donde está el detalle útil sobre un producto o una decisión, y no es lo que saca a la luz Top.

El subreddit viene como columna propia

Que subreddit esté separado de title es lo que hace útil una búsqueda en todo el sitio. Una consulta devuelve publicaciones de dondequiera que se escribieran, y puedes agrupar por comunidad después en vez de lanzar una búsqueda por subreddit.

Dos formas de pedir lo mismo

Un término de búsqueda simple y una URL reddit.com/search/?q=… funcionan los dos, en la misma caja. Si ya has construido una búsqueda en el navegador - con los filtros que le hayas añadido a la URL - puedes pegarla en vez de reconstruirla.

Lee esto primero

Qué es comments
y qué no es.

Un nombre de columna de esta página se malinterpreta sistemáticamente, y merece treinta segundos evitar planificar en torno a lo que no es.

La columna comments es un número: cuántos comentarios tiene una publicación. No son los comentarios en sí. No hay texto de comentario en ninguna parte de esta exportación, ni forma de hacerlo aparecer - las nueve columnas son todo el esquema. Si lo que quieres es lo que la gente escribió realmente, eso es otro servicio de esta plataforma con su propio esquema, y este no te lo va a dar por mucho que ordenes.

La confusión es fácil porque el control de ordenación usa la misma palabra: elegir Comment count envía el valor comments. La ordenación y la columna están relacionadas - una ordena por la otra - pero ninguna de las dos es texto de comentario. Piensa en este servicio como un índice de hilos, y en el de comentarios como lo que hay dentro.

Dicho eso, el recuento es exactamente lo que quieres para encontrar los hilos que merecen lectura. Ordenar por Comment count saca a la luz publicaciones donde mucha gente respondió, que es una señal distinta y a menudo mejor que Top: una puntuación alta significa que la gente estuvo de acuerdo con la publicación, mientras que un número alto de comentarios significa que tenían algo que decir. Para investigación de producto, quejas y comparaciones, lo segundo suele ser lo más útil.

Una limitación va aquí y no enterrada al final. Tenemos tres exportaciones de este servicio y ninguna contiene una publicación - todas las columnas de contenido estaban vacías en las cuatro filas. Lo que hace que merezca decirse sin rodeos es que las ejecuciones no fallaron por error: se enviaron consultas reales, de las dos formas que pide el formulario, y aun así volvieron con solo query y status rellenos. Así que los nombres de columna de abajo son fiables y nada de lo que va más allá lo es. Lanza una búsqueda en el plan gratuito y lee la fila de cabecera antes de construir nada sobre ella.

Lo que obtienes

Nueve columnas,
y nombres que podemos demostrar.

Estos nombres están confirmados dos veces: son la lista de columnas que el propio servicio declara, y son la fila de cabecera de todas las exportaciones que tenemos. Para qué sirve cada columna está debajo. Qué contendrá cada una, no - la nota explica por qué.

query
El término o la URL de búsqueda de la que salió esta fila, repetido. Lo escribe el scraper, así que está en la fila incluso cuando la petición falló - agrupa por él siempre que un archivo cubra más de una búsqueda.
title
El título de la publicación, tal como lo escribió quien la publicó.
subreddit
La comunidad en la que está la publicación. Columna propia, para que puedas agrupar una búsqueda de todo el sitio según de dónde vinieron las publicaciones.
author
El nombre de usuario de Reddit al que se atribuye la publicación. Mira la nota legal de abajo: un nombre de usuario es seudónimo, no anónimo.
score
La puntuación de la publicación. La puntuación de Reddit es votos a favor menos votos en contra, no un recuento bruto de votos positivos, así que puede ser baja en una publicación que mucha gente vio.
comments
Cuántos comentarios tiene la publicación - un recuento, no los comentarios. En esta exportación no hay texto de comentario. Lee la nota de arriba; el texto lo da un servicio aparte con su propio esquema.
created
Cuándo se hizo la publicación, tal como lo informa la exportación.
url
Un enlace a la publicación.
status
Qué le pasó a esta petición - lee esta primero. Como una petición fallida vuelve igualmente como una fila etiquetada en vez de desaparecer, puedes saber exactamente qué consulta no funcionó. Una fila puede llegar con las nueve campos presentes y aun así ser un aviso de fallo en vez de una publicación.

Los nombres son sólidos; todo lo que va más allá es tarea de tu primera ejecución. Tenemos tres exportaciones de este servicio y ninguna contiene una publicación. Todas las columnas de contenido - title, subreddit, author, score, comments, created, url - estaban vacías en las cuatro filas; solo query y status llevaban algo. Merece precisión explicar por qué importa aquí: las consultas eran reales. Se enviaron tanto un término de búsqueda simple como una URL reddit.com/search/?q=…, exactamente las dos formas que pide el formulario, y las filas aun así volvieron sin publicación. Así que estas ejecuciones confirman la forma de la exportación y no te dicen absolutamente nada de su contenido. Lo que sí confirman es la lista de columnas: la fila de cabecera es idéntica en las tres exportaciones y coincide exactamente con el conjunto declarado del servicio. Todo lo demás - qué aspecto tiene una puntuación, en qué formato llega una fecha, si comments es un número o una cadena - está deliberadamente ausente en vez de adivinado. El formulario también avisa de que los sitios con antibots devuelven un estado bloqueado en el pool gratuito, que es solo residencial; ese es el propio aviso de la plataforma sobre la tubería compartida y merece preverse. Ejecuta el plan gratuito sobre una búsqueda y lee la fila de cabecera y los primeros valores antes de construir sobre ellos.

Casos de uso

Tres tareas para las que
la gente lo usa.

Todos empiezan por algo que escribirías en el propio buscador de Reddit.

Investigación

Encontrar dónde se habla realmente de un tema

Busca un producto, una empresa o un problema en todo el sitio y quédate con subreddit. Lo que vuelve es un mapa de qué comunidades se interesan - que suele ser más útil que cualquier hilo suelto, y es justo lo que una búsqueda en el navegador te obliga a deducir a base de scroll.

Investigación · Estrategia
Seguimiento

Reejecutar la misma búsqueda de forma programada

Los mismos términos lanzados cada semana te dan dos archivos comparables. Publicaciones nuevas, movimiento en score y recuentos de comments subiendo son un diff en vez de una tarde de scroll - y query mantiene cada fila atada a la búsqueda de la que salió.

Marca · Escucha social
Triaje

Preseleccionar los hilos que merecen lectura

Ordena por Comment count, coge la parte de arriba del archivo y tienes los hilos donde la gente discutió en vez de aquellos donde estuvo de acuerdo. Esa es la lista corta para leer a mano - y la lista de entrada para el servicio de comentarios, si quieres lo que se dijo.

Producto · Soporte
Precios

Paga por fila de publicación,
por nada más.

Sin suscripción, sin mínimo, sin licencia por usuario. Tus primeras 500 filas corren de nuestra cuenta; a partir de ahí, pago por uso.

Gratis

500 filas

En cada cuenta nueva, una sola vez. Sin tarjeta de crédito. Todos los scrapers desbloqueados. Dado que ninguna ejecución que tenemos ha devuelto una publicación, esta es la parte que más importa aquí: gasta unas cuantas filas en averiguar qué contiene realmente esta exportación antes de planificar en torno a ella.

Una sola vez · Sin tarjeta
Pago por uso

0,002 $ por fila

Unos 2 $ por cada 1.000 publicaciones, la misma tarifa plana que cualquier otro scraper de la plataforma. El límite es por consulta, así que diez términos de búsqueda con un límite de cien son mil filas - merece la pena hacer la cuenta antes de empezar.

Los créditos no caducan
Empresas

A medida - temas enteros, de forma programada

Precios por volumen, SLAs, workers dedicados y onboarding a medida para equipos que siguen un tema a través de comunidades en vez de lanzar alguna búsqueda suelta. Dinos tus números y te hacemos un presupuesto.

Habla con ventas
10 % de descuento en tu primera ejecución de pago.Usa el código LIVESCRAPER10 al pagar.
Registrarse
Combina bien con

La misma pregunta,
en otro sitio.

Reddit es un lugar donde la gente habla. Estos leen los otros, cada uno con su propio esquema.

Legal

¿Es legal scrapear
resultados de búsqueda de Reddit?

Respuesta corta: son publicaciones públicas en una página de búsqueda pública - pero un nombre de usuario es una persona, y los términos de Reddit rigen el acceso automatizado.

Todo lo que hay en estas columnas se le muestra a cualquier visitante en una página pública de resultados de búsqueda, con sesión iniciada o sin ella. No se usa ningún inicio de sesión, no se cruza ningún muro de pago y no se toca ninguna cuenta, y la ejecución va por nuestro pool de proxies en vez de por tu propia dirección. Recopilar información públicamente visible para investigación es una práctica asentada desde hace mucho.

La columna author es un dato personal, y en Reddit eso importa más de lo habitual. Los nombres de usuario son seudónimos, no anónimos: muchos son identidades de larga vida con años de historial de publicaciones detrás, y la gente dice cosas bajo ellos precisamente porque no está usando su nombre real. Si almacenas la columna estás tratando datos personales, y el RGPD y regímenes similares te aplican independientemente de dónde los obtuviste. Contar con qué frecuencia aparece un tema es un caso fácil; montar un perfil de lo que ha publicado un usuario concreto no lo es, y este servicio no está pensado para eso.

Los términos de Reddit restringen el acceso automatizado y su contenido está licenciado a Reddit por quienes lo escribieron, así que sigue siendo una cuestión de términos y no de lo que es públicamente alcanzable; léelos antes de escalar. No usamos rastreadores de terceros en la capa de datos, y tus exportaciones se autoeliminan a los 30 días.

livescraper.app · principios
Solo resultados de búsqueda públicos
Sin inicios de sesión ni muros de pago
Los nombres de usuario son seudónimos, no anónimos - trátalos como datos personales!
Sin rastreadores de terceros en la capa de datos
Las exportaciones se autoeliminan (30 días)
Las mismas publicaciones que ve cualquier visitante en el buscador de Reddit.
FAQ

Lo que se pregunta antes de registrarse.

Las preguntas que más nos hacen. ¿Algo más? Habla con nosotros: las respuestas las escriben personas, no bots.

¿Qué envío?+
O bien un término de búsqueda simple o bien una URL de búsqueda de Reddit de la forma reddit.com/search/?q=…, una por línea, mezcladas libremente. El propio marcador del formulario muestra las dos formas. Puedes subir un archivo CSV, XLSX, TXT o Parquet en vez de pegar.
¿Qué columnas contendrá la exportación?+
Nueve: query, title, subreddit, author, score, comments, created, url y status. Esa es la lista de columnas que el propio servicio declara, y coincide con la fila de cabecera de todas las exportaciones que tenemos.
¿Esto devuelve los comentarios de una publicación?+
No. La columna comments es un recuento de cuántos comentarios tiene una publicación, no los comentarios en sí, y no hay texto de comentario en ninguna de estas nueve columnas. Obtener lo que la gente escribió realmente es un servicio aparte en la plataforma con su propio esquema. Usa este para encontrar los hilos, y aquel para leerlos.
¿Cuáles son las opciones de orden?+
Cinco: Relevance, Hot, Top, New y Comment count. Comment count es la que rara vez encuentras en otros sitios, y suele ser la más útil - una publicación con una puntuación modesta y muchos comentarios es un hilo donde la gente discrepó, que es donde suele estar el detalle.
¿Qué formato tiene la columna created?+
No lo decimos, y es deliberado. Ninguna de las ejecuciones que tenemos devolvió una publicación, así que nunca hemos visto un valor en ella. Adivinar sería peor que inútil, porque una columna de fecha es exactamente el tipo de campo contra el que la gente escribe código de parseo. Ejecuta el plan gratuito sobre una búsqueda y míralo tú primero.
¿Lo habéis ejecutado de verdad?+
Tres veces, y ni una ejecución devolvió una publicación - todas las columnas de contenido estaban vacías en las cuatro filas. Merece precisión explicar por qué importa: las consultas eran reales, no marcadores de posición. Se enviaron las dos formas que pide el formulario, un término de búsqueda simple y una URL reddit.com/search, y las filas aun así volvieron con solo query y status rellenos. Eso te dice la forma de la exportación y nada en absoluto de su contenido, y preferimos decirlo a maquillar la página.
¿Necesita un proxy?+
El formulario avisa de que los sitios con antibots devuelven un estado bloqueado en el pool gratuito, que es solo residencial. Ese es el propio aviso de la plataforma sobre la tubería compartida y no una afirmación sobre este sitio, y merece preverse. Lo que sí podemos decirte desde nuestro lado es más estrecho y más útil: ninguna de las tres exportaciones que tenemos volvió con una publicación dentro, así que lee la columna status en tu propia primera ejecución antes de construir nada sobre el resto.
¿Cuánto cuesta?+
Las primeras 500 filas de una cuenta nueva son gratis y por una sola vez; a partir de ahí son 0,002 $ por fila (unos 2 $ por cada 1.000), con pago por uso y sin suscripción. Los créditos no caducan y no hay reinicio mensual.

Encuentra los hilos primero.
Léelos después.

Lanza una búsqueda, ordena por número de comentarios y mira qué conversaciones merecen tu tarde. Tus primeras 500 filas son gratis.

Exportar resultados de búsqueda de Reddit como filas

El Scraper de Búsqueda de Reddit convierte una búsqueda en una hoja de cálculo. Envías términos de búsqueda o URLs reddit.com/search/?q=… - uno por línea, mezclados libremente, o subidos como archivo CSV, XLSX, TXT o Parquet -, fijas un límite y eliges una ordenación, y cada publicación vuelve como una fila: el título, el subreddit en el que se publicó, el autor, su puntuación, cuántos comentarios tiene, cuándo se hizo y un enlace. Nueve columnas, una fila por publicación, descargables como CSV, Excel o JSON. La descripción del propio servicio lo dice sin rodeos: devuelve resultados de búsqueda.

La columna que más se malinterpreta es comments, que es un recuento y no los comentarios en sí. Nada en estas nueve columnas es texto de comentario, y ninguna ordenación lo hará aparecer - obtener lo que la gente escribió es un servicio aparte con su propio esquema. La palabra hace doble trabajo en la interfaz, porque elegir la ordenación Comment count envía el valor comments, pero tanto la ordenación como la columna van de cuántos, no de qué. La forma útil de entenderlo es que este servicio es un índice de hilos y el otro es lo que hay dentro.

Ese recuento merece que ordenes por él. Se ofrecen cinco órdenes - Relevance, Hot, Top, New y Comment count - y el último es el que rara vez aparece en otros sitios. Una publicación con puntuación alta es una con la que la gente estuvo de acuerdo; una con muchos comentarios es una sobre la que se discutió, y para investigación de producto, quejas y comparaciones el detalle suele estar en la discusión. Que subreddit llegue como columna propia es lo otro que hace que merezca la pena una búsqueda de todo el sitio: una consulta devuelve publicaciones de dondequiera que se escribieran, y agrupas por comunidad después en vez de buscar en cada una por separado. El límite se aplica por consulta, así que varios términos multiplican.

Una limitación se dice sin rodeos porque cambia lo que cabe esperar de esta página. Tenemos tres exportaciones y ninguna contiene una publicación: todas las columnas de contenido estaban vacías en las cuatro filas. Eso merece precisión, porque las ejecuciones no fallaron por error - se enviaron consultas reales, de las dos formas que el formulario acepta, y las filas aun así volvieron con solo query y status rellenos. Así que los nueve nombres de arriba son fiables y todo lo que va más allá está deliberadamente ausente en vez de inventado. El formulario también avisa de que los sitios con antibots devuelven un estado bloqueado en el pool gratuito, que es solo residencial; ese es el propio aviso de la plataforma sobre la tubería compartida y merece preverse. En lo legal, todo lo recogido es público, pero author es un nombre de usuario seudónimo con el historial de publicaciones de una persona real detrás - trátalo como dato personal, y lee los términos de Reddit antes de escalar. Empieza gratis: tus primeras 500 filas no cuestan nada y no necesitan tarjeta, y después son 0,002 $ por fila, tarifa plana. Consulta precios para las tarifas actuales.