CrawlForge MCP
InicioPlaygroundCasos de usoIntegracionesPreciosDocumentaciónBlog
Scraper de Reddit para Claude Code: qué llama Claude en realidad
Tutorials
Volver al blog
Tutoriales

Scraper de Reddit para Claude Code: qué llama Claude en realidad

C
CrawlForge Team
Equipo de Ingeniería
2 de septiembre de 2026
4 min de lectura

En esta página

Respuesta rápida

En Claude Code un scraper de Reddit es una sola llamada a una tool MCP: reddit_search, que lee el archivo comunitario Arctic Shift en lugar de reddit.com. Preguntas en lenguaje natural y Claude elige el modo — una búsqueda acotada a un subreddit, una búsqueda de comentarios o la lectura de un hilo completo — a 5 credits por llamada y sin credenciales de Reddit. Lo que conviene saber es que quitar el subreddit cambia el mecanismo, no solo el alcance: una búsqueda en todo Reddit se resuelve con una búsqueda web restringida al sitio que descubre hasta 10 posts y luego los lee del archivo, así que los resultados llegan por relevancia y los filtros de fecha no se aplican en absoluto.

Claude Code puede buscar en Reddit. Simplemente nunca toca reddit.com para hacerlo — todas las rutas directas devuelven 403, navegadores stealth incluidos, y las probamos todas. Este post da eso por aceptado y va a lo que ocurre de verdad en tu terminal.

La instalación es una línea — la propia documentación MCP de Claude Code cubre los tres scopes de instalación. Si después el server no aparece, ese es otro problema con una respuesta más larga:

Bash
claude mcp add crawlforge \
  --env CRAWLFORGE_API_KEY=cf_live_your_key_here \
  -- npx -y crawlforge-mcp-server

¿Qué ocurre cuando le pides a Claude Code que busque en Reddit?

Describes un resultado, no una tool:

Text
What are people in r/LocalLLaMA complaining about with long context this month? Read the top thread in full.

Claude hace dos llamadas. La primera va acotada, así que entra directa al archivo:

Json
{
  "tool": "reddit_search",
  "arguments": {
    "query": "long context",
    "subreddit": "LocalLLaMA",
    "mode": "posts",
    "after": "30d",
    "limit": 25
  }
}

La segunda coge un id de esos resultados y lee la discusión:

Json
{
  "tool": "reddit_search",
  "arguments": {
    "mode": "thread",
    "link_id": "1vbf4nh",
    "limit": 100
  }
}

Dos llamadas, 10 credits, ni una credencial de Reddit por ningún lado. Lo que vuelve son filas normalizadas del archivo, así que Claude puede pasárselas a summarize_content sin ningún paso de parseo por medio — la lista completa de parámetros está en la referencia de la API.

¿Por qué una búsqueda en todo Reddit cuesta como una búsqueda web?

Quita el subreddit y la petición cambia de mecanismo, no solo de alcance. Esta es la parte que pilla a la gente.

Arctic Shift no puede buscar por palabra clave en todo Reddit — su API exige acotar a un subreddit, un autor o un post. PullPush sí podía, hasta que dejó de atender a clientes automatizados en agosto de 2026. Así que una consulta sin acotar toma una ruta en dos pasos: una búsqueda web restringida al sitio encuentra los posts que coinciden y esos IDs se leen después del archivo.

Lo que vuelve siguen siendo filas reales del archivo, no fragmentos de un buscador. Pero cambian tres cosas, y las tres van declaradas en el propio array notes de la respuesta:

  • Los resultados se ordenan por relevancia de la búsqueda web, no por puntuación ni fecha.
  • El descubrimiento se limita a 10 posts por llamada, sea cual sea el limit que pidieras.
  • after y before no se aplican. La respuesta lo dice explícitamente en lugar de devolver resultados sin filtrar.

Esto último es lo que más pesa dentro de un bucle de agente. Claude pasará tan tranquilo after: "7d" en una búsqueda sin acotar, y el filtro se descarta — la nota es lo único que os avisa, a él y a ti, de que la ventana se ignoró.

¿Cuándo conviene anular la elección de Claude?

Pocas veces, con dos excepciones que vale la pena aprender.

Nombra un subreddit siempre que puedas. Es la diferencia entre una muestra de 10 posts por relevancia y una consulta real al archivo con filtros de fecha operativos. "Busca en Reddit X" y "busca en r/webscraping X" son operaciones distintas, no dos formas de decir lo mismo.

Di "busca en los comentarios" cuando quieras opiniones. mode: "comments" busca en los cuerpos de los comentarios y no en títulos ni selftext, y Claude tiende a quedarse en posts. Lo jugoso suele estar tres respuestas más abajo.

¿Cuánto cuesta esto dentro de un bucle de agente?

5 credits por llamada, responda la ruta que responda — así que los 1.000 credits únicos del plan gratuito son 200 búsquedas. Leer un hilo cuesta los mismos 5 tanto si tiene 12 comentarios como 400, lo que convierte "busca y luego lee los tres hilos principales" en unos previsibles 20 credits en vez de algo que escala con lo animada que estuviera la discusión.

El límite de precisión con el que hay que diseñar: las puntuaciones y los recuentos de comentarios de contenido con menos de unas 36 horas pueden leerse como 0 o 1. El archivo captura un post en cuanto aparece y no vuelve a consultarlo según llegan los votos. Las preguntas de sentimiento van bien. "Lo más votado hoy" no.

Pruébalo tú mismo — sin necesidad de registrarte

Ejecuta cualquiera de las 29 herramientas de scraping y extracción de CrawlForge en el playground y luego empieza gratis con 1,000 credits.

1,000 credits gratis • Por única vez • No se requiere tarjeta de crédito

Etiquetas

redditclaude codemcpreddit_searchweb scraping

Sobre el autor

C

CrawlForge Team

Equipo de Ingeniería

Construimos el MCP server de web scraping más completo. Creamos herramientas que ayudan a los desarrolladores a extraer, analizar y transformar datos web para aplicaciones de IA.

Mantente al día con los últimos artículos

Recibe tutoriales, novedades del producto y consejos de web scraping en tu bandeja de entrada.

Sin spam. Cancela tu suscripción cuando quieras.

Ponlo en práctica

Prueba las herramientas de CrawlForge en cualquier URL — gratis, sin registro.

En esta página

Frequently Asked Questions

¿Por qué Claude Code me devolvió solo 10 posts de Reddit si pedí 50?+

Porque la búsqueda iba sin acotar. Una búsqueda por palabra clave en todo Reddit se resuelve por descubrimiento — una búsqueda web restringida al sitio encuentra los posts, y una sola llamada de búsqueda devuelve como mucho 10 resultados — así que el limit que pasaste queda topado ahí valga lo que valga. Añade un subreddit o un autor y consultará directamente el archivo de Arctic Shift, donde limit llega hasta 100.

¿Tengo que nombrar reddit_search en mi prompt?+

No. Describir el resultado basta en la mayoría de las sesiones, y Claude elige la tool y el modo por su cuenta. Lo que sí conviene nombrar es el alcance: decir "r/webscraping" en vez de "Reddit" cambia qué backend responde, si funcionan los filtros de fecha y cuántos resultados puedes pedir. Eso pesa mucho más que cualquier forma de nombrar la tool.

¿Por qué se ignoró mi filtro de fechas after/before?+

Casi seguro ejecutaste una búsqueda sin acotar. El descubrimiento va por una búsqueda web, que no puede filtrar por fecha de publicación, así que after y before se descartan en lugar de aplicarse a medias — y la respuesta incluye una nota que lo dice tal cual. Acota la búsqueda a un subreddit o a un autor y los filtros funcionan, aceptando ISO 8601, segundos epoch u offsets como "7d".

¿Esto funciona fuera de Claude Code?+

Sí. Cualquier cliente MCP funciona igual — Claude Desktop, Cursor, Windsurf — y hay un endpoint REST en /api/v1/tools/reddit_search que acepta los mismos parámetros con una cabecera X-API-Key, por los mismos 5 credits, así que la búsqueda idéntica se ejecuta desde un cron o un paso de CI sin ningún cliente MCP de por medio.

Artículos relacionados

Cómo scrapear Reddit sin la API (2026)
Tutorials

Cómo scrapear Reddit sin la API (2026)

Toda vía directa a reddit.com devuelve 403 en 2026, incluso los navegadores stealth, y el truco de .json está muerto. Esta es la ruta de archivos que sí funciona, paso a paso.

C
CrawlForge Team
|
24 ago
|
6m
CrawlForge MCP v5.1.0: busca en Reddit sin la API
Product Updates

CrawlForge MCP v5.1.0: busca en Reddit sin la API

reddit.com bloquea todos nuestros scrapers, así que v5.1.0 lanza reddit_search, nuestra herramienta 28: busca posts y comentarios y lee hilos completos vía archivos comunitarios. Sin API key, sin credenciales, 5 credits.

C
CrawlForge Team
|
24 ago
|
9m
Alternativas a la API de Reddit que aún funcionan en 2026
Web Scraping

Alternativas a la API de Reddit que aún funcionan en 2026

Reddit cerró el registro autoservicio de su API en noviembre de 2025, y reddit.com bloquea los scrapers de plano. Aquí tienes las cinco rutas hacia los datos de Reddit que aún funcionan en 2026 — comparadas con honestidad, incluidas las que no vendemos nosotros.

C
CrawlForge Team
|
24 ago
|
6m

Pie de página

CrawlForge MCP

Web scraping empresarial para agentes de IA. 29 herramientas MCP especializadas diseñadas para desarrolladores modernos que crean sistemas inteligentes.

Producto

  • Funciones
  • Playground
  • Precios
  • Casos de uso
  • Integraciones
  • Alternativas
  • Registro de cambios

Recursos

  • Primeros pasos
  • Referencia de la API
  • Plantillas
  • Guías
  • Blog
  • Glosario
  • Preguntas frecuentes
  • Mapa del sitio

Desarrolladores

  • Protocolo MCP
  • Claude Desktop
  • Cursor IDE
  • LangChain
  • LlamaIndex

Empresa

  • Acerca de
  • Contacto
  • Privacidad
  • Términos
  • Uso aceptable
  • Cookies

Mantente al día

Recibe las últimas novedades sobre nuevas herramientas y funciones.

Creado con Next.js y el protocolo MCP

© 2025-2026 CrawlForge. Todos los derechos reservados.