CrawlForge MCP
InicioPlaygroundCasos de usoIntegracionesPreciosDocumentaciónBlog
MCP server de búsqueda web autoalojado
AI Engineering
Volver al blog
Ingeniería de IA

MCP server de búsqueda web autoalojado

C
CrawlForge Team
Equipo de Ingeniería
28 de agosto de 2026
4 min de lectura

En esta página

Respuesta rápida

CrawlForge es un MCP server de búsqueda web que puede autoalojarse en dos de las tres capas que importan. El proceso del servidor es un paquete npm con licencia MIT que se ejecuta en local sobre stdio, y el backend de búsqueda puede ser tu propia instancia de SearXNG: define CRAWLFORGE_SEARXNG_URL y pasa provider: "searxng" a search_web, y la consulta nunca sale de tu red. Las tools basadas en LLM usan por defecto un modelo local de Ollama. Lo que no es autoalojado es la medición: cada llamada sigue necesitando una API key de CrawlForge y search_web sigue costando 5 credits, sea cual sea el provider que responda. Si necesitas cero dependencia de un proveedor, un wrapper MCP nativo de SearXNG encaja mejor.

Busca un MCP server de búsqueda web autoalojado y los resultados se dividen en dos montones: proyectos de GitHub que ejecutas enteramente tú, y páginas de proveedores que llaman "local" a una API alojada porque el cliente corre en tu portátil. Son cosas distintas, y cuál necesitas depende de qué intentas mantener realmente en casa.

Este post es concreto sobre dónde se sitúa CrawlForge en esa línea — incluida la parte que no es autoalojada.

Qué significa "autoalojado" en un MCP server

Un montaje de búsqueda web con MCP tiene tres capas, y cada una puede alojarse por separado:

  1. El proceso del servidor — lo que tu cliente MCP lanza y con lo que habla por stdio.
  2. El backend de búsqueda — lo que de verdad responde a la consulta.
  3. El plano de control — autenticación, medición, facturación.

La mayoría de las afirmaciones de "autoalojado" solo cubren la capa 1. Ejecutar un proceso en local es lo mínimo; casi todos los MCP server lo hacen. La pregunta que decide si cuenta como autoalojado a efectos de privacidad es la capa 2: ¿sale tu consulta de tu red, y quién la ve?

Cuánto de CrawlForge se ejecuta en tu máquina

La capa 1 es enteramente tuya. crawlforge-mcp-server es un paquete npm con licencia MIT que corre como proceso local sobre stdio — sin demonio del proveedor, sin runtime en la nube, y con el código en GitHub por si quieres leerlo antes de ejecutarlo.

Bash
npm install -g crawlforge-mcp-server

La capa 2 es la interesante. search_web acepta un parámetro provider con dos valores admitidos, y uno de ellos es tu propia instancia de SearXNG:

Bash
export CRAWLFORGE_SEARXNG_URL=http://localhost:8888
Json
{
  "query": "mcp server directory",
  "provider": "searxng",
  "limit": 10
}

Con eso configurado, la consulta va a tu máquina con SearXNG y a ningún otro sitio — ningún proveedor de búsqueda externo ve la cadena. Los resultados vuelven normalizados con la misma forma que los del provider alojado, así que el ranking, la deduplicación y la caché se siguen aplicando y nada cambia después en tu flujo.

Las tools basadas en LLM siguen el mismo patrón. extract_with_llm, summarize_content y analyze_content usan por defecto un modelo local de Ollama, así que el paso de extracción también puede quedarse en tu hardware.

Qué no es autoalojado

La capa 3. La medición pasa por CrawlForge sin importar qué provider elijas.

search_web está envuelto en la misma comprobación de autenticación y credits que cualquier otra tool, y esa comprobación ni sabe ni le importa que hayas elegido SearXNG. Una búsqueda servida por SearXNG sigue necesitando una API key válida y sigue costando 5 credits, exactamente igual que una alojada.

Conviene ser claro sobre lo que eso te da y lo que no. Autoalojar el backend de búsqueda cambia quién ve tus consultas — una ganancia real de privacidad, y la razón habitual para quererlo. No hace que la herramienta sea gratis, y no elimina la dependencia del proveedor. Si tu requisito es "ninguna conexión saliente hacia un proveedor", CrawlForge no lo cumple hoy.

Cuándo lo correcto es un servidor totalmente autoalojado

Si la capa 3 es la que necesitas controlar — red aislada, sin cuentas de proveedor, sin coste por llamada — usa mejor un proyecto totalmente autoalojado. SearXNG tiene wrappers MCP que hablan directamente con él, y para ese requisito te servirán mejor que dar rodeos con una herramienta medida.

CrawlForge se gana su sitio cuando quieres el backend de búsqueda en local pero sigues queriendo un solo servidor para el resto del trabajo: scrape, extract_content, crawl_deep, serp_rank y 23 tools más sobre la misma conexión y la misma key. Buscar contra tu propia instancia y extraer con tu propio Ollama, mientras una ruta alojada se encarga de las páginas que SearXNG solo te señaló, es un término medio razonable — y en la práctica es la configuración que acaba queriendo la mayoría de quienes buscan esto.

Consigue una API key — 1.000 credits puntuales, sin tarjeta. Define CRAWLFORGE_SEARXNG_URL, pasa provider: "searxng", y tus consultas se quedan en tu red.

Pruébalo tú mismo — sin necesidad de registrarte

Ejecuta cualquiera de las 29 herramientas de scraping y extracción de CrawlForge en el playground y luego empieza gratis con 1,000 credits.

1,000 credits gratis • Por única vez • No se requiere tarjeta de crédito

Etiquetas

mcpweb searchself-hostedsearxngsearch_webprivacy

Sobre el autor

C

CrawlForge Team

Equipo de Ingeniería

Construimos el MCP server de web scraping más completo. Creamos herramientas que ayudan a los desarrolladores a extraer, analizar y transformar datos web para aplicaciones de IA.

Mantente al día con los últimos artículos

Recibe tutoriales, novedades del producto y consejos de web scraping en tu bandeja de entrada.

Sin spam. Cancela tu suscripción cuando quieras.

Ponlo en práctica

Prueba las herramientas de CrawlForge en cualquier URL — gratis, sin registro.

En esta página

Frequently Asked Questions

¿Se puede autoalojar un MCP server de búsqueda web con CrawlForge?+

En parte, y la distinción importa. El proceso del servidor sí es totalmente autoalojado: crawlforge-mcp-server es un paquete npm con licencia MIT que se ejecuta en local sobre stdio, sin ningún demonio del proveedor. El backend de búsqueda también puede autoalojarse — define CRAWLFORGE_SEARXNG_URL apuntando a tu propia instancia de SearXNG y pasa provider: "searxng" a search_web, y la consulta nunca sale de tu red. Lo que no es autoalojado es la medición: cada llamada sigue autenticándose contra CrawlForge y gastando credits.

¿Buscar a través de mi propia instancia de SearXNG sigue gastando credits?+

Sí. search_web cuesta 5 credits por llamada, responda el provider que responda. La comprobación de credits envuelve la tool y se ejecuta antes de elegir el provider, así que no sabe que fue SearXNG quien sirvió los resultados. Autoalojar el backend de búsqueda es un cambio de privacidad — tus consultas se quedan en tu red — no un cambio de coste.

¿Cuál es la diferencia entre un MCP server local y un backend de búsqueda autoalojado?+

Un MCP server local solo significa que el proceso corre en tu máquina, algo que cumplen casi todos los MCP server y que no dice nada sobre adónde va la consulta. Un backend de búsqueda autoalojado significa que la búsqueda en sí la responde infraestructura que tú ejecutas — por ejemplo tu propia instancia de SearXNG — de modo que la cadena de consulta nunca se envía a un proveedor de búsqueda externo. Solo lo segundo protege la privacidad de tus consultas.

¿Las tools basadas en LLM también pueden ejecutarse en local?+

Sí. extract_with_llm, summarize_content y analyze_content usan por defecto un modelo local de Ollama, así que la extracción y el resumen de contenido pueden ejecutarse en tu propio hardware. Combinado con un backend SearXNG autoalojado, eso mantiene en tu infraestructura tanto la consulta de búsqueda como el contenido extraído de las páginas.

Artículos relacionados

Extrae datos web con LLMs locales (Ollama + CrawlForge)
AI Engineering

Extrae datos web con LLMs locales (Ollama + CrawlForge)

Sin API keys, sin nube, sin que tus datos salgan de tu máquina. Usa extract_with_llm con Ollama local para extraer datos estructurados de cualquier sitio.

C
CrawlForge Team
|
24 may
|
9m
El protocolo MCP explicado: una guía para desarrolladores en 2026
AI Engineering

El protocolo MCP explicado: una guía para desarrolladores en 2026

Aprende cómo funciona el Model Context Protocol, por qué importa para los agentes de IA y cómo construir MCP servers y clientes con diagramas de arquitectura y código.

C
CrawlForge Team
|
27 abr
|
10m
AI Crawler List 2026: Every Bot + Should You Block Them?
AI Engineering

AI Crawler List 2026: Every Bot + Should You Block Them?

Every AI crawler that matters in 2026: 31 bots, their robots.txt tokens, and what blocking each one actually costs you. Copy-paste file included.

C
CrawlForge Team
|
25 ago
|
12m

Pie de página

CrawlForge MCP

Web scraping empresarial para agentes de IA. 29 herramientas MCP especializadas diseñadas para desarrolladores modernos que crean sistemas inteligentes.

Producto

  • Funciones
  • Playground
  • Precios
  • Casos de uso
  • Integraciones
  • Alternativas
  • Registro de cambios

Recursos

  • Primeros pasos
  • Referencia de la API
  • Plantillas
  • Guías
  • Blog
  • Glosario
  • Preguntas frecuentes
  • Mapa del sitio

Desarrolladores

  • Protocolo MCP
  • Claude Desktop
  • Cursor IDE
  • LangChain
  • LlamaIndex

Empresa

  • Acerca de
  • Contacto
  • Privacidad
  • Términos
  • Uso aceptable
  • Cookies

Mantente al día

Recibe las últimas novedades sobre nuevas herramientas y funciones.

Creado con Next.js y el protocolo MCP

© 2025-2026 CrawlForge. Todos los derechos reservados.