CrawlForge MCP
InicioPlaygroundCasos de usoIntegracionesPreciosDocumentaciónBlog
Un MCP server dentro de tu producto: cinco decisiones
AI Engineering
Volver al blog
Ingeniería de IA

Un MCP server dentro de tu producto: cinco decisiones

C
CrawlForge Team
Equipo de Ingeniería
4 de septiembre de 2026
7 min de lectura

En esta página

Respuesta rápida

Meter un MCP server dentro de un producto que distribuyes es un problema distinto que añadirlo a tu propio editor: heredas su radio de acción, su coste unitario y su modo de fallo en nombre de cada usuario. LightAudit Score, una consola gratuita de Lighthouse, conecta CrawlForge como servidor de investigación para que sus correcciones con IA citen páginas que realmente ha abierto. Cinco decisiones hicieron que fuera seguro distribuirlo — el servidor viene desactivado y la función se degrada de forma honesta sin él, se conceden diez de veintinueve tools mientras se deniegan los crawlers y los trabajos por lotes, la API key del usuario nunca pasa por la app, la versión se fija en vez de dejar que npx la resuelva al arrancar, y cualquier servidor declarado en un .mcp.json estándar puede sustituirlo. Calcula unos 11 credits por análisis: una búsqueda y tres lecturas de página.

Añadir un MCP server a tu propio editor es un cambio de configuración de cinco líneas y el radio de acción es tu máquina. Distribuir uno dentro de un producto que ejecutan otras personas es otra decisión. Heredas los permisos del servidor, su coste unitario y su modo de fallo en nombre de cada usuario, y cuando se inventa una fuente, el enlace falso lleva encima el nombre de tu producto, no el del modelo.

Acabamos de hacerlo. LightAudit Score es una consola gratuita y de código abierto que ejecuta Lighthouse contra localhost, staging y hosts tras una VPN a los que PageSpeed Insights no puede llegar. Haces clic en una puntuación baja y una IA lee los datos reales de la auditoría y devuelve correcciones priorizadas. Esas correcciones llevan citas solo cuando hay un servidor de investigación MCP conectado — y CrawlForge es la opción nombrada.

Este post es la arquitectura, no el argumento de venta. Cinco decisiones, y por cada una de ellas va a preguntar alguien en tu revisión de seguridad.

LightAudit Score se lanza pronto. El repositorio se hará público en breve, y cuando lo haga será gratuito y con licencia MIT — sin cuenta, sin licencia, sin límite de uso. Para que te avisen el día que salga, deja tu correo en lightauditscore.com: un solo email con el repositorio y la guía rápida, y nada más.

Índice

  • Por qué una función de IA necesita un servidor de investigación
  • Decisión 1: desactivado por defecto y honesto cuando falta
  • Decisión 2: diez tools de veintinueve
  • Decisión 3: la key del usuario nunca toca tu app
  • Decisión 4: fija la versión, no la resuelvas al arrancar
  • Decisión 5: nombra un servidor, admite cualquiera
  • Lo que cuesta cada análisis
  • La forma general

Por qué una función de IA necesita un servidor de investigación

Una puntuación de Lighthouse de 71 le dice a quien programa que algo va mal. No le dice cuál de las cuarenta auditorías atacar primero, y desde luego no le dice por qué. Ese es el hueco que cubre un panel de IA: leer el árbol de auditoría, nombrar la causa, ordenar las correcciones.

En el momento en que esas correcciones citan web.dev o developer.chrome.com, tienes un problema que no va de la calidad del modelo. Un modelo al que le pides citas producirá URLs plausibles las haya abierto o no. Pídele que no lo haga y casi siempre obedece — hasta la vez que no, que es justo la vez en que un cliente hace clic y se encuentra un 404 y deja de fiarse del panel entero.

Un servidor de investigación cierra ese bucle por mecánica, no por instrucción. El modelo solo puede citar una fuente que haya descargado mediante una llamada a una tool, porque la cita se compone a partir del resultado de la tool y no del recuerdo que el modelo tenga de la web. Es la misma propiedad de trazabilidad que hace útil a un servidor de datos web genérico en trabajos de due diligence: el valor no son los datos, es el camino auditable desde la afirmación hasta la página.

Decisión 1: desactivado por defecto y honesto cuando falta

El servidor de investigación es un interruptor en Ajustes, y arranca apagado.

Con él apagado, el análisis se diagnostica solo a partir de los datos de auditoría y el resultado lleva una etiqueta llana de Sin investigación web. Cada análisis va además sellado con el proveedor y el modelo que lo produjo. Nada se degrada en silencio, y nada se inventa una fuente para rellenar el hueco donde habría ido una cita.

Es la decisión que más equipos toman al revés. El instinto es hacer obligatoria la integración para que la función luzca siempre lo mejor posible; la consecuencia es que la credibilidad de tu función pasa a depender de que un tercero esté accesible. Degrádala de forma visible. Quien ve Sin investigación web sabe exactamente qué está leyendo. Quien ve una cita que resulta ser inventada ha aprendido algo mucho peor sobre tu producto.

Decisión 2: diez tools de veintinueve

CrawlForge expone veintinueve tools. A la ruta de análisis de LightAudit se le entregan diez: buscar, descargar, extraer, resumir. Los crawlers de sitios, los trabajos por lotes, la automatización de navegador y la investigación profunda se deniegan de plano.

El motivo es el coste unitario, no la paranoia. Una pasada de citas necesita encontrar una página y leerla. No necesita rastrear un dominio, y la diferencia aparece en la factura del usuario:

ToolCredits¿Concedida?
fetch_url1Sí — lectura HTTP en crudo
extract_text1Sí
extract_content2Sí — contenido principal, sin plantilla
summarize_content4Sí
search_web5Sí — el punto de entrada
crawl_deep4No — recorre un sitio entero
batch_scrape5No — se abre en abanico sobre una lista de URLs
stealth_mode5No — levanta un navegador
deep_research10No — multifuente, expande la consulta por su cuenta

deep_research es la ilustrativa. Es la mejor tool del catálogo para una pregunta de investigación, y está denegada. Un modelo que eche mano de ella en cada puntuación baja convierte un análisis de 11 credits en uno de 10 más el abanico, y quien hizo clic en un anillo de puntuación no pidió un proyecto de investigación. La tool que más disfrutaría tu agente no es la tool que tu producto debería concederle.

Si te llevas una sola cosa de este post: enumera las tools que concedes. El catálogo de un MCP server es la idea que su autor tiene de lo útil, y la intersección con el trabajo de tu función suele ser un tercio de él.

Decisión 3: la key del usuario nunca toca tu app

LightAudit no reenvía nada al servidor de investigación. CrawlForge se autentica desde su propia configuración, escrita por su propio asistente de instalación, así que la API key del usuario nunca pasa por la app que se beneficia de ella.

Esa frase vale más en una revisión de seguridad que cualquier cantidad de retórica sobre cifrado en reposo, porque elimina la pregunta en lugar de responderla. No eres el custodio de una credencial de terceros. No hay key en tu base de datos que se filtre, ni key en tus logs que redactar, ni key en un paquete de soporte, ni párrafo de respuesta a incidentes que escribir sobre un proveedor que no controlas.

La forma general: cuando una integración puede autenticarse por su cuenta, déjala. Cada credencial que tu producto guarda en nombre de un usuario es un riesgo que asumiste para ahorrarle un paso de configuración.

Decisión 4: fija la versión, no la resuelvas al arrancar

Casi toda configuración MCP que vas a copiar de un README tiene esta pinta:

Json
{
  "mcpServers": {
    "crawlforge": {
      "command": "npx",
      "args": ["-y", "crawlforge-mcp-server"],
      "env": {
        "CRAWLFORGE_API_KEY": "cf_live_YOUR_API_KEY_HERE"
      }
    }
  }
}

Esa es la configuración correcta para tu máquina y la equivocada para distribuir. -y suprime el aviso de instalación y un nombre de paquete pelado resuelve a lo que sea la última versión en el momento de arrancar, lo que significa que el código que tus clientes ejecutan mañana es código que nadie de tu equipo ha leído. Es una decisión de cadena de suministro disfrazada de flag de comodidad.

Fíjala:

Json
{
  "mcpServers": {
    "crawlforge": {
      "command": "npx",
      "args": ["-y", "crawlforge-mcp-server@5.6.6"]
    }
  }
}

Después mueve la subida de versión a tu revisión de dependencias habitual, donde una persona lee un changelog antes de que tus usuarios reciban comportamiento nuevo. Esto te cuesta una pull request cada pocas semanas. La alternativa te cuesta un incidente que no puedes reproducir, porque la versión que lo causó ya no es lo que resuelve latest.

Decisión 5: nombra un servidor, admite cualquiera

LightAudit nombra a CrawlForge en su documentación y no distribuye nada. Cualquier servidor de investigación declarado en un .mcp.json estándar será el que se use en su lugar.

Esto no es altruismo, es cómo se sobrevive a una conversación de compras. Una dependencia MCP que tu comprador no puede sustituir es una pregunta sobre cautividad en cada revisión corporativa en la que te vayas a sentar. Como MCP es un protocolo y no un SDK, respetar el fichero de configuración estándar no te cuesta prácticamente nada y convierte el "¿a qué proveedor estáis atados?" en "al que tú prefieras".

También te mantiene honesto. Un valor por defecto nombrado pero sustituible tiene que seguir siendo la mejor opción por méritos.

Lo que cuesta cada análisis

Un análisis es una búsqueda y unas cuantas lecturas:

PasoToolCredits
Encontrar las páginas de referencia para el diagnósticosearch_web5
Leer tres de ellasextract_content × 36
Total11

Los análisis se guardan junto con la ejecución, así que reabrir un informe no cuesta nada — la segunda persona que lea el mismo informe gasta cero credits. Una cuenta nueva de CrawlForge empieza con 1.000 credits gratis y sin tarjeta, que son unos noventa análisis con citas antes de que nadie tome una decisión de compra. El precio por tool está en la página de precios.

Ese número es el que hay que calcular antes de conectar el servidor, no después. Las tools que concede tu función y el número de veces que las llama son las dos variables de la factura de tus clientes, y la primera queda fijada en el momento de diseñar.

La forma general

Quita lo específico de Lighthouse y las mismas cuatro preguntas valen para cualquier MCP server que metas dentro de un producto que distribuyes:

  1. ¿Cuál es el radio de acción? Enumera las tools concedidas. Deniega el resto por nombre.
  2. ¿Quién guarda la credencial? Si el servidor puede autenticarse solo, no la guardes tú por él.
  3. ¿Cuál es el coste unitario? Calcúlalo por acción del usuario, no por mes.
  4. ¿Qué pasa cuando no está? Degrádate de forma visible. Una función que falta es recuperable; una función inventada no.

Nada de esto es exótico. Es la misma disciplina que aplicarías a cualquier llamada a un tercero en una ruta caliente — lo que pasa es que con los MCP servers se suele saltar, porque la configuración son cinco líneas y parece un cambio de ajustes en vez de una dependencia.

LightAudit Score se lanza pronto. Es gratuito, con licencia MIT y se ejecuta enteramente en tu propia máquina, y el repositorio se hará público en breve. Si quieres ver este patrón funcionando en vez de descrito, la web tiene el desglose completo de funciones y una lista de acceso anticipado que te mandará el enlace el día que salga — y el servidor de investigación que nombra es el que acabas de estar leyendo.

Pruébalo tú mismo — sin necesidad de registrarte

Ejecuta cualquiera de las 29 herramientas de scraping y extracción de CrawlForge en el playground y luego empieza gratis con 1,000 credits.

1,000 credits gratis • Por única vez • No se requiere tarjeta de crédito

Etiquetas

mcparchitectureb2bcitationslighthouse

Sobre el autor

C

CrawlForge Team

Equipo de Ingeniería

Construimos el MCP server de web scraping más completo. Creamos herramientas que ayudan a los desarrolladores a extraer, analizar y transformar datos web para aplicaciones de IA.

Mantente al día con los últimos artículos

Recibe tutoriales, novedades del producto y consejos de web scraping en tu bandeja de entrada.

Sin spam. Cancela tu suscripción cuando quieras.

Ponlo en práctica

Prueba las herramientas de CrawlForge en cualquier URL — gratis, sin registro.

En esta página

Frequently Asked Questions

¿LightAudit Score ya está disponible?+

Todavía no — se lanza pronto. El repositorio se hará público en breve, y hasta que llegue ese momento la web mantiene una lista de acceso anticipado que te envía el enlace el día que salga. Todo lo que describe este post es cómo funciona el producto final: gratuito, con licencia MIT, ejecutándose en tu propia máquina y con el servidor de investigación desactivado por defecto tras un interruptor en Ajustes.

¿Debo distribuir un MCP server dentro de mi producto o llamar directamente a la API?+

Distribuye el MCP server cuando quien llama es un modelo que decide qué tool usar, y llama a la API REST cuando decide tu propio código. LightAudit distribuye el servidor porque el análisis es un modelo leyendo datos de auditoría y eligiendo qué consultar; un pipeline fijo que siempre busca y luego siempre lee tres páginas sería más simple como tres llamadas HTTP. El protocolo se gana su sitio al dejar elegir al modelo, que es exactamente por lo que la lista de tools concedidas importa tanto.

¿Cómo evito que el modelo llame a tools caras?+

No te fíes del prompt. Concede las tools que quieras y deniega el resto en la conexión, para que las caras ni siquiera estén en el catálogo que el modelo ve. LightAudit concede diez de las veintinueve tools de CrawlForge y deniega de plano los crawlers de sitios, los trabajos por lotes, la automatización de navegador y deep_research, lo que limita un análisis a unos 11 credits independientemente de lo que el modelo hubiera preferido hacer.

¿Qué pasa si el servidor de investigación no está disponible?+

La función tiene que seguir funcionando sin él, y tiene que decirlo. En LightAudit el análisis se diagnostica solo con los datos de auditoría y el resultado lleva una etiqueta llana de "Sin investigación web", junto al proveedor y el modelo que lo produjo. Nunca recurre a citar de memoria. Diseñar esa ruta primero es lo que evita que una caída en una dependencia se convierta en información inventada dentro de tu producto.

¿Mis usuarios tienen que darle a mi app su API key de CrawlForge?+

No deberían tener que hacerlo, y en LightAudit no lo hacen. CrawlForge se autentica desde su propia configuración, escrita por su propio asistente de instalación, así que la key nunca pasa por la app. Eso elimina toda la cuestión de la custodia de tu revisión de seguridad: ninguna key en tu base de datos, en tus logs ni en un paquete de soporte. Prefiere este arreglo para cualquier integración que pueda autenticarse por su cuenta.

¿Por qué fijar la versión del MCP server en vez de usar npx -y paquete@latest?+

Porque en un producto distribuido, @latest significa que tus clientes ejecutan código que nadie de tu equipo ha leído. Fijarla a una versión revisada — crawlforge-mcp-server@5.6.6 en lugar del nombre pelado del paquete — mueve la actualización a tu revisión de dependencias habitual, donde una persona lee antes un changelog. También hace reproducibles los incidentes, cosa que una versión flotante no consigue, porque latest ya se habrá movido para cuando investigues.

¿Cuántos credits cuesta un análisis con citas?+

Unos 11 credits: una llamada a search_web por 5 credits más tres lecturas de extract_content a 2 cada una. Los análisis guardados se releen gratis, así que un informe abierto por una segunda persona no cuesta nada. Una cuenta nueva recibe 1.000 credits gratis sin tarjeta, que son unos noventa análisis con citas — suficiente para decidir si la función merece pagarse antes de que se le pida a nadie.

Artículos relacionados

MCP server de búsqueda web con LLM local: qué modelo se ejecuta
AI Engineering

MCP server de búsqueda web con LLM local: qué modelo se ejecuta

search_web encuentra las páginas; un modelo local de Ollama las lee. CrawlForge elige ese modelo por precisión medida, no por número de parámetros — y uno de 4B gana a uno de 20B.

C
CrawlForge Team
|
31 ago
|
4m
MCP server de búsqueda web autoalojado
AI Engineering

MCP server de búsqueda web autoalojado

La mayoría de los MCP server "autoalojados" solo ejecutan el proceso en local. CrawlForge puede apuntar search_web a tu propia instancia de SearXNG — y esto es lo que sigue sin ser autoalojado.

C
CrawlForge Team
|
28 ago
|
4m
El protocolo MCP explicado: una guía para desarrolladores en 2026
AI Engineering

El protocolo MCP explicado: una guía para desarrolladores en 2026

Aprende cómo funciona el Model Context Protocol, por qué importa para los agentes de IA y cómo construir MCP servers y clientes con diagramas de arquitectura y código.

C
CrawlForge Team
|
27 abr
|
10m

Pie de página

CrawlForge MCP

Web scraping empresarial para agentes de IA. 29 herramientas MCP especializadas diseñadas para desarrolladores modernos que crean sistemas inteligentes.

Producto

  • Funciones
  • Playground
  • Precios
  • Casos de uso
  • Integraciones
  • Alternativas
  • Registro de cambios

Recursos

  • Primeros pasos
  • Referencia de la API
  • Plantillas
  • Guías
  • Blog
  • Glosario
  • Preguntas frecuentes
  • Mapa del sitio

Desarrolladores

  • Protocolo MCP
  • Claude Desktop
  • Cursor IDE
  • LangChain
  • LlamaIndex

Empresa

  • Acerca de
  • Contacto
  • Privacidad
  • Términos
  • Uso aceptable
  • Cookies

Mantente al día

Recibe las últimas novedades sobre nuevas herramientas y funciones.

Creado con Next.js y el protocolo MCP

© 2025-2026 CrawlForge. Todos los derechos reservados.