Ingeniería de IA
Crear aplicaciones de IA con datos web.
Agente de scraping: qué es y cómo construir uno
Un agente de scraping persigue un objetivo, no un selector. Qué significa eso, las tres formas de construir uno, código funcional, los fallos reales y las cuentas en credits.
SSRF en MCP servers: por qué los scrapers filtran secretos
Un estudio de julio de 2026 halló que el 91,8% de los MCP servers auditados no tiene autenticación. Por qué los servidores de scraping filtran credenciales de la nube y cómo evitarlo.
Las mejores herramientas de web scraping para agentes de IA en 2026
Las mejores herramientas de web scraping para agentes de IA en 2026, clasificadas por su preparación para agentes: descubrimiento de herramientas nativo de MCP, esquemas tipados y salida eficiente en tokens.
Extrae datos web con LLMs locales (Ollama + CrawlForge)
Sin API keys, sin nube, sin que tus datos salgan de tu máquina. Usa extract_with_llm con Ollama local para extraer datos estructurados de cualquier sitio.
El protocolo MCP explicado: una guía para desarrolladores en 2026
Aprende cómo funciona el Model Context Protocol, por qué importa para los agentes de IA y cómo construir MCP servers y clientes con diagramas de arquitectura y código.
Cómo crear un pipeline de RAG con datos web
Crea un pipeline de RAG en producción que rastrea sitios web, extrae contenido, divide el texto en fragmentos, genera embeddings y sirve respuestas con generación aumentada por recuperación.
Scraping en modo sigiloso: cómo CrawlForge evade la detección anti-bot
Análisis técnico en profundidad de los sistemas de detección anti-bot y de cómo las funciones de modo sigiloso de CrawlForge te ayudan a hacer scraping de sitios web protegidos de forma ética y eficaz.
Web scraping para datos de entrenamiento de IA: guía completa 2026
Aprende a recopilar, limpiar y estructurar datos web para entrenar IA. Buenas prácticas para scraping ético, calidad de datos y preparación de fine-tuning de LLM.