Un MCP es la forma estándar en que un agente de programación con IA se conecta a una herramienta que no trae de fábrica — y sí, uno puede darle búsqueda web a tu agente. wigolo es un servidor MCP que hace exactamente eso, y corre por completo en tu máquina.
Si usaste Claude Code, Cursor o Codex por más de una semana, ya chocaste con el límite: el agente razona muy bien sobre el código que tiene delante y no sabe nada de la web. Le preguntas por una librería publicada después de su fecha de corte y adivina. MCP es el protocolo que cierra esa brecha, y wigolo es una de las cosas más interesantes conectadas a él hoy.
¿Qué es un MCP?
MCP — Model Context Protocol — es una especificación de cómo un agente de IA se conecta a una capacidad externa. Piénsalo como un puerto: el agente habla un solo protocolo, y cualquier cosa que implemente ese protocolo se puede enchufar.
La consecuencia importante es que el agente no necesita saber de antemano a qué lo van a conectar. Un servidor MCP declara las herramientas que ofrece, el agente las descubre en tiempo de ejecución, y desde ahí puede llamarlas igual que llama a cualquier función propia. Un MCP de sistema de archivos le da tus archivos. Un MCP de base de datos le da tu esquema. Un MCP de web le da internet.
Un “servidor MCP” es simplemente un programa que implementa esto. Normalmente corre en local, se comunica por stdio y arranca cuando arranca tu agente. Por defecto no hay nada alojado en la nube, y nada en el protocolo exige un servicio externo — un detalle que conviene retener, porque es justamente el supuesto que wigolo ataca.
¿Un MCP puede darle búsqueda web a mi agente?
Sí, y es una de las razones más comunes para instalar uno.
La ruta habitual es una API de búsqueda alojada — Firecrawl, Exa, Tavily — alcanzada a través de un envoltorio MCP. Funciona, y factura por consulta. La curiosidad de tu agente se convierte en una línea de gasto, y eso cambia cómo lo usas: empiezas a racionar los rastreos.
wigolo toma el camino contrario. La búsqueda, la descarga, el rastreo, la extracción y el reordenamiento corren sobre tu propio hardware. El núcleo no requiere ninguna API key, y nada sale de tu máquina salvo que lo actives explícitamente.
¿Qué hace wigolo exactamente?
El README documenta ocho herramientas que el agente puede llamar:
- search — recuperación multi-motor con puntuación explicable por resultado
- fetch — carga de URLs que escala automáticamente de HTTP plano a suplantación TLS y luego a navegador headless
- crawl — rastreo de múltiples páginas que respeta
robots.txty se autolimita - extract — datos estructurados de una página: tablas, JSON-LD, esquemas
- cache — consulta resultados ya guardados por palabra clave o de forma semántica
- find_similar — páginas relacionadas por fusión de keyword, semántica y búsqueda en vivo
- research — descompone una pregunta en subconsultas y sintetiza un informe con citas
- agent — ciclos autónomos de recolección con planificación y registro de pasos
La escalada de fetch es la parte que vale la pena mirar con calma. La mayoría del scraping se rompe porque el sitio rechaza a un cliente HTTP ingenuo. wigolo prueba primero lo barato y solo paga el costo de un navegador real cuando el camino barato falla — el mismo instinto detrás de Scrapling, que cubrimos antes, aplicado a toda la ruta de recuperación de un agente y no a un scraper puntual.
El ranking, la deduplicación y la canonicalización son deterministas y locales. Las llamadas a un LLM quedan reservadas para la síntesis, y hasta eso es opcional.
¿Cómo se instala wigolo?
Necesitas Node 20 o superior y alrededor de 1,5 GB de disco libre para los modelos locales. Funciona en macOS, Linux y Windows.
npx wigolo init --non-interactive --agents=claude-code
Los valores admitidos para --agents son claude-code, cursor, codex, gemini-cli, vscode, windsurf, zed y antigravity. Después revisa que haya levantado limpio:
npx wigolo doctor
Para cualquier cliente compatible con MCP que no esté en esa lista, regístralo manualmente:
{
"mcpServers": {
"wigolo": {
"command": "npx",
"args": ["-y", "wigolo"]
}
}
}
También hay imagen de contenedor:
docker run -i --rm -v wigolo-data:/data ghcr.io/knockoutez/wigolo
La síntesis opcional se activa con variables de entorno: WIGOLO_LLM_PROVIDER acepta gemini, anthropic, openai o groq, con la clave del proveedor correspondiente. WIGOLO_SEARCH=hybrid suma respaldo de agregadores a los motores del núcleo, y WIGOLO_EAGER_WARMUP=1 precarga los modelos al arrancar.
En cada llamada, el agente puede pasar mode (cache, default, stealth), search_depth (de ultra-fast a deep), una strategy de rastreo (bfs, dfs, sitemap, map) e include_domains para restringir la recuperación a las fuentes en las que confías.
¿Es tan bueno como Firecrawl, Exa o Tavily?
El proyecto publica una comparación a cuatro bandas contra Firecrawl, Exa y Tavily en la que reclama paridad para las consultas cotidianas de un agente, más dos cosas que según ellos las demás no tienen: extractos textuales anclados a posiciones de byte en la fuente, y descomposición de la puntuación de cada resultado. Son mediciones propias del mantenedor, no benchmarks independientes, y así hay que leerlas — aunque la afirmación sobre la trazabilidad a nivel de byte es lo bastante inusual como para que valga la pena comprobarla por tu cuenta.
Las advertencias honestas: al momento de publicar esta nota, en septiembre de 2026, wigolo está en beta pública en la versión 0.2.1, publicada el 19 de julio de 2026. Está en desarrollo activo y su superficie todavía puede moverse.
La licencia es AGPL-3.0-only. Puedes autoalojarlo en toda una empresa sin costo; si lo modificas y lo corres como servicio de red, publicas las modificaciones. El mantenedor es explícito en que esto es deliberado — impide que el proyecto se cierre más adelante convertido en un producto alojado. Hay licenciamiento comercial disponible para quien necesite otros términos.
¿Vale la pena instalarlo?
Si tu agente ya tiene acceso web con el que estás conforme, esto es un cambio de pieza, no una revelación. Si no lo tiene — o si la recuperación medida está condicionando con cuánta libertad dejas explorar al agente — es una instalación de una línea que elimina el medidor por completo.
Empieza por search y fetch. research y agent son las interesantes, pero vas a entender mucho mejor lo que hacen después de haber visto funcionar la recuperación básica.
mcp servidores-mcp busqueda-web agentes-ia open-source
Claude Code