BrowserSkill es un CLI y extensión open source de Tencent que permite a Claude Code, Codex o Cursor usar tu Chrome o Edge real, con la sesión ya iniciada. El agente trabaja con tus sesiones y tus cookies, pero en una ventana aparte, así que puedes seguir usando tu navegador mientras tanto.
La versión 0.3.1 de la extensión y del CLI bsk salió el 23 de septiembre de 2026, y todo lo que sigue corresponde a esa versión. El proyecto todavía es pre-1.0 y avanza rápido: los comandos y flags pueden cambiar.
¿Qué es BrowserSkill?
BrowserSkill es un puente local entre tu agente de programación y tu navegador. Tiene tres piezas:
- El CLI
bsky su daemon. El agente ejecuta comandosbsken la terminal. Un daemon local los envía por WebSocket en127.0.0.1a la extensión. - La extensión, para Chrome y Microsoft Edge. Abre una Agent Window dedicada y ejecuta ahí las acciones del agente. Tus ventanas normales no se tocan.
- Un skill. Es un archivo
SKILL.mdque le enseña a tu harness de agentes a usarbsk: iniciar una sesión, leer la página, actuar y cerrar siempre la sesión al terminar.
El agente nunca habla directamente con el navegador. Cada acción recorre CLI → daemon → extensión → Agent Window.
El README lista estos harnesses compatibles: Cursor, Claude Code, Codex, OpenClaw, CodeBuddy, WorkBuddy, Pi, Hermes Agent y DeepSeek Harness. DeepSeek Harness usa un plugin propio en lugar del skill. Cualquier otro harness que pueda ejecutar comandos de shell puede usar el skill copiando skill/SKILL.md en su carpeta de skills como browser-skill/SKILL.md.
¿Por qué usar tu navegador real y no un headless browser?
Porque un headless browser empieza sin ninguna sesión iniciada. Cada tarea que toca un sitio con login (tu panel de administración, un entorno de staging detrás de SSO, un dashboard SaaS, un ticket en tu gestor de incidencias) exige cuentas de prueba, credenciales guardadas o un flujo de login que el agente tiene que superar. BrowserSkill se salta ese paso: el agente trabaja con los sitios donde ya tienes la sesión iniciada. Es browser automation for AI agents sobre un logged-in browser, no sobre un navegador vacío.
Para hacer scraping de páginas públicas, correr en CI o cualquier cosa que deba funcionar sin escritorio, headless sigue siendo la herramienta correcta. Cubrimos ese lado en cómo darle un navegador a tu agente de IA sin cargar Chromium y en Lightpanda. BrowserSkill es para el caso opuesto: automatizar el navegador con IA en tareas que solo tienen sentido dentro de tu sesión.
¿Cómo se instala BrowserSkill?
La forma recomendada es que lo instale tu propio agente. Pega esta línea en Claude Code, Codex o Cursor:
Set up browser-skill on this machine by following https://raw.githubusercontent.com/Tencent/BrowserSkill/main/AGENT_INSTALL.md
El agente instala el CLI y el skill, y luego te guía para cargar la extensión.
Para instalarlo a mano:
1. Instala el CLI bsk. En macOS o Linux:
curl -fsSL https://raw.githubusercontent.com/Tencent/BrowserSkill/main/install.sh | sh
export PATH="${BSK_INSTALL_DIR:-$HOME/.local/bin}:$PATH"
En Windows (PowerShell):
irm https://raw.githubusercontent.com/Tencent/BrowserSkill/main/install.ps1 | iex
Compruébalo con bsk --version. Si tu agente ya estaba abierto durante la instalación, puede que siga con el PATH anterior: reinícialo.
2. Instala la extensión desde la Chrome Web Store o desde Edge Add-ons. El README advierte que la versión de las tiendas puede ir por detrás de la del CLI.
3. Instala el skill en tu harness:
bsk install-skill
Elige el harness con la barra espaciadora y pulsa Enter. Para una instalación no interactiva, indica el harness de forma explícita, por ejemplo bsk install-skill --harness cursor --json.
4. Verifica. Ejecuta bsk doctor, abre el popup de la extensión y confirma que aparece como conectada.
¿Cómo se usa BrowserSkill desde Claude Code?
Abre una sesión nueva del agente, confirma que browser-skill está disponible y dale una tarea. En los harnesses con skills invocables por slash command:
/browser-skill abre example.com y resume lo que hay en la página.
Detrás de esa línea, el skill obliga al agente a seguir un ciclo fijo:
bsk session start # imprime un id de sesión de 4 letras
bsk navigate <url> --session <id>
bsk snapshot --session <id> # árbol de accesibilidad con refs @e1, @e2…
bsk click @e3 --session <id> # o fill, select, press
bsk session stop <id> # obligatorio, incluso si hay errores
El agente lee las páginas primero con bsk snapshot y solo recurre a get-html o screenshot cuando el snapshot no alcanza. Así gasta menos tokens, que es el mismo argumento que usa el README de Playwright MCP, de Microsoft, para recomendar CLI + skills en lugar de MCP en agentes de programación.
¿Qué puede hacer que un navegador headless no puede?
Reutilizar tu login. Apunta el agente a tu admin de staging, a tu dashboard de analítica o a la preview de un PR detrás de SSO: ya está autenticado.
Tomar prestada una pestaña que tienes abierta. Por defecto, tus propias pestañas son de solo lectura para el agente. Para actuar sobre una, tiene que tomarla prestada de forma explícita (bsk tab borrow <tab-id> --session <id>), lo que la mueve a la Agent Window. Por defecto, la extensión te pide confirmación antes. La pestaña vuelve a su sitio cuando el agente ejecuta bsk tab return o cierra la sesión.
Pasarte lo que solo puede hacer una persona. Cuando una tarea se encuentra con un CAPTCHA, un login, un código OTP o una acción que conviene confirmar, el agente puede llamar a bsk request-help con una instrucción y el elemento resaltado en pantalla. Luego espera a que pulses Continuar o Cancelar. El agente recibe el resultado como continued, cancelled, timed_out o navigated.
¿Qué hay de nuevo en BrowserSkill 0.3?
Las notas de la versión 0.3.1 se comparan contra la 0.2.1, así que cubren toda la serie 0.3:
- Soporte para canvas. El agente ahora puede detectar elementos canvas, capturar su región visible y hacer clic en puntos dentro de ellos. Eso importa en gráficos, editores y mapas, que son invisibles para un árbol de accesibilidad.
- Capturas de página completa, desde las acciones rápidas de la extensión o desde el CLI:
bsk screenshot --session <id> --full-page --out page.png. - Pestañas de tarea en segundo plano. Las pestañas controladas siguen trabajando, y se pueden capturar, sin pasar a primer plano.
- Conexiones remotas autenticadas. El agente puede correr en un servidor mientras la extensión controla tu navegador local. La extensión abre una conexión saliente, así que tu equipo no necesita puertos de entrada. El emparejamiento usa un enlace de un solo uso que, por defecto, caduca a los cinco minutos.
- Historial local de ejecución de tareas y diagnósticos persistentes de sitios web.
- Ajustes de automatización en el popup. «Confirmar antes de tomar prestadas pestañas» y «Permitir solicitudes de ayuda humana» vienen activados por defecto. Esto cambia el comportamiento anterior: el flag
--unattended,tab borrow --no-confirmyBSK_REQUEST_HELP=offya no se saltan estos ajustes. Si tienes scripts que dependían de ellos, desactiva los ajustes en la extensión. - Ocho idiomas nuevos en la extensión, entre ellos español (
es-ES) y portugués de Brasil.
La versión suma nueve contribuidores nuevos.
¿BrowserSkill o Playwright MCP?
Los dos pueden usar tu navegador con la sesión iniciada. El modo --extension de Playwright MCP se conecta a un Chrome o Edge abierto a través de su propia extensión. Así que la elección depende de cómo se comporta cada uno:
- Interfaz. BrowserSkill es un CLI con un skill. Playwright MCP es un servidor MCP con un catálogo amplio de herramientas.
- Dónde trabaja el agente. BrowserSkill siempre trabaja en una Agent Window separada, y tus pestañas requieren un préstamo explícito. Playwright MCP, por defecto, abre su propio perfil persistente, guardado por separado para cada workspace y distinto de tu navegador de uso diario. Para conectarlo a tu navegador abierto se usa
--extension. - Traspaso a una persona. En BrowserSkill es una primitiva incorporada (
request-help). - Madurez. Playwright MCP viene del equipo de Playwright y soporta Chrome, Edge, Firefox y WebKit. BrowserSkill es pre-1.0 y, por ahora, solo funciona con navegadores Chromium.
Si ya tienes Playwright MCP conectado a tu agente y sobre todo pruebas tus propias aplicaciones, probablemente no necesitas cambiar. Si quieres que el agente trabaje a tu lado en tu navegador de todos los días, con una separación clara entre sus pestañas y las tuyas, BrowserSkill está pensado para eso.
¿Funciona en Windows y Firefox? ¿Es gratis?
- Windows: sí. Funciona en macOS (Apple Silicon e Intel), Linux (x64 y ARM64) y Windows x64.
- Firefox: todavía no. Al 23 de septiembre de 2026, el README lo marca como planificado. Chrome y Edge están soportados, y otros navegadores Chromium deberían funcionar con la versión de la Chrome Web Store.
- Precio: es gratis y tiene licencia MIT. El costo del modelo que use tu agente va aparte.
¿Es seguro darle tu navegador a un agente de IA?
Es tan seguro como el agente que conectes y las páginas a las que lo envíes. El mayor riesgo abierto es el prompt injection. BrowserSkill añade protecciones reales, pero no elimina ese riesgo.
Lo que aporta el proyecto:
- El agente trabaja en su propia ventana.
- Tomar prestadas tus pestañas requiere confirmación por defecto.
- El skill incluye límites explícitos: no leer cookies,
localStorageni cabeceras de autenticación para extraerlas; no ejecutarbsk evaluateen páginas de bancos, SSO o gestores de contraseñas; cerrar siempre la sesión. - La guía de conexiones remotas es directa: un servidor emparejado puede actuar con todas las sesiones iniciadas en ese perfil del navegador. Su consejo es emparejar solo con servidores de confianza. Los permisos de emparejamiento se pueden listar y revocar (
bsk daemon devices,bsk daemon revoke).
Lo que falta es un modelo de amenazas en la portada del proyecto. Una página que el agente lee puede contener texto diseñado para desviarlo, y tus sesiones iniciadas son justo lo que buscaría un atacante. En la serie 0.3 se actualizó el skill para decirle al agente que el contenido de las páginas es información, nunca instrucciones. Es una indicación para el modelo, no algo que la herramienta imponga.
Reglas prácticas:
- Usa un perfil de navegador separado para el trabajo con agentes, con sesión iniciada solo en lo que el agente necesita.
- Mantén activados los dos ajustes de automatización hasta que confíes en un flujo.
- No mandes al agente a sitios que no son de confianza mientras tenga acceso a sesiones importantes.
¿Vale la pena probarlo?
Si tu agente se queda atascado una y otra vez en pantallas de login, sí. La instalación guiada por el agente es una sola línea, la Agent Window separada te deja seguir usando tu navegador, y la primitiva de ayuda humana resuelve justo los pasos que un agente no debería hacer solo. Empieza con un perfil dedicado y con las confirmaciones activadas. Si estás configurando Claude Code desde cero, nuestra guía para la terminal cubre lo básico primero.