Jev Ultrafast: cómo funciona su agente de navegador por dentro

Jev Ultrafast es un agente de navegador que utiliza Jev para elegir acciones y un modelo de lenguaje independiente para escribir en los campos de texto.

Esa división resulta más interesante cuando sigues una acción desde la observación hasta la ejecución. La aplicación construye las opciones disponibles, las vincula con elementos reales de la página y comprueba si una decisión sigue siendo válida antes de actuar.

Para quienes desarrollan automatizaciones de navegador, vale la pena examinar ese código. La latencia del modelo es solo una parte del tiempo que un agente necesita para completar una tarea.

Este artículo analiza el código y la documentación publicados al 22 de septiembre de 2026. No hemos ejecutado el proyecto ni reproducido sus mediciones de forma independiente.

¿Qué diferencia hay entre Jev y Jev Ultrafast?

Jev es el modelo de decisiones de TypeSafe; Jev Ultrafast es una aplicación de navegador construida sobre él.

Jev evalúa el estado de una aplicación y devuelve opciones, puntuaciones o probabilidades estructuradas. La aplicación de navegador aporta ese estado y convierte las opciones seleccionadas en interacciones. Nuestra guía sobre Jev de TypeSafe explica el modelo y sus usos más generales.

Aquí interesa entender cómo la aplicación convierte una página cambiante en algo que un modelo de decisiones puede manejar. Documentación de TypeSafe

¿Cómo funciona Jev Ultrafast al elegir las acciones del navegador?

El agente construye una tabla indexada de los controles observados y agrupa los destinos válidos según la operación.

Un campo de texto puede recibir escritura. Un botón puede recibir un clic. Un desplegable compatible expone las opciones observadas. Las opciones disponibles cambian cuando cambia la página.

El modelo recibe la URL, el título, el texto visible, la tabla de elementos y el historial de acciones recientes. Selecciona a partir de esa representación.

Por eso importa la capa de observación: un control ausente o mal descrito cambia lo que el modelo puede elegir. Una predicción más rápida no compensa una representación de la página que omite la acción necesaria. Implementación del espacio de acciones

¿Cómo elige una operación y un elemento en una sola petición?

La aplicación envía la pregunta sobre la operación junto con preguntas independientes sobre el elemento correspondiente a cada tipo de interacción compatible.

Conceptualmente, pregunta qué operación debe realizarse a continuación, en qué elemento haría clic y qué campo recibiría texto.

Solo utiliza la respuesta sobre el elemento que corresponde a la operación seleccionada. Elegir un clic no ejecuta también la acción de escritura propuesta.

Esta organización evita una segunda comunicación de ida y vuelta con el servicio para seleccionar el elemento después de elegir la operación. La aplicación valida las respuestas seleccionadas frente a las opciones que proporcionó. Implementación de las decisiones

¿Cuándo utiliza un modelo de lenguaje para escribir texto?

El modelo auxiliar de texto interviene cuando la acción elegida necesita un valor para un campo.

Jev decide dónde escribir. El modelo auxiliar recibe el objetivo, el campo seleccionado, el contexto de la página y las acciones recientes para producir el texto. En el ejemplo de vuelos documentado, así se generan los nombres de las ciudades.

El bucle comprueba que la página siga vigente antes de solicitar el texto y otra vez antes de introducirlo. Si un cambio de página interrumpe la ejecución y obliga a reintentar, solo puede reutilizarse un valor generado cuando todo el contexto de entrada del modelo auxiliar permanece idéntico.

Esa condición importa: un texto preparado para un campo o un estado concreto de la página no debería trasladarse silenciosamente a otro contexto. Bucle del agente

¿Qué ocurre si la página cambia antes de hacer clic?

El ejecutor comprueba el estado observado y calcula la posición actual del elemento antes de interactuar.

Para los clics y las selecciones, las comprobaciones examinan el documento y el estado relacionado con el elemento. La ejecución también comprueba que este siga existiendo, esté habilitado y visible, y no quede cubierto por otro elemento.

Estas comprobaciones abordan un problema habitual de la automatización de navegadores: una decisión puede referirse a una página que ya cambió. Puede aparecer una ventana superpuesta, reemplazarse un control o actualizarse un formulario mientras la petición al modelo está en curso.

La implementación también trata con cautela una selección interrumpida en un desplegable. Si no puede confirmar la ejecución, se detiene para que se inspeccione el estado, en lugar de asumir que repetir la acción es inocuo. Ejecutor del navegador

El bucle consume la decisión pendiente antes de intentar ejecutarla y registra la acción ejecutada antes de volver a observar. Estas decisiones de diseño ayudan a evitar que un reintento repita una decisión ya consumida o que se pierda el registro de una acción si falla la siguiente observación. Bucle del agente

¿De dónde sale la mejora de velocidad de Jev Ultrafast?

La comparación del proyecto atribuye la mejora a cambios en el código de ejecución del navegador, manteniendo los mismos modelos.

Ambas versiones utilizaron Jev y Mercury. En tres pares de pruebas, la mediana del tiempo de la tarea bajó de 9,450 a 7,092 segundos, una reducción del 25 %. La mediana de llamadas al protocolo del navegador pasó de 1.092 a 101.

El informe describe varios cambios: leer los controles de forma conjunta, evitar invalidar decisiones por cada modificación irrelevante del DOM y esperar brevemente a que aparezcan las sugerencias de autocompletado antes de solicitar otra decisión.

Son resultados publicados por el autor para una tarea y un perfil de navegador. Justifican examinar el diseño del código de ejecución; no establecen una ventaja general de velocidad frente a otros agentes.

La demostración grabada de 7,073 segundos buscó vuelos. No realizó una reserva. La medición excluye la preparación del navegador, la navegación inicial y la verificación independiente posterior. El importe informado para el modelo auxiliar de texto tampoco incluye los demás costes de la tarea. Metodología de rendimiento

¿Cómo instalar Jev Ultrafast para inspeccionarlo localmente?

El repositorio documenta un inspector local para observar las decisiones y las acciones ejecutadas.

Estas son sus instrucciones de instalación:

git clone https://github.com/browser-use/jev-ultrafast.git
cd jev-ultrafast
uv sync
cp .env.example .env

Añade las credenciales documentadas TYPESAFE_API_KEY y TEXT_MODEL_API_KEY a .env y ejecuta:

uv run jev

Abre http://127.0.0.1:8766. El inspector muestra elementos numerados, probabilidades de las operaciones, probabilidades de los elementos de destino y acciones ejecutadas. Choose next permite detenerse antes de la ejecución.

Al 22 de septiembre de 2026, la configuración de ejemplo utiliza una clave de OpenRouter para el modelo auxiliar de texto. Sigue la configuración vigente del repositorio cuando lo pruebes; los ejemplos con servicios reales realizan llamadas de pago a las API. Documentación de instalación

¿Qué tareas conviene evaluar primero con Jev Ultrafast?

Empieza con tareas acotadas que utilicen controles compatibles y cuyo resultado puedas comprobar de forma independiente.

Abrir una página específica o aplicar filtros conocidos proporciona un resultado concreto que verificar. Que el modelo seleccione DONE no demuestra que la tarea se haya completado correctamente.

Al 22 de septiembre de 2026, las limitaciones documentadas incluyen frames, shadow roots, canvas, cargas de archivos, pestañas emergentes, desplazamiento dentro de contenedores anidados y controles de teclado arbitrarios. Las pestañas también comparten el perfil de Chrome conectado. Utiliza un perfil dedicado sin sesiones sensibles durante la evaluación. Limitaciones del proyecto

Las decisiones tipadas tampoco eliminan el riesgo del contenido engañoso de una página. TypeSafe documenta susceptibilidad a entradas adversariales en sus limitaciones actuales de Jev. La autorización y la verificación del resultado siguen correspondiendo a mecanismos externos al modelo. Limitaciones de TypeSafe

Para los equipos de Iberoamerica, una evaluación útil mediría el tiempo completo de la tarea desde su región de despliegue, registraría fallos y reintentos, y contabilizaría ambos servicios de modelos.

La lección reutilizable está en la distribución de responsabilidades: el modelo selecciona entre posibilidades observadas; la aplicación define esas posibilidades, comprueba las condiciones de ejecución y verifica el resultado. Jev Ultrafast ofrece una implementación compacta para estudiar y un punto de partida para comprobar si ese diseño mejora tu propio flujo de trabajo.