DESDE LA FRONTERA
Un nuevo estudio finalmente nos muestra cómo desempeñan los agentes de IA en trabajos reales
Creado con Midjourney
¿Realmente puedes usar agentes de IA para ser más eficiente en el trabajo? Aquí está lo que dice un nuevo estudio.
Índice de Productividad Humana+ de Upwork (HAPI). El HAPI de Upwork es una de las primeras evaluaciones basadas en datos sobre el desempeño de agentes de IA en trabajos reales para clientes. El estudio probó agentes de IA de tres modelos punteros (Claude Sonnet 4, Gemini 2.5 Pro y OpenAI GPT-5) en 300 proyectos de Upwork, seleccionando específicamente tareas simples que los agentes de IA podrían manejar razonablemente.
Donde los agentes de IA sí (y no) destacan. Los resultados de la prueba mostraron que los agentes de IA funcionan mejor en tareas con respuestas objetivamente correctas, como matemáticas o codificación básica. Pero en trabajos cualitativos, como diseñar páginas de aterrizaje o redactar contenido de marketing, los agentes tuvieron dificultades — al menos sin orientación humana.
Para mejores resultados, añade expertos humanos. Los agentes de IA funcionaron mucho mejor cuando se incorporaron expertos humanos. En promedio, las tasas de finalización de trabajos aumentaron un 70 % cuando humanos y agentes colaboraron, en comparación con los agentes trabajando solos. Este patrón fue consistente en diferentes estilos de trabajo.
No abandones los agentes todavía. ¿Significa esto que aprender a usar agentes de IA es una pérdida de tiempo? Para nada. El CTO de Upwork, Andrew Rabinovich, señala que “donde un proyecto podría tomarle días a un freelancer completarlo de forma independiente, el enfoque de agente más humano puede entregar resultados en horas mediante ciclos iterativos de trabajo automatizado y refinamiento experto”.
Los resultados de Upwork muestran que la experiencia humana dirigiendo la potencia de la IA puede ayudar a comprimir días de trabajo en horas.
vía Superhuman
