Los agentes de IA capaces de operar ordenadores han cruzado un doble punto de inflexión tanto en coste como en precisión, según una nueva investigación publicada por Fabrizio Serafini, socio de Andreessen Horowitz. Estos hallazgos marcan un punto de inflexión…
Una investigación de Andreessen Horowitz reveló que el modelo líder, Claude Fable 5, alcanza una puntuación del 85% en la prueba de rendimiento OSWorld-Verified, superando el 72% de los evaluadores humanos.a16z
Hace un año, el mejor modelo de IA apenas alcanzaba el 42% en las mismas tareas; la implementación en entornos de producción se volvió viable tras el salto de capacidades a principios de 2026, según a16z.a16z
La ventaja competitiva sostenible se ha desplazado de la capacidad del modelo al contexto del flujo de trabajo: un operador que ejecuta millones de tareas mensuales ni siquiera sabe qué modelo impulsa el sistema.a16z