Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

news.futunn+1officechai+1memeburn+1El modelo Qwen3.8-Max de Alibaba ha alcanzado la primera posición en el Agentic Index de Artificial Analysis con una puntuación de 55.4, superando por poco a Claude Opus 5 de Anthropic con 55.3 puntos y a GPT 5.6 de OpenAI, según las últimas clasificaciones publicadas esta semana por la organización de evaluación. Este resultado marca la primera vez que un modelo de IA chino ocupa el primer lugar en la tabla de clasificación de capacidades de agentes, que mide la habilidad de un modelo para resolver problemas complejos de varios pasos de forma autónoma.news.futunn+1
Las acciones de Alibaba que cotizan en Hong Kong subieron alrededor de un 7% tras el sólido desempeño del modelo en múltiples clasificaciones.memeburn
El modelo de 2.4 billones de parámetros, presentado el 3 de agosto, utiliza una arquitectura de mezcla de expertos que activa aproximadamente 95 mil millones de parámetros por paso hacia adelante. También obtuvo 56 puntos en el Intelligence Index de Artificial Analysis, situándose al nivel de Claude Opus 4.8 y por delante de modelos de Google Alphabet Inc. , Meta y xAI.officechai+2
Gran parte de las ganancias en capacidad de agente de Qwen3.8-Max provienen de un cambio en su enfoque de las tareas. El modelo promedia 64 turnos en la evaluación GDPval-AA, en comparación con los 14 de su predecesor Qwen3.7 Max, con un uso de tokens de entrada que aumentó aproximadamente 15 veces. Ese cómputo adicional impulsa puntuaciones más altas, pero también eleva los costos por tarea a 1.14 dólares, más del doble de los 0.53 dólares de Qwen3.7 Max.officechai
Alibaba ha anunciado que liberará los pesos del modelo la próxima semana, lo que convertiría a Qwen3.8-Max en el modelo de pesos abiertos más grande disponible, con aproximadamente seis veces el tamaño del mayor lanzamiento abierto anterior de Alibaba. El precio de la API por token se ha fijado en 2.00 dólares por millón de tokens de entrada y 6.00 dólares por millón de tokens de salida, siendo más barato que su predecesor.venturebeat+1
El lanzamiento intensifica una tendencia en la que los laboratorios chinos están cerrando la brecha con los desarrolladores de vanguardia de EE. UU. El modelo Kimi K3 de Moonshot AI, con 2.8 billones de parámetros, sigue liderando a los modelos chinos en el Intelligence Index con una puntuación de 57, pero Qwen3.8-Max ahora se sitúa solo un punto por detrás. VentureBeat señaló que el modelo también supera a GPT-5.6 Sol Max y Fable 5 en OSWorld-Verified, un punto de referencia de uso de computadoras de escritorio.officechai+1
Las mejoras no son uniformes. La tasa de alucinación de Qwen3.8-Max aumentó del 23% al 40% en la evaluación AA-Omniscience, lo que significa que ahora intenta responder preguntas que antes rechazaba y comete muchos errores. Anthropic y OpenAI mantienen una ventaja en la cima del Intelligence Index general, y los costos por tarea para el trabajo de agentes siguen siendo más altos que los de varios competidores en el mismo rango de rendimiento.officechai