Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

news.futunn+1officechai+1memeburn+1Le modèle Qwen3.8-Max d'Alibaba s'est hissé à la première place de l'Agentic Index d'Artificial Analysis avec un score de 55.4, devançant de peu Claude Opus 5 d'Anthropic (55.3 points) et GPT 5.6 d'OpenAI, selon les derniers classements publiés cette semaine par l'organisation de référence. C'est la première fois qu'un modèle d'IA chinois occupe la tête du classement des capacités agentiques, qui mesure l'aptitude d'un modèle à résoudre de manière autonome des problèmes complexes en plusieurs étapes.news.futunn+1
Les actions d'Alibaba cotées à Hong Kong ont bondi d'environ 7% suite aux excellentes performances du modèle sur plusieurs classements.memeburn
Le modèle de 2,4 billions de paramètres, dévoilé le 3 août, utilise une architecture de mélange d'experts qui active environ 95 milliards de paramètres par passage. Il a également obtenu un score de 56 sur l'Intelligence Index d'Artificial Analysis, se plaçant au niveau de Claude Opus 4.8 et devant les modèles de Google Alphabet Inc. , Meta et xAI.officechai+2
Une grande partie des gains de Qwen3.8-Max en matière d'agentivité provient d'un changement dans son approche des tâches. Le modèle effectue en moyenne 64 tours dans l'évaluation GDPval-AA, contre 14 pour son prédécesseur Qwen3.7 Max, avec une utilisation des jetons d'entrée multipliée par environ 15. Ce calcul supplémentaire permet d'obtenir des scores plus élevés, mais augmente également les coûts par tâche à 1,14 dollar, soit plus du double des 0,53 dollar du Qwen3.7 Max.officechai
Alibaba a annoncé qu'elle publierait les poids du modèle la semaine prochaine, ce qui ferait de Qwen3.8-Max le plus grand modèle à poids ouverts disponible, environ six fois plus grand que la précédente version ouverte majeure d'Alibaba. La tarification de l'API par jeton est fixée à 2,00 dollars par million de jetons d'entrée et 6,00 dollars par million de jetons de sortie, soit un coût inférieur à celui de son prédécesseur.venturebeat+1
Ce lancement intensifie une tendance où les laboratoires chinois comblent l'écart avec les développeurs de pointe américains. Le modèle Kimi K3 de Moonshot AI, avec 2,8 billions de paramètres, reste en tête des modèles chinois sur l'Intelligence Index avec un score de 57, mais Qwen3.8-Max ne se situe désormais qu'à un point derrière. VentureBeat a noté que le modèle surpasse également GPT-5.6 Sol Max et Fable 5 sur OSWorld-Verified, un benchmark d'utilisation d'ordinateurs de bureau.officechai+1
Les gains ne sont pas uniformes. Le taux d'hallucination de Qwen3.8-Max est passé de 23% à 40% lors de l'évaluation AA-Omniscience, ce qui signifie qu'il tente désormais de répondre à des questions qu'il refusait auparavant, tout en commettant davantage d'erreurs. Anthropic et OpenAI conservent une avance au sommet de l'Intelligence Index global, et les coûts par tâche pour le travail agentique restent plus élevés que ceux de plusieurs concurrents dans la même catégorie de performance.officechai