Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

news.futunn+1officechai+1memeburn+1Alibaba'nın Qwen3.8-Max modeli, Artificial Analysis'in Agentic Index'inde 55.4 puanla zirveye yerleşerek Anthropic'in 55.3 puanlı Claude Opus 5 ve OpenAI'ın GPT 5.6 modellerini kıl payı geride bıraktı. Bu sonuç, bir Çin yapay zeka modelinin, bir modelin karmaşık ve çok adımlı problemleri otonom bir şekilde çözme yeteneğini ölçen bu liderlik tablosunda ilk kez birinci sıraya yerleştiğini gösteriyor.news.futunn+1
Alibaba'nın Hong Kong borsasında işlem gören hisseleri, modelin çeşitli listelerdeki güçlü performansının ardından yaklaşık %7 oranında değer kazandı.memeburn
3 Ağustos'ta tanıtılan 2.4 trilyon parametreli model, her ileri geçişte yaklaşık 95 milyar parametreyi aktif hale getiren bir uzmanların karışımı mimarisi kullanıyor. Model ayrıca daha geniş kapsamlı Artificial Analysis Intelligence Index'te 56 puan alarak Claude Opus 4.8 ile aynı seviyeye geldi ve Google Alphabet Inc. , Meta ve xAI'ın modellerini geride bıraktı.officechai+2
Qwen3.8-Max'in ajans yeteneklerindeki artışın büyük bir kısmı, görevlere yaklaşım biçimindeki değişimden kaynaklanıyor. Model, GDPval-AA değerlendirmesinde ortalama 64 adım atarken, selefi Qwen3.7 Max'te bu sayı 14'tü ve girdi token kullanımı yaklaşık 15 kat arttı. Bu ekstra hesaplama gücü daha yüksek puanlar sağlasa da, görev başına maliyeti Qwen3.7 Max'in 0.53 dolarlık maliyetinin iki katından fazla olan 1.14 dolara çıkarıyor.officechai
Alibaba, önümüzdeki hafta modelin ağırlıklarını yayınlayacağını açıkladı. Bu durum, Qwen3.8-Max'i Alibaba'nın önceki en büyük açık kaynaklı sürümünden yaklaşık altı kat daha büyük, mevcut en büyük açık ağırlıklı model haline getirecek. Token başına API fiyatlandırması, bir milyon girdi tokenı için 2.00 dolar ve bir milyon çıktı tokenı için 6.00 dolar olarak belirlendi; bu da selefinden daha ucuz.venturebeat+1
Bu sürüm, Çinli laboratuvarların ABD'li öncü geliştiricilerle arayı kapattığı bir modeli pekiştiriyor. 2.8 trilyon parametreye sahip Moonshot AI'ın Kimi K3 modeli, 57 puanla Intelligence Index'te Çinli modeller arasında liderliğini korusa da, Qwen3.8-Max artık sadece bir puan gerisinde. VentureBeat, modelin masaüstü bilgisayar kullanımını ölçen bir kıyaslama olan OSWorld-Verified'da da GPT-5.6 Sol Max ve Fable 5'ten daha iyi performans gösterdiğini belirtti.officechai+1
Elde edilen kazanımlar tekdüze değil. Qwen3.8-Max'in AA-Omniscience değerlendirmesindeki halüsinasyon oranı %23'ten %40'a yükseldi; bu da modelin daha önce reddettiği soruları artık yanıtlamaya çalıştığı ve birçok hataya düştüğü anlamına geliyor. Anthropic ve OpenAI, genel Intelligence Index'in zirvesinde liderliklerini korurken, ajans çalışmaları için görev başına maliyetler aynı performans kategorisindeki birçok rakibe göre daha yüksek kalmaya devam ediyor.officechai