Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

news.futunn+1officechai+1memeburn+1Alibaban Qwen3.8-Max on noussut Artificial Analysisin Agentic Index -vertailun kärkeen 55.4 pisteellä, ohittaen niukasti Anthropicin Claude Opus 5:n (55.3 pistettä) ja OpenAI:n GPT 5.6:n, kertovat tällä viikolla julkaistut tuoreimmat ranking-tulokset. Tulos on ensimmäinen kerta, kun kiinalainen tekoälymalli on noussut agenttikyvykkyyksiä mittaavan listan kärkeen. Tämä indeksi mittaa mallin kykyä ratkaista monimutkaisia, monivaiheisia ongelmia itsenäisesti.news.futunn+1
Alibaban Hongkongin pörssissä noteeratut osakkeet nousivat noin 7 % mallin vahvan suoriutumisen myötä useissa eri vertailuissa.memeburn
Elokuun 3. päivänä julkistettu 2,4 biljoonan parametrin malli käyttää asiantuntijoiden sekoitusarkkitehtuuria (mixture-of-experts), joka aktivoi noin 95 miljardia parametria per syöte. Se sai myös 56 pistettä laajemmassa Artificial Analysis Intelligence Index -vertailussa, sijoittuen tasoihin Claude Opus 4.8:n kanssa ja edelle Google Alphabet Inc:n , Meta ja xAI:n malleja.officechai+2
Suuri osa Qwen3.8-Maxin agenttikyvykkyyden kasvusta johtuu muutoksesta siinä, miten se lähestyy tehtäviä. Malli käyttää keskimäärin 64 vaihetta GDPval-AA-arvioinnissa, kun edeltäjä Qwen3.7 Max käytti 14 vaihetta, ja syötetokenien käyttö on kasvanut noin 15-kertaiseksi. Tämä lisälaskenta nostaa pisteitä, mutta myös tehtäväkohtaiset kustannukset 1,14 dollariin, mikä on yli kaksinkertainen verrattuna Qwen3.7 Maxin 0,53 dollarin hintaan.officechai
Alibaba on ilmoittanut julkaisevansa mallin painoarvot ensi viikolla, mikä tekisi Qwen3.8-Maxista suurimman saatavilla olevan avoimen mallin, noin kuusi kertaa suuremman kuin Alibaban aiempi suurin avoin julkaisu. API-hinnoittelu on asetettu 2,00 dollariin per miljoona syötetokenia ja 6,00 dollariin per miljoona tulostokenia, mikä on edullisempaa kuin edeltäjällä.venturebeat+1
Julkaisu voimistaa kehitystä, jossa kiinalaiset laboratoriot kurovat umpeen eroa yhdysvaltalaisiin huippukehittäjiin. Moonshot AI:n Kimi K3, jossa on 2,8 biljoonaa parametria, johtaa edelleen kiinalaisia malleja Intelligence Indexissä 57 pisteellä, mutta Qwen3.8-Max on nyt vain pisteen päässä. VentureBeat huomautti, että malli voittaa myös GPT-5.6 Sol Maxin ja Fable 5:n OSWorld-Verified-vertailussa, joka mittaa tietokoneen käyttökykyä.officechai+1
Kehitys ei ole tasaista. Qwen3.8-Maxin hallusinaatioaste nousi 23 prosentista 40 prosenttiin AA-Omniscience-arvioinnissa, mikä tarkoittaa, että se yrittää nyt vastata kysymyksiin, joista se aiemmin kieltäytyi, ja tekee niissä usein virheitä. Anthropic ja OpenAI säilyttävät johtoasemansa Intelligence Indexin huipulla, ja agenttityön tehtäväkohtaiset kustannukset ovat edelleen korkeammat kuin useilla kilpailijoilla samassa suorituskykyluokassa.officechai