Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

reutersuniteeconomictimes.indiatimesAlibaban Qwen-tiimi julkaisi keskiviikkona Qwen3.8-Flash-mallin. Kyseessä on multimodaalinen tekoälymalli, joka tarjoaa vahvempaa suorituskykyä koodauksessa ja toimistotehtävissä noin yhdeksäsosalla edeltäjänsä koulutuskustannuksista. Samalla tiimi julkaisi avoimena lähdekoodina Qwen3.8-Flash-Next-mallin, joka toimii arkkitehtonisena esikatseluna tulevalle Qwen4-malliperheelle.
Kaksoisjulkaisu korostaa sitä, miten Kiinan suurin pilvipalveluyritys panostaa kustannustehokkuuteen säilyttääkseen johtoasemansa maan kiristyvässä tekoälykilpailussa, vaikka se joutuukin sietämään raskaiden infrastruktuuri-investointien aiheuttamaa taloudellista painetta.
Qwen3.8-Flash tukee oletusarvoisesti 262 144 tokenin konteksti-ikkunaa, joka on laajennettavissa 1 miljoonaan tokeniin. Sen hinta API-rajapinnan kautta on 1 yuan miljoonaa syötetokenia kohden ja 3 yuania miljoonaa tulostetokenia kohden. Alibaba kertoi, että verrattuna Qwen3.7-Plus-malliin koulutuskustannukset putosivat noin yhdeksäsosaan.reuters+1
Kokeellinen, avoimilla painoarvoilla julkaistu Qwen3.8-Flash-Next on 125 miljardin parametrin Mixture-of-Experts-järjestelmä (MoE), joka aktivoi vain 6 miljardia parametria tokenia kohden. Lisäksi siinä on 51 miljardin parametrin n-gram-upotuskomponentti. Kehittäjän ilmoittamien suorituskykytestien mukaan se sai SWE-bench Pro -testissä tuloksen 62,5 (verrattuna Claude Opus 4.6 Maxin tulokseen 53,4) ja LiveCodeBench v6 -testissä tuloksen 91,9 (verrattuna Clauden tulokseen 88,8). Painoarvot julkaistiin Hugging Face -palvelussa qwen-community-1.0-lisenssillä.tech.yahoo+2
Qwen-tiimi määritteli Flash-Nextin nimenomaan prototyypiksi seuraavan sukupolven Qwen4-perheelleen. Keskeisiä arkkitehtonisia innovaatioita ovat hybriditarkkaavaisuusmekanismi, joka yhdistää Gated DeltaNetin ja Qwen Sparse Attentionin, gated residual -mekanismi sekä n-gram-upotuskerros, joka kasvattaa parametrien määrää ilman suhteellista laskentatehon tarpeen kasvua. Malli oli määrä julkaista avoimena lähdekoodina Pekingin aikaa 26. elokuuta klo 23.00.technode+2
Julkaisut tapahtuvat vain päiviä sen jälkeen, kun Alibaba käynnisti huomattavalla alennuksella toteutetun 80 miljardin Hongkongin dollarin osakemyynnin rahoittaakseen siru- ja tekoälyinfrastruktuuria. Yhtiön huhti-kesäkuun 2026 voitto laski 75 % edellisvuodesta, kun taas pääomamenot kasvoivat 75 % eli 67,7 miljardiin yuaniin, mikä johtui pitkälti tekoälyinvestoinneista Startup Fortunen sitoman AP-uutisen mukaan. Pilvipalveluiden ja tekoälylaskennan liikevaihto kasvoi samalla neljänneksellä 45 %.economictimes.indiatimes+1
Qwen on jo saavuttanut merkittävän suosion kehittäjien keskuudessa. Elokuussa 2026 julkaistussa Hugging Face -raportissa arvioitiin, että Qwen-malleja ladattiin tammi-elokuun välisenä aikana noin 2,05 miljardia kertaa, mikä ylittää Googlen 418 miljoonaa ja Metan 227 miljoonaa latausta.startupfortune