Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

news.futunn+1officechai+1memeburn+1Qwen3.8-Max frá Alibaba hefur náð efsta sæti á Agentic Index hjá Artificial Analysis með 55,4 stig, rétt á undan Claude Opus 5 frá Anthropic með 55,3 stig og GPT 5,6 frá OpenAI, samkvæmt nýjustu röðun greiningaraðilans sem birt var í vikunni. Niðurstaðan markar í fyrsta sinn sem kínverskt gervigreindarlíkan nær efsta sæti á lista yfir getu til sjálfstæðra vinnubragða, sem mælir getu líkans til að leysa flókin verkefni í mörgum skrefum án mannlegrar íhlutunar.news.futunn+1
Hlutabréf Alibaba í Hong Kong hækkuðu um 7% eftir góðan árangur líkansins á ýmsum listum.memeburn
Líkanið, sem hefur 2,4 billjónir færibreyta og var kynnt 3. ágúst, notar arkitektúr sem virkjar um 95 milljarða færibreyta í hverju skrefi. Það fékk einnig 56 stig á víðtækari Intelligence Index hjá Artificial Analysis, sem setur það á sama stall og Claude Opus 4,8 og á undan líkönum frá Google Alphabet Inc. , Meta og xAI.officechai+2
Stór hluti af framförum Qwen3.8-Max í sjálfstæðum vinnubrögðum stafar af breyttri nálgun á verkefni. Líkanið notar að meðaltali 64 skref í GDPval-AA mati, samanborið við 14 skref hjá forvera sínum Qwen3.7 Max, og notkun á innsláttartáknum hefur aukist um fimmtánfalt. Þessi aukna útreikningsgeta skilar hærri stigum en hækkar einnig kostnað á hvert verkefni í 1,14 dollara, sem er meira en tvöfalt hærra en 0,53 dollara kostnaður Qwen3.7 Max.officechai
Alibaba hefur tilkynnt að fyrirtækið muni gefa út vigtir líkansins í næstu viku, sem gerir Qwen3.8-Max að stærsta líkaninu með opnum vigtum sem völ er á, um það bil sex sinnum stærra en fyrri stærsta útgáfa Alibaba. Verðlagning á API er 2,00 dollarar fyrir hverja milljón innsláttartákna og 6,00 dollarar fyrir hverja milljón úttakstákna, sem er ódýrara en hjá forveranum.venturebeat+1
Útgáfan skerpir á þróun þar sem kínverskar rannsóknarstofur eru að minnka bilið við bandaríska tæknirisa. Kimi K3 frá Moonshot AI, með 2,8 billjónir færibreyta, leiðir enn kínversk líkön á Intelligence Index með 57 stig, en Qwen3.8-Max er nú aðeins einu stigi á eftir. VentureBeat benti á að líkanið skari einnig fram úr GPT-5.6 Sol Max og Fable 5 á OSWorld-Verified, sem er viðmið fyrir notkun á tölvustýrikerfum.officechai+1
Framfarirnar eru ekki einsleitar. Hlutfall rangfærslna hjá Qwen3.8-Max hækkaði úr 23% í 40% í AA-Omniscience mati, sem þýðir að það reynir nú að svara spurningum sem það hafnaði áður og svarar mörgum þeirra rangt. Anthropic og OpenAI halda enn forystu á toppi Intelligence Index og kostnaður við sjálfstæð verkefni er enn hærri en hjá mörgum keppinautum í sama afkastaflokki.officechai