Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

news.futunn+1officechai+1memeburn+1„Alibaba“ modelis „Qwen3.8-Max“ užėmė pirmąją vietą „Artificial Analysis“ agentinių sistemų reitinge („Agentic Index“) su 55,4 balo, nežymiai aplenkdamas „Anthropic“ „Claude Opus 5“ (55,3 balo) ir „OpenAI“ „GPT 5.6“, rodo šią savaitę paskelbti naujausi vertinimo organizacijos duomenys. Tai pirmas kartas, kai Kinijos dirbtinio intelekto modelis atsiduria agentinių gebėjimų lyderių sąrašo viršuje, kuriame matuojamas modelio gebėjimas savarankiškai spręsti sudėtingas, daugiapakopes užduotis.news.futunn+1
Po sėkmingo modelio pasirodymo įvairiuose reitinguose „Alibaba“ akcijos Honkongo biržoje pabrango apie 7 proc.memeburn
Rugpjūčio 3 d. pristatytas 2,4 trilijono parametrų modelis naudoja „mixture-of-experts“ architektūrą, kuri kiekvieno skaičiavimo metu aktyvuoja apie 95 milijardus parametrų. Jis taip pat surinko 56 balus platesniame „Artificial Analysis“ intelekto indekse, susilygindamas su „Claude Opus 4.8“ ir aplenkdamas „Google Alphabet Inc.“ , „Meta“ bei „xAI“ modelius.officechai+2
Didelė dalis „Qwen3.8-Max“ agentinių gebėjimų pažangos kyla iš pasikeitusio požiūrio į užduočių vykdymą. „GDPval-AA“ vertinime modelis vidutiniškai atlieka 64 veiksmus, palyginti su 14 jo pirmtako „Qwen3.7 Max“ atveju, o įvesties žetonų (tokenų) naudojimas išaugo maždaug 15 kartų. Šie papildomi skaičiavimai lemia aukštesnius balus, tačiau taip pat padidina vienos užduoties kainą iki 1,14 JAV dolerio, t. y. daugiau nei dvigubai, palyginti su „Qwen3.7 Max“ 0,53 JAV dolerio kaina.officechai
„Alibaba“ pranešė, kad kitą savaitę išleis modelio svorius, todėl „Qwen3.8-Max“ taps didžiausiu prieinamu atvirų svorių modeliu, maždaug šešis kartus viršijančiu ankstesnį didžiausią „Alibaba“ atvirą modelį. API kainodara nustatyta 2,00 JAV dolerio už milijoną įvesties žetonų ir 6,00 JAV dolerių už milijoną išvesties žetonų, o tai yra pigiau nei pirmtako atveju.venturebeat+1
Šis žingsnis sustiprina tendenciją, kai Kinijos laboratorijos mažina atsilikimą nuo JAV technologijų milžinių. „Moonshot AI“ modelis „Kimi K3“ su 2,8 trilijono parametrų vis dar pirmauja tarp Kinijos modelių „Intelligence Index“ reitinge su 57 balais, tačiau „Qwen3.8-Max“ dabar atsilieka vos vienu balu. „VentureBeat“ pažymėjo, kad modelis taip pat lenkia „GPT-5.6 Sol Max“ ir „Fable 5“ „OSWorld-Verified“ – stalinių kompiuterių naudojimo vertinimo sistemoje.officechai+1
Pažanga nėra vienoda. „AA-Omniscience“ vertinime „Qwen3.8-Max“ haliucinacijų rodiklis išaugo nuo 23 proc. iki 40 proc., o tai reiškia, kad modelis dabar bando atsakyti į klausimus, kurių anksčiau atsisakydavo, ir dažnai klysta. „Anthropic“ ir „OpenAI“ išlaiko lyderystę bendro intelekto indekso viršūnėje, o agentinių užduočių vykdymo kaštai išlieka aukštesni nei daugelio konkurentų tame pačiame našumo lygyje.officechai