Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

news.futunn+1officechai+1memeburn+1Alibaba-ի Qwen3.8-Max-ը զբաղեցրել է առաջին հորիզոնականը Artificial Analysis-ի Agentic Index-ում՝ 55.4 միավորով՝ փոքր-ինչ առաջ անցնելով Anthropic-ի Claude Opus 5-ից (55.3 միավոր) և OpenAI-ի GPT 5.6-ից, ըստ այս շաբաթ հրապարակված վարկանիշի: Սա առաջին դեպքն է, երբ չինական AI մոդելը գլխավորում է գործակալական կարողությունների առաջատարների աղյուսակը, որը չափում է մոդելի՝ բարդ, բազմափուլ խնդիրներն ինքնուրույն լուծելու ունակությունը:news.futunn+1
Alibaba-ի հոնկոնգյան բաժնետոմսերը թանկացել են մոտ 7%-ով՝ մոդելի ցուցադրած բարձր արդյունքներից հետո:memeburn
2.4 տրիլիոն պարամետր ունեցող մոդելը, որը ներկայացվել է օգոստոսի 3-ին, օգտագործում է փորձագետների խառնուրդի ճարտարապետություն, որն ակտիվացնում է մոտ 95 միլիարդ պարամետր յուրաքանչյուր գործողության համար: Այն նաև 56 միավոր է վաստակել Artificial Analysis Intelligence Index-ում՝ հավասարվելով Claude Opus 4.8-ին և առաջ անցնելով Google Alphabet Inc.-ի , Meta-ի և xAI-ի մոդելներից:officechai+2
Qwen3.8-Max-ի գործակալական հաջողությունների մեծ մասը պայմանավորված է առաջադրանքներին մոտենալու ձևի փոփոխությամբ: Մոդելը GDPval-AA գնահատման մեջ միջինում կատարում է 64 քայլ, մինչդեռ նախորդ՝ Qwen3.7 Max մոդելը՝ 14, իսկ մուտքային թոքենների օգտագործումն աճել է մոտ 15 անգամ: Այս լրացուցիչ հաշվարկները բարձրացնում են միավորները, բայց նաև ավելացնում են մեկ առաջադրանքի արժեքը՝ հասցնելով 1.14 դոլարի, ինչը կրկնակի ավելի է Qwen3.7 Max-ի 0.53 դոլարից:officechai
Alibaba-ն հայտարարել է, որ հաջորդ շաբաթ կհրապարակի մոդելի կշիռները, ինչը Qwen3.8-Max-ը կդարձնի ամենամեծ բաց կշիռներով մոդելը՝ մոտ վեց անգամ գերազանցելով Alibaba-ի նախորդ ամենամեծ բաց թողարկումը: API-ի գինը սահմանվել է 2.00 դոլար մեկ միլիոն մուտքային թոքենի համար և 6.00 դոլար մեկ միլիոն ելքային թոքենի համար, ինչն ավելի էժան է, քան նախորդ մոդելինը:venturebeat+1
Այս թողարկումն ուժեղացնում է այն միտումը, որով չինական լաբորատորիաները կրճատում են ԱՄՆ-ի առաջատար մշակողների հետ եղած տարբերությունը: Moonshot AI-ի Kimi K3-ը՝ 2.8 տրիլիոն պարամետրով, դեռևս առաջատար է չինական մոդելների շարքում Intelligence Index-ում՝ 57 միավորով, սակայն Qwen3.8-Max-ն այժմ ընդամենը մեկ միավորով է հետ մնում: VentureBeat-ը նշել է, որ մոդելը նաև գերազանցում է GPT-5.6 Sol Max-ին և Fable 5-ին OSWorld-Verified-ում, որը սեղանադիր համակարգչի օգտագործման բենչմարկ է:officechai+1
Ձեռքբերումները միանշանակ չեն: Qwen3.8-Max-ի հալյուցինացիաների մակարդակը AA-Omniscience գնահատման ժամանակ 23%-ից բարձրացել է 40%-ի, ինչը նշանակում է, որ այն այժմ պատասխանում է հարցերի, որոնց նախկինում հրաժարվում էր պատասխանել, և հաճախ սխալվում է: Anthropic-ը և OpenAI-ը շարունակում են պահպանել առաջատարությունը Intelligence Index-ի գագաթնակետին, իսկ գործակալական աշխատանքի համար ծախսերը մնում են ավելի բարձր, քան նույն կատեգորիայի մի շարք մրցակիցների դեպքում:officechai