Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

news.futunn+1officechai+1memeburn+1Alibaba-ს Qwen3.8-Max-მა Artificial Analysis-ის Agentic Index-ზე პირველი ადგილი დაიკავა 55.4 ქულით, რითაც მცირედით აჯობა Anthropic-ის Claude Opus 5-ს (55.3 ქულა) და OpenAI-ის GPT 5.6-ს. ეს არის პირველი შემთხვევა, როდესაც ჩინურმა AI მოდელმა დაიკავა პირველი ადგილი აგენტური შესაძლებლობების ლიდერბორდზე, რომელიც ზომავს მოდელის უნარს, ავტონომიურად გადაჭრას კომპლექსური, მრავალეტაპიანი ამოცანები.news.futunn+1
Alibaba-ს ჰონგ-კონგის ბირჟაზე განთავსებული აქციები დაახლოებით 7%-ით გაიზარდა მას შემდეგ, რაც მოდელმა სხვადასხვა რეიტინგში მაღალი შედეგები აჩვენა.memeburn
2.4-ტრილიონიანი პარამეტრების მქონე მოდელი, რომელიც 3 აგვისტოს წარადგინეს, იყენებს ექსპერტთა ნარევის არქიტექტურას, რომელიც თითოეულ ოპერაციაზე დაახლოებით 95 მილიარდ პარამეტრს ააქტიურებს. მან ასევე 56 ქულა დააგროვა Artificial Analysis Intelligence Index-ზე, რითაც გაუთანაბრდა Claude Opus 4.8-ს და გაუსწრო Google Alphabet Inc.-ის , Meta-ს და xAI-ის მოდელებს.officechai+2
Qwen3.8-Max-ის აგენტური წინსვლა დიდწილად განპირობებულია ამოცანებისადმი მიდგომის შეცვლით. მოდელი GDPval-AA შეფასებაში საშუალოდ 64 ნაბიჯს ასრულებს, მაშინ როცა მისი წინამორბედი Qwen3.7 Max მხოლოდ 14-ს, ხოლო შემავალი ტოკენების მოხმარება დაახლოებით 15-ჯერ გაიზარდა. ეს დამატებითი გამოთვლები ზრდის ქულებს, თუმცა ასევე ზრდის თითოეულ ამოცანაზე დანახარჯს 1.14 დოლარამდე, რაც ორჯერ მეტია Qwen3.7 Max-ის 0.53 დოლარიან მაჩვენებელზე.officechai
Alibaba-მ განაცხადა, რომ მოდელის წონებს მომავალ კვირას გაასაჯაროებს, რაც Qwen3.8-Max-ს გახდის ყველაზე დიდ ღია წონების მქონე მოდელად, რომელიც დაახლოებით ექვსჯერ აღემატება Alibaba-ს წინა უდიდეს ღია რელიზს. API-ის ფასი დადგენილია 2.00 დოლარად მილიონ შემავალ ტოკენზე და 6.00 დოლარად მილიონ გამომავალ ტოკენზე, რაც მის წინამორბედზე იაფია.venturebeat+1
ეს რელიზი აძლიერებს ტენდენციას, რომლის მიხედვითაც ჩინური ლაბორატორიები ამცირებენ ჩამორჩენას აშშ-ის წამყვან დეველოპერებთან. Moonshot AI-ის Kimi K3, 2.8 ტრილიონი პარამეტრით, კვლავ ლიდერობს ჩინურ მოდელებს შორის Intelligence Index-ზე 57 ქულით, თუმცა Qwen3.8-Max ახლა მხოლოდ ერთი ქულით ჩამორჩება. VentureBeat-მა აღნიშნა, რომ მოდელი ასევე აჯობებს GPT-5.6 Sol Max-სა და Fable 5-ს OSWorld-Verified-ზე, რომელიც დესკტოპ კომპიუტერის გამოყენების ბენჩმარკია.officechai+1
მიღწევები არ არის ერთგვაროვანი. Qwen3.8-Max-ის ჰალუცინაციების მაჩვენებელი AA-Omniscience შეფასებაზე 23%-დან 40%-მდე გაიზარდა, რაც იმას ნიშნავს, რომ ის ახლა პასუხობს კითხვებს, რომლებზეც ადრე უარს ამბობდა და ხშირად ცდება. Anthropic-ი და OpenAI კვლავ ინარჩუნებენ ლიდერობას Intelligence Index-ის სათავეში, ხოლო აგენტური სამუშაოსთვის საჭირო დანახარჯები კვლავ უფრო მაღალია, ვიდრე იმავე კატეგორიის რამდენიმე კონკურენტის შემთხვევაში.officechai