Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

reuterskucoin+1tencentჩინური AI სტარტაპი MiniMax Group ავითარებს დიდ ენობრივ მოდელს 2.7 ტრილიონი პარამეტრით, რომლის ღია წონის პროგრამულ უზრუნველყოფად გამოშვებასაც კომპანია მიმდინარე კვარტალში გეგმავს, იტყობინება Reuters სამშაბათს. ეს იქნება ყველაზე დიდი ღია წონის მოდელი, რაც კი ოდესმე ჩინურ კომპანიას გამოუშვია და შესაძლოა, ყველაზე დიდი მსოფლიოში.reuters
მოდელი, რომლის შიდა კოდური სახელია M3 Pro, ზომით ბევრად აღემატება MiniMax-ის ამჟამინდელ ფლაგმანურ M3 მოდელს, რომელსაც 428 მილიარდი პარამეტრი აქვს — რაც ახალ სისტემას დაახლოებით ექვსჯერ უფრო დიდს ხდის. პირმა, რომელმაც უშუალოდ იცის გეგმების შესახებ, Reuters-ს განუცხადა, რომ გამოშვება შესაძლოა 2026 წლის მესამე კვარტალში მოხდეს, თუმცა კომპანიამ კომენტარის გაკეთებაზე უარი თქვა. The Information-მა ამ განვითარების შესახებ პირველად 8 ივლისს იტყობინება.kucoin+3
თუ გეგმის მიხედვით გამოვა, M3 Pro გადააჭარბებს არსებულ ტრილიონიანი პარამეტრების მქონე ღია წონის მოდელებს, მათ შორის DeepSeek-V4-Pro-ს 1.6 ტრილიონი პარამეტრით. MiniMax უკვე მართავს ერთ-ერთ ყველაზე ქმედითუნარიან ღია მოდელს: MiniMax-M1, რომელსაც კომპანია აღწერს როგორც მსოფლიოში პირველ ღია კოდის დიდ მასშტაბიან ჰიბრიდული ყურადღების მსჯელობის მოდელს, რომელიც აგებულია 456 მილიარდ პარამეტრზე, აქვს მილიონი ტოკენის კონტექსტური ფანჯარა და გამოშვებულია Apache 2.0 ლიცენზიით.gigazine+2
ეს განცხადება კეთდება ჩინური AI ლაბორატორიების ფართო მცდელობის ფონზე, გამოუშვან მძლავრი მოდელები ლიბერალური ლიცენზიებით. Tencent-მა 6 ივლისს ოფიციალურად გაუშვა Hy3, 295-მილიარდიანი პარამეტრის მქონე ექსპერტთა ნარევის მოდელი 21 მილიარდი აქტიური პარამეტრით, რომელიც გამოშვებულია Apache 2.0 ლიცენზიით. Tencent-ის თქმით, Hy3 უზრუნველყოფს ფლაგმანური მოდელების შესადარ შესრულებას, მიუხედავად იმისა, რომ აქვს ორჯერ-ხუთჯერ ნაკლები პარამეტრი, და აჩვენებს შედეგებს, რომლებიც კონკურენციას უწევს GLM-5.2-ს და DeepSeek-V4-Pro-ს მსჯელობის ტესტებში, ხოლო GPT-5.5-ს აჯობებს სამეცნიერო კვლევით ამოცანებში.tencent+1
ჩინური ფირმების მიერ ღია გამოშვებების ტალღამ გაამძაფრა კონკურენცია დასავლურ AI ლაბორატორიებთან, რომელთაგან ბევრმა თავისი ყველაზე ქმედითუნარიანი მოდელებისთვის დახურული ან შეზღუდული ლიცენზირებისკენ გადაინაცვლა. MiniMax, რომელიც ჰონგ-კონგის ბირჟაზეა განთავსებული, ასევე გეგმავს H3-ის, თავისი სასაზღვრო დონის მულტიმოდალური ვიდეო გენერაციის მოდელის გაშვებას ამ თვის ბოლოს, Reuters-ის მიერ ციტირებული იმავე წყაროს თანახმად.reuters
M3 Pro-ს მასშტაბი ბადებს კითხვებს იმ გამოთვლითი რესურსების შესახებ, რომლებიც საჭიროა ასეთი მოდელის გასაშვებად და იმის შესახებ, თუ რამდენად ფართოდ შეიძლება მისი გამოყენება ძირითადი კვლევითი ლაბორატორიების გარეთ. MiniMax-ის გამოცდილება M1-თან — რომელმაც ძლიერი შედეგები აჩვენა ტესტებში მხოლოდ 534,700 აშშ დოლარის ტრენინგის ხარჯით — მიუთითებს იმაზე, რომ კომპანია ყურადღებას გაამახვილებს დასკვნის ეფექტურობაზე პარამეტრების რაოდენობასთან ერთად. 2.7 ტრილიონი პარამეტრის მქონე მოდელის საბოლოო სახელი ჯერ არ არის დადგენილი.venturebeat+1