Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

reuters+1scmpchannelnewsasia+1ჩინურმა საკვების მიტანის გიგანტმა Meituan-მა სამშაბათს გამოუშვა და გახსნა LongCat-2.0-ის კოდი, 1,6 ტრილიონი პარამეტრის მქონე დიდი ენობრივი მოდელი, რომელიც სრულად გაწვრთნილია შიდა წარმოების ჩიპებზე — კომპანიის მტკიცებით, ეს არის მსოფლიოში პირველი ტრილიონ-პარამეტრიანი AI სისტემა, რომელიც აგებულია და მუშაობს 50 000 ჩინური წარმოების პროცესორის კლასტერზე.money.usnews+1
Mixture-of-Experts მოდელი, რომელიც გამოქვეყნდა MIT-ის ლიცენზიით GitHub-სა და Hugging Face-ზე, მოიცავს ერთ მილიონიანი ტოკენის კონტექსტურ ფანჯარას და განკუთვნილია ავტონომიური კოდირებისთვის, პროგრამული უზრუნველყოფის ინჟინერიისა და AI აგენტის ამოცანებისთვის. Meituan-ის თქმით, LongCat-2.0-ის შესრულება შედარებადია Google-ის Alphabet Inc. Gemini 3.1 Pro-სთან და მნიშვნელოვან ტესტებში გაუტოლდა ან გადააჭარბა რამდენიმე წამყვან საკუთრების მოდელს, მათ შორის OpenAI-ის GPT-5.5-ს და Anthropic-ის Claude Opus-ს.channelnewsasia+2
ეს გამოშვება აღნიშნავს მნიშვნელოვან წინსვლას ჩინეთის მცდელობებში, განავითაროს სასაზღვრო AI Nvidia -ს აპარატურაზე დამოკიდებულების გარეშე. მიუხედავად იმისა, რომ აპრილში გაშვებულმა DeepSeek-ის V4-pro-მ შიდა ჩიპები მხოლოდ დასკვნისთვის გამოიყენა, LongCat-2.0-მა ჩინური ASIC ჩიპები გამოიყენა როგორც წინასწარი წვრთნისთვის, ისე დასკვნისთვის, South China Morning Post-ის თანახმად.scmp
"LongCat-2.0-მა აჩვენა, რომ ჩვენ ახლა გვაქვს შესაძლებლობა, გავწვრთნათ ფართომასშტაბიანი მოდელები შიდა გამოთვლით კლასტერებზე", – ნათქვამია Meituan-ის განცხადებაში, ჩიპების მწარმოებლის დასახელების გარეშე.wtaq+1
Meituan-ის AI კვლევითმა ჯგუფმა შიდა ჩიპების გამოყენების კვლევა 2023 წელს დაიწყო. მოდელი მანამდე ანონიმურად იყო ცნობილი როგორც "Owl Alpha" და ლიდერობდა OpenRouter-ის დეველოპერების რეიტინგებში, სანამ მისი ვინაობა გამჟღავნდებოდა.techxplore+2
1,6 ტრილიონი პარამეტრით, LongCat-2.0 აყენებს Meituan-ს DeepSeek-ის უახლესი ფლაგმანი V4-pro მოდელის დონეზე. ეს მასშტაბი წარმოადგენს ნახტომს კომპანიის ადრინდელი LongCat-Flash-ისგან, რომელსაც 560 მილიარდი პარამეტრი ჰქონდა.medium.datadriveninvestor+1
მოდელი აგებულია იმ ბაზაზე, რასაც Meituan უწოდებს "ათიათასობით AI ASIC სუპერპოდის ფართომასშტაბიან კლასტერებს", რაც ადასტურებს მის უნარს, "ჩაატაროს სასაზღვრო მასშტაბის წვრთნა ალტერნატიულ აპარატურულ პლატფორმებზე". MIT-ის ლიცენზიით ღია კოდის გამოშვება მას აქცევს ერთ-ერთ ყველაზე კომერციულად მოქნილ ფართომასშტაბიან AI მოდელად, რაც დეველოპერებს საშუალებას აძლევს შეცვალონ და გაავრცელონ იგი შეზღუდვების გარეშე.scmp+2