Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

wiredwiredlinkedinმკვლევართა ჯგუფმა შეიმუშავა ტექნიკა წამყვანი AI მოდელების ფარული მსჯელობის კვალის ამოსაღებად. ეს აღმოჩენა მიუთითებს, რომ შესაძლოა, სულ მცირე ერთი ჩინური AI სისტემა ამერიკული ანალოგების მონაცემების დისტილაციის გზით არის გაწვრთნილი, თუმცა მკვლევრები ხაზს უსვამენ, რომ მათი დასკვნები არ არის საბოლოო მტკიცებულება.
ტიუბინგენის უნივერსიტეტის, მაქს პლანკის ინსტიტუტის, AI უსაფრთხოების ორგანიზაცია MATS Research-ისა და კიბერუსაფრთხოების ფირმა Snyk-ის კომპიუტერულმა მეცნიერებმა აღმოაჩინეს დაუცველობა OpenAI, Anthropic და Google Alphabet Inc. -ის მოდელებში. ეს დაუცველობა საშუალებას იძლევა, ამოღებულ იქნას ფარული მსჯელობის ნაბიჯები, ანუ ის დეტალური აზროვნების პროცესები, რომლებსაც ეს სისტემები რთული პრობლემების გადასაჭრელად იყენებენ.wired
"ყველა წამყვანი მოდელის პროვაიდერი, რომელიც ჩვენ შევისწავლეთ, ამ დაუცველობას ავლენს," განაცხადა ალექსანდრე პანფილოვმა, ტიუბინგენის უნივერსიტეტის კომპიუტერულმა მეცნიერმა, რომელიც კვლევაში მონაწილეობდა. "ამან შეიძლება გამოიწვიოს პერსონალური მონაცემების გაჟონვა და ხელი შეუწყოს მსჯელობის დისტილაციის ფართომასშტაბიან შეტევებს."wired
თავიანთ ნაშრომში მკვლევრები აჩვენებენ, რომ Moonshot AI-ის ღია წონის მოდელი Kimi K3 გარკვეული მოთხოვნების შემთხვევაში "საოცრად მსგავს" შედეგებს იძლევა, როგორც Claude Opus 4.8 და GPT 5.6 Sol-ის ფარული მსჯელობის კვალი. თუმცა, ისინი აფრთხილებენ, რომ მათ ნაშრომს "არ შეუძლია მიზეზშედეგობრივი დისტილაციის დადგენა". მკვლევრებმა ასევე დაადგინეს, რომ ორ სხვა ღია წონის მოდელს, ჩინურ DeepSeek-სა და ამერიკული ფირმა Thinking Machines-ის Inkling-ს, მსგავსი მსჯელობის კვალი Claude Opus-თან არ გამოუვლენიათ.wired
დისტილაციის საკითხის გარდა, ტექნიკამ გამოავლინა უსაფრთხოების დაუცველობა, რომელიც შეიძლება გამოყენებულ იქნას მოდელის შიდა მსჯელობიდან ისეთი მგრძნობიარე ინფორმაციის მოსაპოვებლად, როგორიცაა პაროლები და API გასაღებები. პანფილოვმა და მისმა თანაავტორებმა OpenAI, Anthropic და Google გააფრთხილეს ამ პრობლემის შესახებ და თითოეულმა კომპანიამ შეცვალა თავისი API პრობლემის შესამცირებლად. მიუხედავად იმისა, რომ პირადი ინფორმაციის ამოღება უკვე შეუძლებელია, პანფილოვის თქმით, ზოგიერთი მსჯელობის კვალის აღმოჩენა ამ მეთოდით კვლავ შესაძლებელია და დისტილაციის რისკის სრულად აღმოსაფხვრელად საჭიროა "ფუნდამენტური ცვლილებები იმ გზაში, თუ როგორ მუშაობს ამ კომპანიების API-ები."linkedin
ეს აღმოჩენები ხდება აშშ-სა და ჩინურ ფირმებს შორის AI დისტილაციის გარშემო მიმდინარე დაძაბულობის ფონზე. 2026 წლის თებერვალში Anthropic-მა და OpenAI-მ გამოაქვეყნეს მტკიცებულებები ჩინური AI კომპანიების მიერ სისტემური დისტილაციის კამპანიების შესახებ. უფრო ახლახან, როდესაც Moonshot AI-მ ივლისში Kimi K3 გამოუშვა, თეთრი სახლის მეცნიერების მრჩეველმა მაიკლ კრაციოსმა კომპანია Anthropic-ის ტექნოლოგიის კოპირებაში დაადანაშაულა. თუმცა, დამოუკიდებელმა ექსპერტებმა ეჭვი შეიტანეს იმაში, იყო თუ არა Claude-ის საჯარო გამოშვებასა და Kimi K3-ის გაშვებას შორის დრო საკმარისი ამ პრეტენზიის გასამყარებლად.iaps+2
პანფილოვის გუნდის ახალი კვლევა ამ დებატებს ტექნიკურ განზომილებას მატებს და გვთავაზობს მეთოდს, რომელსაც პრინციპში შეუძლია დისტილაციის მასშტაბურად გამოვლენა, ამავდროულად ხაზს უსვამს, თუ როგორ შეიძლება გამჭვირვალობის იმავე ინსტრუმენტებმა, რომლებიც AI უსაფრთხოებას აუმჯობესებენ, მოდელები კონკურენტული ამოღების რისკის ქვეშ დააყენონ.