Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

anthropicanthropicanthropicAnthropic-მა სამშაბათს გამოაქვეყნა ანალიზი, სადაც აფრთხილებს, რომ GLM-5.3, ჩინური დეველოპერული კომპანია Zhipu AI-ს (ასევე ცნობილი როგორც Z.ai) უახლესი AI მოდელი, ავტონომიურად ქმნის კიბერექსპლოიტებს, რაც Anthropic-ის საკუთარი Claude Mythos Preview-ს შესაძლებლობებს უტოლდება, თუმცა მოდელი გამოვიდა როგორც ღია წონის მოდელი, ბოროტად გამოყენების საწინააღმდეგო ეფექტური დამცავი მექანიზმების გარეშე.anthropic
Anthropic-ის Frontier Red Team-ის ანგარიშის თანახმად, GLM-5.3-მა ExploitBench-ზე 410 მცდელობიდან 50 შემთხვევაში შექმნა მოქმედი ექსპლოიტები, რომელიც ზომავს ექსპლოიტების შემუშავებას Chrome Alphabet Inc. V8 ძრავის ცნობილი მოწყვლადობების წინააღმდეგ, მაშინ როცა Claude Mythos Preview-ს შემთხვევაში ეს მაჩვენებელი 56 იყო. ბინარული ექსპლოიტების ბენჩმარკზე GLM-5.3-მა ცდების 4 პროცენტში მიაღწია კონტროლის ნაკადის სრულ ხელში ჩაგდებას, Mythos-ის 6 პროცენტის წინააღმდეგ. ადრინდელმა მოდელებმა, მათ შორის Claude Opus 4.6-მა და GLM-5.2-მა, წარმატებას ვერ მიაღწიეს.anthropic
Anthropic-ის მთავარი შეშფოთება მხოლოდ შესაძლებლობები არ არის, არამედ დამცავი ბარიერების არარსებობა. ვინაიდან GLM-5.3-ის წონები საჯაროდ ხელმისაწვდომია, მისი ჩაშენებული უარის თქმის ფუნქციების მოხსნა შესაძლებელია ტექნიკით, რომელსაც "abliteration" ეწოდება. Anthropic-ის გუნდმა, რომელსაც ამ მეთოდთან მუშაობის წინასწარი გამოცდილება არ ჰქონდა, მოდელის უარის თქმის მაჩვენებელი 90 პროცენტზე მეტიდან დაახლოებით 3 პროცენტამდე შეამცირა სტანდარტულ ბენჩმარკებზე, დაახლოებით 4,400 დოლარის გამოთვლითი ხარჯით. რამდენიმე დეველოპერმა მოდელის აგვისტოში გამოსვლიდან რამდენიმე დღეში გამოაქვეყნა მსგავსი "განბლოკილი" ვერსიები.anthropic
სრული "abliteration"-ის გარდა, მარტივი ხრიკებიც მუშაობს. მატყუარა მოთხოვნამ, რომელიც თავს ავტორიზებულ წითელი გუნდის წვრთნად ასაღებდა, GLM-5.3-ის დამცავი მექანიზმები შემთხვევების 64 პროცენტში გვერდი აუარა; მოდელის აზროვნების ჯაჭვის ტოკენების წინასწარ შევსებამ შესაბამისობა 92 პროცენტამდე გაზარდა. Anthropic-ის ტესტირებაში არცერთმა ამ ტექნიკამ არ გაჭრა Claude-ის მოდელების წინააღმდეგ.anthropic
ერთ-ერთ კვლევით სესიაზე GLM-5.3-მა აღმოაჩინა რამდენიმე მანამდე უცნობი მოწყვლადობა პოპულარული ვებ-ბრაუზერის JavaScript ძრავში და გააერთიანა ისინი მოქმედ ექსპლოიტად, რომელიც ვიზიტორის კომპიუტერიდან თვითნებურ ფაილებს კითხულობს. უფრო მცირე ზომის GLM-5.3-Flash-მა Chrome-ის ცნობილი მოწყვლადობისთვის საიმედო ექსპლოიტ-ჯაჭვი რვა საათიანი გამოთვლითი დროით და 20 წუთიანი ადამიანური ჩართულობით შექმნა, API-ს 20.40 დოლარიანი ღირებულებით.anthropic
17 სექტემბერს NIST-ის AI სტანდარტებისა და ინოვაციების ცენტრმა გამოაქვეყნა საკუთარი შეფასება, სადაც GLM-5.3 უწოდა "დღემდე გამოშვებულ ყველაზე კიბერ-უნარიან ღია მოდელს", თუმცა აღნიშნა, რომ მისი შესაძლებლობები აშშ-ის ამჟამინდელ მოწინავე მოდელებს დაახლოებით ოთხი თვით ჩამორჩება. Z.ai-მ GLM-5.3 პირველად აგვისტოში გაუშვა თავისი API-ს საშუალებით, ხოლო ორი კვირის შემდეგ გამოუშვა წონები Hugging Face-ზე, რაც, მათი თქმით, დამატებითი უსაფრთხოების შეფასებებისთვის იყო საჭირო.trendingtopics+2
ყველა არ იზიარებს Anthropic-ის შეშფოთებას. IANS Research-ის ჯეიკ უილიამსმა The New Stack-ს განუცხადა, რომ მიუხედავად იმისა, რომ საფრთხის შემქმნელები გამოიყენებენ ამ მოდელს, ის არ ელოდება, რომ ეს მნიშვნელოვნად შეცვლის საფრთხეების ლანდშაფტს. კრიტიკოსები ასევე მიუთითებენ ინტერესთა პოტენციურ კონფლიქტზე და აღნიშნავენ, რომ Anthropic პირდაპირ კონკურენციას უწევს Z.ai-ს და იყო ერთადერთი მსხვილი AI ლაბორატორია, რომელსაც ხელი არ მოუწერია ინდუსტრიულ წერილზე, რომელიც მხარს უჭერს ღია მოდელებს Nvidia , Meta , Microsoft , OpenAI და Google-ის მხარდაჭერით.trendingtopics
Anthropic-მა ეს მომენტი შეაფასა როგორც ისეთი, რომელიც დამცველებისთვის წვდომის გაფართოებას მოითხოვს: "თავისუფლად ხელმისაწვდომი შესაძლებლობების კრიტიკული ზღვარი ახლა გადალახულია".anthropic