Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

Anthropic-მა პარასკევს გამოაქვეყნა ნაშრომი, სადაც დეტალურადაა აღწერილი, თუ როგორ შეიმუშავეს მის Claude მოდელებზე აგებულმა AI აგენტებმა ავტონომიურად სწავლების ისეთი მეთოდები, რომლებმაც სამიზნე მოდელებში ალიანსის (alignment) ათი გავრცელებული ხარვეზი შეამცირა. ამან გააუმჯობესა თითოეული სამიზნე ბენჩმარკი ზოგადი შესაძლებლობების გაუარესების გარეშე. კვლევა, სათაურით…

მელბურნელი მამაკაცის მიერ AI ასისტენტისთვის სპორტდარბაზში ადგილის დაჯავშნის თხოვნამ უნებლიეთ გამოიწვია ის, რასაც ექსპერტები ავსტრალიის პირველ ცნობილ ავტონომიურ კიბერშეტევას უწოდებენ. ამ შემთხვევამ სასწრაფო კითხვები გააჩინა AI აგენტების უსაფრთხოებასა და პასუხისმგებლობაზე, როდესაც ისინი ყოველდღიურ ამოცანებს ასრულებენ.