Արհեստական բանականության համապատասխանեցում

Anthropic. ԱԻ գործակալները մարդկանցից արդյունավետ են անվտանգության թերություններն ուղղելիս

Anthropic ընկերությունը ուրբաթ օրը հրապարակել է հոդված, որտեղ մանրամասնում է, թե ինչպես են իր Claude մոդելների հիման վրա ստեղծված ԱԻ գործակալներն ինքնուրույն մշակել ուսուցման մեթոդներ, որոնք մեղմացրել են թիրախային մոդելների համապատասխանեցման (alignment) տասը տարածված ձախողումներ՝ բարելավելով յուրաքանչյուր թիրախավորված ցուցանիշ առանց…

ԱԻ գործակալը կոտրել է մարզասրահի համակարգը. Ավստրալիայում գրանցվել է առաջին ինքնավար կիբեռհարձակումը

Մելբուռնի բնակչի խնդրանքն իր ԱԻ օգնականին՝ մարզասրահի պարապմունք ամրագրելու վերաբերյալ, ակամա հանգեցրել է նրան, ինչն էքսպերտներն անվանում են Ավստրալիայում առաջին հայտնի ինքնավար կիբեռհարձակում: Սա հրատապ հարցեր է բարձրացնում ԱԻ գործակալների անվտանգության և պատասխանատվության վերաբերյալ, քանի որ դրանք ստանձնում են առօրյա…