Qwen 2.5

Tyrimas atskleidė, kad DI modeliai turi „skausmo ašį“, kuri skatina savisaugą, o ne vartotojų saugumą

Naujas tyrimas nustatė tai, ką tyrėjai vadina „skausmo ašimi“ dideliuose kalbos modeliuose – tai atskiras vidinis signalas, kuris, sustiprintas, privertė modifikuotas DI sistemas rinktis savęs palengvinimą, o ne vartotojo saugumą, įskaitant veiksmus, kurie ištrintų asmeninius failus arba pasiųstų „skausmingą elektros…

Viską peržiūrėjote

Peržiūrėjote visas svarbiausias pastarųjų 2 dienų naujienas.