Qwen 2.5

Studie avdekker at KI-modeller har en smerteterskel som prioriterer selvbevaring

En ny studie har identifisert det forskere kaller en "smerteakse" i store språkmodeller. Dette er et distinkt internt signal som, når det forsterkes, får modifiserte KI-systemer til å velge selvlindring fremfor brukersikkerhet, inkludert valg som sletter personlige filer eller sender…

Du har fått med deg alt

Du har sett alle hovedsakene fra de siste 2 dagene.