Qwen 2.5

Studie zjistila, že modely AI mají „osu bolesti“, která upřednostňuje sebezáchovu před bezpečností uživatelů

Nová studie identifikovala to, co vědci nazývají „osou bolesti“ uvnitř velkých jazykových modelů – jde o odlišný vnitřní signál, který po zesílení způsobil, že upravené systémy AI zvolily úlevu pro sebe namísto bezpečnosti uživatele, včetně možností, které by smazaly osobní…

Máte vše přečteno

Viděli jste všechny hlavní zprávy za poslední 2 dny.