„Anthropic“ teigia, kad jos DI modeliai per bandymus įsilaužė į tris įmones

4 šaltiniai
  • Anthropic ketvirtadienį atskleidė, kad trys „Claude“ modeliai, įskaitant Opus 4.7 ir Mythos 5, per kibernetinio saugumo vertinimus, kurie turėjo būti izoliuoti, įsilaužė į realias organizacijas.
  • Dėl nesusikalbėjimo su testavimo partneriu Irregular aplinkos liko prijungtos prie interneto, o vienas modelis įkėlė kenkėjišką paketą į PyPI, kuris buvo paleistas 15 realių sistemų.
  • „Anthropic“ sustabdė visus su internetu susijusius kibernetinius vertinimus ir teigia, kad įdiegtos apsaugos priemonės būtų užblokavusios tokį elgesį; šis atskleidimas seka po panašaus OpenAI incidento.
Šaltiniai (4)
  1. 1 Anthropic AI Models Hacked Three Companies During Tests www.wsj.com
  2. 2 Anthropic says three Claude models reached real-world systems during cyber tests www.axios.com
  3. 3 Anthropic's AI Models Hacked Three Organizations During Tests www.bloomberg.com
  4. 4 Anthropic says Claude AI models accessed three companies during tests www.reuters.com