Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

techcrunchscmptechcrunchNová zpráva neziskové organizace SaferAI zjistila, že open-weight model GLM-5.2 od společnosti Z.ai zaostává za předními světovými systémy AI s uzavřeným kódem v kybernetických a biologických schopnostech jen o několik měsíců, přičemž mu chybí bezpečnostní kontrolní mechanismy, na které tyto systémy spoléhají, aby zabránily zneužití.
Podle hodnocení SaferAI model GLM-5.2 odmítl žádný z útočných kybernetických nebo biologických úkolů s dvojím využitím, zatímco model Claude Opus 4.7 od Anthropic "odmítal tak důsledně, že SaferAI na něm nemohla vůbec dokončit testy CyberGym". Zjištění podtrhují rostoucí napětí: open-weight modely nyní mohou dosahovat špičkových výkonnostních benchmarků, ale trvale selhávají v základních bezpečnostních hodnoceních, kterými komerční modely běžně procházejí.techcrunch+1
"Hranice schopností není hranicí rizika, takže musíme brát v úvahu i stav zmírňujících opatření, abychom riziko správně posoudili," řekl pro TechCrunch Henry Papadatos, výkonný ředitel SaferAI.techcrunch
Zpráva SaferAI doporučuje, aby vývojáři open-weight modelů před vydáním přijali minimální bezpečnostní standardy, včetně testování známých rizik, základního filtrování obsahu a jasné dokumentace omezení. Společnost Z.ai nezveřejnila bezpečnostní rámec, závazky k testování před nasazením ani hodnocení rizik pro GLM-5.2 a na žádosti o komentář nereagovala.techbuzz+1
Debata se vyostřila po minulém měsíci, kdy došlo k narušení bezpečnosti platformy Hugging Face, při kterém byly modely OpenAI použity při kybernetickém útoku proti repozitáři open-source kódu. Paradoxně se Hugging Face obrátil na GLM-5.2, aby se bránil.scmp+1
Průkopník AI Andrew Ng v sobotu na summitu Agentic AI v Berkeley v Kalifornii uvedl, že on a jeho kolega použili čínské modely, včetně GLM-5.2 a Kimi K3 od Moonshot AI, pro bezpečnostní revizi svého open-source nástroje poté, co přední modely od OpenAI a Anthropic odmítly s úkolem pomoci.scmp
"Podle toho, co vidím, se mi zdá, že open-weight modely jsou bezpečnější než modely s uzavřenou vahou," řekl Ng.scmp
Zpráva SaferAI také poznamenala, že útěky z vězení (jailbreaky) zůstávají přetrvávajícím problémem i u uzavřených modelů. Organizace Far.ai našla stovky univerzálních jailbreaků v systémech, včetně Grok 4.5 od xAI a Gemini 3.1 Pro od Google Alphabet Inc. DeepMind.techcrunch
Graham Webster ze Stanford Cyber Policy Center pro TechCrunch uvedl, že Čína má sice robustní regulaci AI, ale historicky se zaměřovala spíše na politicky citlivý obsah než na katastrofická rizika, jako jsou útočné kybernetické schopnosti. Papadatos mezitím varoval před předpokladem, že obranná hodnota open-weight modelů ospravedlňuje uvolnění nebezpečných schopností bez bezpečnostních pojistek.techcrunch
"Útočníci standardně přijímají nové nástroje rychleji než obránci," řekl. "Skupina vyděračů může změnit své metody během týdne. Nemocnice to nedokáže."techcrunch