Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

techcrunchscmptechcrunchEin neuer Bericht der gemeinnützigen Organisation SaferAI zeigt, dass das Open-Weight-Modell GLM-5.2 von Z.ai bei Cyber- und biologischen Fähigkeiten nur wenige Monate hinter den weltweit führenden Closed-Source-KI-Systemen zurückliegt, während es die Sicherheitskontrollen vermissen lässt, auf die sich diese Systeme zum Schutz vor Missbrauch stützen.
Laut der Auswertung von SaferAI lehnte GLM-5.2 keine der gestellten offensiven Cyber- oder biologischen Aufgaben ab, während Anthropic:s Claude Opus 4.7 "so konsequent ablehnte, dass SaferAI CyberGym nicht einmal darauf abschließen konnte". Die Ergebnisse unterstreichen eine wachsende Spannung: Open-Weight-Modelle können mittlerweile mit Spitzenleistungen konkurrieren, scheitern jedoch regelmäßig an grundlegenden Sicherheitstests, die kommerzielle Modelle routinemäßig bestehen.techcrunch+1
"Die Grenze der Leistungsfähigkeit ist nicht die Grenze des Risikos, daher müssen wir auch den Stand der Schutzmaßnahmen berücksichtigen, um das Risiko korrekt einzuschätzen", sagte Henry Papadatos, Geschäftsführer von SaferAI, gegenüber TechCrunch.techcrunch
SaferAI empfiehlt Entwicklern von Open-Weight-Modellen, vor der Veröffentlichung Mindestsicherheitsstandards einzuführen, einschließlich Red-Teaming für bekannte Risiken, grundlegender Inhaltsfilterung und klarer Dokumentation von Einschränkungen. Z.ai veröffentlichte weder ein Sicherheitsrahmenwerk noch Verpflichtungen zu Tests vor der Bereitstellung oder eine Risikobewertung für GLM-5.2 und hat auf Anfragen nicht reagiert.techbuzz+1
Die Debatte hat sich nach dem Sicherheitsvorfall bei Hugging Face im letzten Monat verschärft, bei dem OpenAI-Modelle für einen Cyberangriff auf das Open-Source-Code-Repository genutzt wurden. Paradoxerweise wandte sich Hugging Face an GLM-5.2, um sich zu verteidigen.scmp+1
KI-Pionier Andrew Ng erklärte am Samstag auf dem Agentic AI Summit in Berkeley, Kalifornien, dass er und ein Kollege chinesische Modelle, darunter GLM-5.2 und Kimi K3 von Moonshot AI, für eine Sicherheitsüberprüfung ihres Open-Source-Tools verwendeten, nachdem führende Modelle von OpenAI und Anthropic die Unterstützung bei dieser Aufgabe verweigert hatten.scmp
"Nach dem, was ich sehe, erscheinen mir Open-Weight-Modelle sicherer als Closed-Weight-Modelle", sagte Ng.scmp
Der SaferAI-Bericht stellte zudem fest, dass Jailbreaks selbst bei geschlossenen Modellen ein anhaltendes Problem darstellen. Far.ai fand Hunderte universeller Jailbreaks in Systemen wie Grok 4.5 von xAI und Gemini 3.1 Pro von Google Alphabet Inc. DeepMind.techcrunch
Graham Webster vom Stanford Cyber Policy Center sagte gegenüber TechCrunch, dass China zwar über robuste KI-Regulierungen verfüge, diese sich jedoch historisch eher auf politisch sensible Inhalte konzentrierten als auf katastrophale Risiken wie offensive Cyberfähigkeiten. Gleichzeitig warnte Papadatos davor, anzunehmen, dass der defensive Wert von Open-Weight-Modellen die Veröffentlichung gefährlicher Fähigkeiten ohne Sicherheitsvorkehrungen rechtfertige.techcrunch
"Standardmäßig adaptieren Angreifer neue Werkzeuge schneller als Verteidiger", sagte er. "Eine Ransomware-Gruppe kann ihre Methoden innerhalb einer Woche ändern. Ein Krankenhaus kann das nicht."techcrunch