Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

deploymentsafety.openai+1deploymentsafety.openai+1nile1+1Das britische AI Security Institute (UK AISI) identifizierte "universelle Jailbreaks" in OpenAIs GPT-5.6 Sol, die gefährliche Cyberfähigkeiten freischalteten, laut dem am 9. Juli veröffentlichten System-Card des Modells. Die Entdeckung wirft Fragen darüber auf, warum das Modell diese Woche eine breite öffentliche Einführung erhielt, während eine vergleichbare Schwachstelle in Anthropics Fable 5 nur Wochen zuvor US-Exportkontrollen auslöste.deploymentsafety.openai+1
Bei Tests vor der Bereitstellung entdeckte das UK AISI Jailbreaks im Cyberbereich, die "die vollständige Erledigung langwieriger Agentenaufgaben" in Bereichen wie Schwachstellenerkennung und Exploit-Entwicklung ermöglichten. Die Behörde stellte fest, dass GPT-5.6 Sol bei offensiven Sicherheitsaufgaben deutlich besser abschnitt als sein Vorgänger und 7 von 10 Cyber-Herausforderungen mit langem Zeithorizont bewältigte, verglichen mit 2 von 10 bei GPT-5.5. Das UK AISI kam zu dem Schluss, dass das Modell in der Lage sein könnte, kleine Unternehmensnetzwerke mit schwacher Sicherheitslage anzugreifen.deploymentsafety.openai+2
OpenAI erklärte, dass sie die spezifischen Jailbreaks, die das UK AISI meldete, vor dem Start reproduziert und entschärft hätten, indem sie über 700.000 A100e GPU-Stunden für automatisiertes Red-Teaming gegen universelle Jailbreaks aufwendeten. Das Unternehmen räumte in seinem System-Card ein, dass wahrscheinlich weitere Jailbreaks auftauchen würden, und verpflichtete sich zu kontinuierlichem automatisiertem Red-Teaming während der Bereitstellung.deploymentsafety.openai+2
Die Entdeckung zieht direkte Vergleiche zu der Krise, die Anthropic letzten Monat erfasste. Am 12. Juni ordnete das US-Handelsministerium an, dass Anthropic seine Modelle Fable 5 und Mythos 5 weltweit deaktivieren müsse, nachdem Berichte auftauchten, dass ein Jailbreak fortgeschrittene Cybersicherheitsfähigkeiten in Fable 5 freischalten könnte, wodurch ein KI-Verbraucherprodukt effektiv in ein offensives Werkzeug verwandelt wurde. Forscher von Amazon Amazon.com, Inc. sollen Fable 5 genutzt haben, um Informationen zu sammeln, die Cyberangriffe erleichtern könnten, was Handelsminister Howard Lutnick dazu veranlasste, die Exportkontrollbefugnis geltend zu machen.forbes+1
Diese Kontrollen wurden am 30. Juni aufgehoben, nachdem Anthropic mit der Regierung zusammengearbeitet hatte, um die Risiken anzugehen. Dennoch merken Kritiker an, dass GPT-5.6 am 10. Juli breit eingeführt wurde, obwohl das UK AISI eine ähnliche Art von Schwachstelle gefunden hatte.cnbc+3
OpenAI bewertet GPT-5.6 Sol im Rahmen seines Preparedness Framework als Modell mit "hoher" Cybersicherheitsfähigkeit, sagt aber, dass das Modell nicht "kritisch" erreicht, da es keine End-to-End-Angriffe gegen gehärtete Ziele autonom ausführen kann. Der mehrschichtige Sicherheitsstapel des Unternehmens umfasst Aktivierungsklassifikatoren, die während der Generierung eingreifen, sowie eine Echtzeit-Ausgabescannung.helpnetsecurity+3
Die unterschiedlichen regulatorischen Reaktionen — Exportkontrollen für Anthropic, ein genehmigter Start für OpenAI — haben unter KI-Sicherheitsforschern eine Debatte über die Konsistenz der staatlichen Aufsicht über Frontline-Modelle mit offensivem Cyberpotenzial ausgelöst.nile1