Prompt Injection

OpenAIs GPT-6 Astra halluziniert weniger, bleibt aber anfällig für versteckte Angriffe

OpenAIs GPT-6 Astra, veröffentlicht am 3. September, markiert eine messbare Verbesserung der faktischen Genauigkeit und der Widerstandsfähigkeit gegen direkte Prompt-Manipulation im Vergleich zum Vorgänger GPT-5.6 Sol. Unabhängige Sicherheitstests zeigen jedoch, dass das Modell weiterhin durch versteckte Anweisungen in verarbeiteten Dokumenten…