prompt-injektio

OpenAI:n GPT-6 Astra hallusinoi vähemmän, mutta on yhä altis piilotetuille hyökkäyksille

OpenAI:n 3. syyskuuta julkaisema GPT-6 Astra merkitsee mitattavaa parannusta faktatarkkuudessa ja vastustuskyvyssä suoralle kehotteiden manipuloinnille verrattuna edeltäjäänsä, GPT-5.6 Soliin. Riippumattomat tietoturvatestit kuitenkin paljastavat, että malli voidaan yhä vaarantaa sen käsittelemiin asiakirjoihin upotetuilla piilotetuilla ohjeilla – heikkous, joka vaikeuttaa sen käyttöä…