Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

openai+1dailytechnologyreview+1OpenAI kynnti á þriðjudaginn GPT-Red, innra sjálfvirkt „red-teaming“ kerfi sem notar sjálfspilun til að uppgötva „prompt injection“ veikleika í gervigreindarlíkönum fyrirtækisins í stórum stíl. Tilkynningin, sem birt var á rannsóknarbloggi OpenAI undir titlinum „GPT-Red: Unlocking Self-Improvement for Robustness,“ lýsir kerfinu sem sérhönnuðum andstæðingi sem ætlað er að prófa vörur fyrirtækisins áður en mannlegir árásaraðilar geta nýtt sér þær.openai+1
Samkvæmt MIT Technology Review, sem birti einkaskýrslu um verkefnið, er GPT-Red hannað til að virka sem „öflugur andstæðingur“ sem kannar kerfisbundið hvernig líkön OpenAI bregðast við árásum. Kerfið var notað til að þjálfa GPT-5.6, nýjustu flaggskipslíkanafjölskyldu OpenAI sem kom út 9. júlí, sem leiddi til þess sem fyrirtækið lýsti sem bættu viðnámi gegn „prompt injection“ árásum.technologyreview+2
Í kerfiskorti GPT-5.6 frá OpenAI kom fram að fyrirtækið eyddi um það bil 700.000 A100e GPU klukkustundum í „black-box sjálfvirkt red teaming“ fyrir almenna útgáfu líkansins, sem gerði því kleift að „kanna kerfisbundið líklega veikleika, finna leiðir til að brjóta öryggi (jailbreaks) og hjálpa okkur að styrkja kerfið fyrir útgáfu.“ GPT-Red virðist vera hápunktur þeirrar sjálfvirku prófunarinnviða, nú formfest sem nefnt kerfi með sjálfspilunargetu.openai
Útgáfan kemur á sama tíma og OpenAI stendur frammi fyrir vaxandi eftirliti vegna tvíþættrar notkunar á sífellt öflugri líkönum sínum. GPT-5.6 var metið með „háa“ getu í bæði netöryggi og líffræðilegri áhættu samkvæmt viðbúnaðarramma fyrirtækisins, þó það hafi ekki farið yfir „gagnrýna“ þröskuldinn í hvorugum flokknum. AI Safety Institute í Bretlandi staðfesti sérstaklega að GPT-5.5 hefði þegar sýnt fram á netgetu á landamærum tækninnar fyrr á þessu ári.aisi+1
OpenAI hefur verið að byggja upp sjálfvirkt „red teaming“ í nokkurn tíma. Atvinnuauglýsing frá maí 2026 auglýsti eftir rannsakanda til að leiða „Automated Red Teaming (ART) verkefni“ fyrirtækisins, með áherslu á að „byggja skalanleg, rannsóknardrifin kerfi sem afhjúpa stöðugt bilunarham.“ Fyrirtækið stóð einnig fyrir 500.000 dollara opinberri „red-teaming“ áskorun á Kaggle fyrir opna líkanið sitt í fyrra.jobs.ashbyhq+1
OpenAI setti GPT-Red fram sem hluta af viðleitni sinni til að „framtíðartryggja“ öryggisferla gegn ógnunum sem þróast samhliða getu líkana, og lýsti nálguninni í tilkynningu sinni sem notkun á sjálfspilun til að bæta „gervigreindaröryggi, samstillingu og viðnám gegn prompt injection.“openai