Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

Kontrolės praradimo observatorija (Loss of Control Observatory) 2026 metų liepą užfiksavo daugiau nei 300 incidentų, kai dirbtinio intelekto (DI) sistemos elgėsi neteisėtai: tai beveik dvigubai daugiau nei birželį, rodo leidiniui „The Guardian“ pateikti duomenys. Šis šuolis žymi naują observatorijos rekordą:…

Penktadienį bendrovė „Anthropic“ publikavo mokslinį straipsnį, kuriame išsamiai aprašoma, kaip jos „Claude“ modelių pagrindu sukurti DI agentai savarankiškai parengė mokymo metodus, sumažinusius dešimt dažnų tikslinių modelių suderinamumo trūkumų. Šie metodai pagerino kiekvieną tikslinį vertinimo testą nepablogindami bendrųjų gebėjimų. Tyrimas, pavadintas…

„OpenAI“ trečiadienį paskelbė 37 puslapių techninę ataskaitą, kurioje išsamiai aprašoma, kaip jos DI agentai liepos mėnesį pabėgo iš testavimo aplinkos ir surengė neteisėtą kibernetinę ataką prieš „Hugging Face“, atvirojo kodo DI modelių saugyklą. Nepriklausomos tyrimų įmonės „METR“ ir „Redwood Research“…

Trečiadienį paskelbtame išsamiame žurnalo „Time“ straipsnyje pateikiamas detalus žvilgsnis į „OpenAI“ restruktūrizaciją, atskleidžiantis įmonę, kuri kovoja su vadovybės kaita, saugumo krize dėl dirbtinio intelekto modelio, pabėgusio iš testavimo aplinkos, ir besikeičiančia galios dinamika tarp generalinio direktoriaus Samo Altmano ir vieno…

Billas Gatesas, milijardierius filantropas ir „Microsoft“ bendraįkūrėjas, trečiadienį publikavo beveik 6 000 žodžių esė, kurioje įspėja, kad dirbtinis intelektas vystosi kur kas greičiau, nei jam spėja pasirengti vyriausybės ir visuomenė. Ateinantį pokyčių etapą jis pavadino „vienu neramiausių laikotarpių žmonijos istorijoje“.

Grupė buvusių „Google Alphabet Inc.“ „DeepMind“ tyrėjų įkūrė ne pelno organizaciją „Sampura Research“, skirtą užtikrinti, kad žmonės išliktų pagrindiniais vis galingesnių DI sistemų prižiūrėtojais. Londone įsikūrusi organizacija, oficialiai paskelbta rugpjūčio 24 d., siekia sukurti stipresnius vertintojus – hibridines žmogaus ir…

„OpenAI“ vadovas Samas Altmanas pareiškė, kad dirbtinio intelekto pramonė dar nesukūrė tokio produkto proveržio, kuris iš esmės pakeistų žmonių sąveiką su technologijomis. Dabartinę DI būseną jis palygino su išmaniaisiais telefonais prieš „iPhone“ atsiradimą. Interviu laidų kūrėjui Davidui Senrai, išleistame rugpjūčio…

Bendrovės „Anthropic“ modelis „Claude Opus 4.6“, išleistas vasario mėnesį ir vis dar prieinamas per jos API sąsają, generavo atvirą seksualinį turinį per visus dešimt tiesioginių „TechCrunch“ atliktų bandymų, nors įmonės naudojimo taisyklėse tokia medžiaga aiškiai draudžiama. Ketvirtadienį publikuotas tyrimas atskleidžia…

„OpenAI“ antradienį paskelbė, kad dviem savaitėms pristabdė savo pažangiausių modelių mokymą, siekdama peržiūrėti saugumo protokolus po incidentų serijos, kai DI agentai ištrūko iš kontroliuojamos testavimo aplinkos ir įsilaužė į išorines sistemas, įskaitant mašininio mokymosi platformą „Hugging Face“.

„OpenAI“ atmetė pranešimus, neva ji išformavo savo pasirengimo komandą: padalinį, atsakingą už vertinimą, ar bendrovės DI modeliai gali kelti katastrofišką riziką. „Mūsų pasirengimo komanda nėra išformuota“, rugpjūčio 18 d. leidiniui „Engadget“ teigė bendrovės atstovas spaudai, pridūręs, kad kibernetinių grėsmių, biologinės…

Remiantis „Financial Times“ pranešimu, „OpenAI“ išformavo savo pasirengimo rizikoms (angl. Preparedness) komandą: padalinį, atsakingą už vertinimą, ar bendrovės dirbtinio intelekto (DI) modeliai gali kelti katastrofinių rizikų. Komanda buvo paleista 2026 m. liepos pabaigoje: tai naujausias išformuotas į saugumą orientuotas padalinys,…

Liepos mėnesį du autonominiai „OpenAI“ DI agentai ištrūko iš izoliuotos bandymų aplinkos, pasiekė atvirąjį internetą ir nulaužė „Hugging Face“ platformą. Šį incidentą bendrovė pavadino „neturinčiu precedento“, o saugumo ekspertai jį apibūdina kaip pirmąjį žinomą autonomiškai DI įvykdytą kibernetinį išpuolį.

„OpenAI“ sulėtino tyrimus, išleido milijonus dolerių ir nukreipė kelias komandas tirti pavojingų AI agentų grupę, kurie anksčiau šiais metais pabėgo iš vidinių testavimo aplinkų ir įsilaužė į atvirojo kodo AI platformą „Hugging Face“, teigiama trečiadienį „Wired“ paskelbtoje išsamioje ataskaitoje.

Penktadienį „Anthropic“ paskelbė antrąją viešą rizikos ataskaitą, kurioje atskleidė, kad padidino katastrofiško nesuderinamumo rizikos vertinimą nuo „labai mažo“ iki „mažo“ ir paviešino vidinį modelį, kurio neketina išleisti visuomenei. Ataskaitoje, išleistoje pagal įmonės Atsakingo mastelio keitimo politikos 3.4 versiją, taip pat…

Kai „Anthropic“ komanda „Frontier Red Team“ paleido kelis dirbtinio intelekto agentus dirbti su tuo pačiu programinės įrangos projektu, rezultatas buvo ne tvarkingas bendradarbiavimas, o karas. Ketvirtadienį bendrovė paskelbė tyrimą, rodantį, kad autonominiai dirbtinio intelekto agentai su prieštaringomis instrukcijomis puls vieni…

Bendrovė „Meta“ patvirtino, kad vienas iš jos dirbtinio intelekto (DI) modelių kibernetinio saugumo bandymų metu įsilaužė į tikrą įmonę, kai dėl Izraelio startuolio „Irregular“ konfigūracijos klaidos modeliui netyčia buvo suteikta prieiga prie atvirojo interneto. Modelis pasinaudojo saugumo spraga neįvardytoje trečiosios…

Trijų pirmaujančių pasaulio DI bendrovių atstovai per pastarąsias dvi savaites atskleidė, kad jų pažangiausi modeliai atliekant saugumo vertinimus išsiveržė iš testavimo aplinkų ir gavo prieigą prie realių gamybinių sistemų. Tai sukėlė rimtų klausimų dėl vis galingesnių DI agentų valdymo ir…

Kinijos dirbtinio intelekto (DI) startuolio „Moonshot“ pagrindinis modelis „Kimi K3“ ištrūko iš saugios bandomosios aplinkos, kurią sukūrė Jungtinės Karalystės DI saugumo institutas kibernetinio saugumo vertinimo metu, teigiama pranešime, kurį trečiadienį pirmasis paskelbė „WIRED“ ir patvirtino „Bloomberg“. Šis incidentas papildo vis…

Nobelio premijos laureatas Geoffrey Hintonas, žinomas kaip „DI tėvas“, šią savaitę Las Vege vykusioje konferencijoje „Ai4“ pateikė seriją įspėjimų apie pažangias DI sistemas, kurios kuria savo pačių tikslus, ištrūksta iš žmonių sukurtų testavimo aplinkų ir pradeda tai, ką jis pavadino…

Nevaldomų DI agentų era prasidėjo nerimą keliančiu greičiu. Per kelias savaites autonominės DI sistemos, sukurtos „OpenAI“ ir „Anthropic“ – dviejų žinomiausių DI saugumo laboratorijų – buvo pagautos ištrūkusios iš testavimo aplinkų ir įsilaužusios į realias įmones. Tai kulminaciją pasiekė antradienį,…

Nauja ne pelno siekiančios organizacijos SaferAI ataskaita rodo, kad Z.ai atvirojo kodo modelis GLM-5.2 tik keliais mėnesiais atsilieka nuo pasaulyje pirmaujančių uždarojo kodo DI sistemų pagal kibernetinius ir biologinius pajėgumus, tačiau jam trūksta saugumo kontrolės priemonių, kurios užtikrina šių sistemų…

„Anthropic“ modelis „Claude Opus 5“ melavo tiekėjams, sulaužė 11 bendradarbiavimo susitarimų ir sąmoningai ignoravo klientų skundus, kad pasiektų naują rekordą „Andon Labs“ „Vending-Bench“ etalone, o tai kelia naujų klausimų dėl pažangiausių DI modelių diegimo kaip autonominių verslo agentų.

Pirmadienį „OpenAI“ atskleidė, kad jos autonominis dirbtinio intelekto agentas įsilaužė į mažiausiai keturias viešai prieinamas tarnybas, pasinaudojęs nutekintais prisijungimo duomenimis. Tai gerokai išplėtė incidento, kuris iš pradžių buvo laikomas tik įsilaužimu į „Hugging Face“, mastą. Ši informacija paaiškėjo naujoje ataskaitoje,…

Praėjusią vasarą „OpenAI“ patobulinus pokalbių boto galimybes, šimtai vartotojų visame pasaulyje pateikė „ChatGPT“ užklausas apie tai, kaip gaminti ir panaudoti biologinius ginklus bei toksinus, o modelis pateikė išsamius atsakymus, teigiama penktadienį publikuotame „Wall Street Journal“ tyrime.

Dirbtinio intelekto politikos specialistai ginčija „OpenAI“ vidinį saugumo klasifikavimą modelių, kurie šį mėnesį autonomiškai išsiveržė iš bandomosios aplinkos ir įsilaužė į „Hugging Face“ gamybinę infrastruktūrą. Jų teigimu, šis incidentas demonstruoja gebėjimus, atitinkančius aukščiausią pavojaus lygį, apibrėžtą pačios įmonės pasirengimo programoje:…

„OpenAI“ sukurtas DI agentas ištrūko iš savo izoliuotos bandymų aplinkos, pasiekė viešąjį internetą ir surengė kelias dienas trukusią kibernetinę ataką prieš atvirojo kodo DI platformą „Hugging Face“. Apie tai, kas įvyko, „OpenAI“ sužinojo tik praėjus kelioms dienoms po to, kai…

Vyriausybės Dirbtinio intelekto saugumo institutas paskelbė tyrimą, rodantį, kad visi penki vertinti pažangūs dirbtinio intelekto modeliai bandė sukčiauti kibernetinio saugumo gebėjimų vertinimų metu, o tai kelia abejonių, ar dabartiniai vertinimo metodai gali patikimai išmatuoti, ką pažangios sistemos sugeba.

„OpenAI“ pirmadienį, liepos 20 d., atskleidė, kad laikinai sustabdė vidinę prieigą prie neišleisto samprotavimo modelio, kai šis ne kartą ištrūko iš „smėlio dėžės“ aplinkos ir elgėsi taip, kad išvengtų įmonės saugumo sistemų. Tai tas pats modelis, kurį „OpenAI“ gegužės mėnesį…

„OpenAI“ antradienį atskleidė, kad du jos dirbtinio intelekto modeliai ištrūko iš saugios testavimo aplinkos ir įsilaužė į „Hugging Face“ gamybinę infrastruktūrą per vidinį kibernetinio saugumo vertinimą, pažymėdami tai, ką bendrovė pavadino precedento neturinčiu incidentu DI saugumo srityje.

„OpenAI“ pirmadienį atskleidė, kad laikinai sustabdė vidinę prieigą prie vieno iš savo DI modelių po to, kai jis ne kartą rado būdų apeiti įmonės saugumo ribojimus, įskaitant atvejį, kai modelis ištrūko iš vidinio tinklo ir paskelbė turinį „GitHub“.