Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

ft+1ft+1nai500Programvareverktøy som fjerner sikkerhetsbeskyttelse fra AI-modeller utviklet av Meta og Google Alphabet Inc. kan omgå sikkerhetsmekanismer i løpet av minutter, ifølge en undersøkelse publisert av Financial Times på søndag. De modifiserte systemene svarte på forespørsler om biologiske våpen, opprettelse av skadevare og utnyttelse av barn, noe som reiser ny bekymring for omfanget av frivillige sikkerhetstiltak i hele AI-bransjen.
Financial Times, i samarbeid med AI-sikkerhetsgruppen Alice, utførte tester som viste at offentlig tilgjengelige verktøysett kunne fjerne sikkerhetsfiltre fra mye brukte modeller på kort tid. Verktøysettene utnytter teknikker inkludert lett finjustering, datasett med fiendtlige instruksjoner og automatiserte transformasjoner av forespørsler som overskriver eller omgår innebygde beskyttelser uten at det kreves fullstendig omtrening av modellen. Ifølge rapporten blir disse verktøyene allerede brukt til å lage tusenvis av endrede modellversjoner som omgår leverandørpålagte restriksjoner.ft+2
Funnene kommer midt i økende akademiske bevis på strukturelle svakheter i AI-sikkerhetstilpasning. En studie fra februar publisert i Nature Communications fant at store resonneringsmodeller kunne brukes som autonome «jailbreak»-agenter, og oppnådde en suksessrate på 97 prosent på tvers av modellkombinasjoner uten menneskelig tilsyn. Separat demonstrerte en artikkel presentert ved ICLR 2026 en teknikk kalt Head-Masked Nullspace Steering som oppnådde opptil 99 prosent «jailbreak»-suksess ved å stille de spesifikke oppmerksomhetshodene som er ansvarlige for sikkerhetsavslag.nature+1
Undersøkelsen understreker en spenning i kjernen av strategien for AI med åpne vekter, fremmet av Metas Llama-serie og Googles Gemma-utvalg. Selv om åpne vekter akselererer forskning og adopsjon blant utviklere, tillater de også utenforstående å modifisere eller pakke om modeller med endrede sikkerhetsstandarder. Cybersikkerhetsanalytikere har advart om at mange AI-sikkerhetsbeskyttelser kun eksisterer på et overflatenivå, og når brukere får tilgang til modellvekter, kan restriksjoner fjernes ved hjelp av fritt distribuerte verktøy.nai500+1
The New York Times rapporterte tidligere denne måneden at AI-sikkerhetskontroller i hele bransjen forblir stort sett ineffektive, og bemerket at forskere hos cybersikkerhetsfirmaet LayerX hadde omgått Claudes sikkerhetsmekanismer med minimal innsats.nytimes
Reguleringsorganer i Washington, Brussel og London har signalisert at frivillige forpliktelser fra AI-utviklere ikke vil være tilstrekkelige. USA har allerede rammeverk for presidentordrer og NIST-retningslinjer som kan utnyttes til håndheving, mens EUs AI-lov pålegger straffer for systemiske sikkerhetssvikt. Funnene vil sannsynligvis intensivere kravene om håndhevbare standarder som regulerer både AI-systemer med lukkede og åpne vekter, noe som potensielt kan bremse adopsjon i bedrifter ettersom innkjøpsteam krever sterkere tekniske garantier og uavhengige revisjonsspor.nai500