Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

anthropicanthropicanthropicAnthropic publiserte tirsdag en analyse som advarer om at GLM-5.3, den nyeste AI-modellen fra den kinesiske utvikleren Zhipu AI (også kjent som Z.ai), autonomt kan bygge ende-til-ende cyberangrep på linje med Anthropics egen Claude Mythos Preview, men at den er utgitt som en åpen-vekt-modell uten effektive sikkerhetstiltak mot misbruk.anthropic
Rapporten fra Anthropics Frontier Red Team viser at GLM-5.3 utviklet fungerende angrep i 50 av 410 forsøk på ExploitBench, en test som måler utvikling av angrep mot kjente sårbarheter i Chrome-motoren V8 fra Alphabet Inc. , sammenlignet med 56 for Claude Mythos Preview. På en test for binær utnyttelse oppnådde GLM-5.3 full kontroll over kontrollflyten i 4 prosent av forsøkene, mot 6 prosent for Mythos. Tidligere modeller, inkludert Claude Opus 4.6 og GLM-5.2, lyktes ikke i noen av tilfellene.anthropic
Anthropics hovedbekymring er ikke bare kapasiteten, men fraværet av sikkerhetsmekanismer. Siden vektene til GLM-5.3 er offentlig tilgjengelige, kan de innebygde avvisningene fjernes gjennom en teknikk kalt "abliteration". Anthropics team, uten forutgående erfaring med metoden, reduserte modellens avvisningsrate fra over 90 prosent til rundt 3 prosent på standard tester for skadelig innhold til en kostnad på omtrent 4 400 dollar i datakraft. Flere utviklere publiserte lignende opplåste versjoner bare dager etter modellens lansering i august.anthropic
Utenom fullstendig fjerning av sikkerhetsmekanismer fungerer også enklere triks. En villedende instruks som utga seg for å være en autorisert sikkerhetstest, omgikk GLM-5.3 sine sikkerhetstiltak 64 prosent av gangene; forhåndsutfylling av modellens tankeprosess-tokens økte etterlevelsen til 92 prosent. Ingen av disse teknikkene lyktes mot Claude-modellene i Anthropics tester.anthropic
I en forskerstyrt økt oppdaget GLM-5.3 flere tidligere ukjente sårbarheter i en populær nettlesers JavaScript-motor og lenket dem sammen til et fungerende angrep: en nettside som leser vilkårlige filer fra en besøkendes datamaskin. Den mindre GLM-5.3-Flash bygde en pålitelig angrepskjede for en kjent Chrome-sårbarhet i løpet av åtte timer med datakraft og 20 minutter med menneskelig innsats, til en API-kostnad på 20,40 dollar.anthropic
Den 17. september publiserte NIST sitt Center for AI Standards and Innovation sin egen evaluering, der de kalte GLM-5.3 "den mest cyber-kapable åpen-vekt-modellen som er utgitt til dags dato", samtidig som de bemerket at kapasiteten fortsatt ligger omtrent fire måneder bak dagens amerikanske toppmodeller. Z.ai lanserte først GLM-5.3 via sitt API i august og publiserte vektene på Hugging Face to uker senere, med begrunnelsen at forsinkelsen ga rom for ytterligere sikkerhetsvurderinger.trendingtopics+2
Ikke alle deler Anthropics bekymring. Jake Williams fra IANS Research uttalte til The New Stack at selv om trusselaktører vil bruke modellen, forventer han ikke at den vil endre trusselbildet nevneverdig. Kritikere har også pekt på en potensiell interessekonflikt, og bemerket at Anthropic konkurrerer direkte med Z.ai og var det eneste store AI-laboratoriet som ikke signerte et bransjeopprop til støtte for åpne modeller støttet av Nvidia , Meta , Microsoft , OpenAI og Google.trendingtopics
Anthropic rammet inn situasjonen som et øyeblikk som krever utvidet tilgang for forsvarere: "En kritisk terskel for fritt tilgjengelige kapasiteter er nå krysset".anthropic