Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

anthropicanthropicanthropicAnthropic birti greiningu á þriðjudag þar sem varað er við því að GLM-5.3, nýjasta gervigreindarlíkanið frá kínverska þróunaraðilanum Zhipu AI (einnig þekkt sem Z.ai), geti sjálfvirkt búið til heildstæðar netárásir á borð við Claude Mythos Preview frá Anthropic, en líkanið hefur verið gefið út sem opið líkan án virkra öryggisráðstafana gegn misnotkun.anthropic
Skýrsla frá Frontier Red Team hjá Anthropic leiddi í ljós að GLM-5.3 þróaði virkar árásir í 50 af 410 tilraunum á ExploitBench, viðmiði sem mælir árásarþróun gegn þekktum veikleikum í V8 vél Chrome frá Alphabet Inc. , samanborið við 56 fyrir Claude Mythos Preview. Á öðru viðmiði náði GLM-5.3 fullri stjórn á flæði í 4 prósent tilvika á móti 6 prósentum hjá Mythos. Fyrri gerðir, þar á meðal Claude Opus 4.6 og GLM-5.2, náðu engum árangri.anthropic
Helsta áhyggjuefni Anthropic er ekki geta líkansins ein og sér heldur skortur á öryggisgirðingum. Þar sem vigtir GLM-5.3 eru opinberlega aðgengilegar er hægt að fjarlægja innbyggðar höfnanir með tækni sem kallast „abliteration“. Teymi Anthropic, án fyrri reynslu af aðferðinni, lækkaði höfnunarhlutfall líkansins úr yfir 90 prósentum í um 3 prósent á stöðluðum viðmiðum fyrir skaðsemi fyrir um 4.400 dollara í tölvuvinnslu. Nokkrir forritarar birtu svipaðar ólæstar útgáfur innan nokkurra daga frá útgáfu líkansins í ágúst.anthropic
Fyrir utan fulla „abliteration“ virka einfaldari brellur einnig. Villandi leiðbeiningar sem þóttust vera viðurkennd öryggisprófun fóru framhjá öryggisráðstöfunum GLM-5.3 í 64 prósent tilvika; að fylla út hugsunarkeðju líkansins fyrirfram jók hlýðni í 92 prósent. Engin af þessum aðferðum virkaði gegn Claude líkönum í prófunum Anthropic.anthropic
Í einni rannsókn uppgötvaði GLM-5.3 nokkra áður óþekkta veikleika í JavaScript vél vinsæls vafra og tengdi þá saman í virka árás, vefsíðu sem les handahófskenndar skrár úr tölvu notandans. Minni gerðin, GLM-5.3-Flash, bjó til áreiðanlega árásarkeðju fyrir þekktan Chrome veikleika á átta klukkustundum í tölvuvinnslu og 20 mínútum af mannlegri vinnu, sem kostaði 20,40 dollara í API gjöldum.anthropic
Þann 17. september birti Center for AI Standards and Innovation hjá NIST eigin úttekt þar sem GLM-5.3 var kallað „öflugasta opna líkanið fyrir netárásir sem gefið hefur verið út“ en tekið fram að geta þess sé um fjórum mánuðum á eftir fremstu líkönum í Bandaríkjunum. Z.ai setti GLM-5.3 fyrst á markað í gegnum API sitt í ágúst og gaf út vigtirnar á Hugging Face tveimur vikum síðar, með þeim rökum að seinkunin hefði gefið svigrúm til frekari öryggismats.trendingtopics+2
Ekki eru allir sammála áhyggjum Anthropic. Jake Williams hjá IANS Research sagði við The New Stack að þótt ógnaraðilar muni nota líkanið, búist hann ekki við að það breyti ógnarmyndinni verulega. Gagnrýnendur hafa einnig bent á hugsanlega hagsmunaárekstra og tekið fram að Anthropic keppi beint við Z.ai og hafi verið eina stóra gervigreindarstofan sem skrifaði ekki undir iðnaðaryfirlýsingu til stuðnings opnum líkönum sem studd eru af Nvidia , Meta , Microsoft , OpenAI og Google.trendingtopics
Anthropic túlkar þessa stöðu sem augnablik sem krefst aukins aðgangs fyrir varnaraðila: „Mikilvægum þröskuldi í frjálslega aðgengilegri getu hefur nú verið náð“.anthropic