Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

reutersreutersreuters+1Kiinalainen tekoälyalan startup-yritys Z.ai ilmoitti perjantaina, että sen avoimen lähdekoodin GLM-5.3-malli sai 84,5 % haavoittuvuuksien tunnistamiseen tarkoitetussa CyberGym-testissä, ylittäen hieman Anthropicin rajoitetun Mythos 5 -mallin 83,8 % tuloksen. Tulokset, joita ei ole riippumattomasti vahvistettu, ovat uusin yritys kiinalaiselta tekoäly-yhtiöltä haastaa Yhdysvaltojen hallitseva asema tekoälyn huippukyvykkyyksissä.reuters
Vaikka GLM-5.3 nousi kärkeen ohjelmistovirheiden tunnistamisessa, se jäi jälkeen Mythos 5:stä näiden löydösten muuttamisessa toimiviksi hyökkäyksiksi, mikä on puolustuksellisen tietoturvatutkimuksen vakiokomponentti. Z.ai raportoi mallinsa saaneen 54,4 % ExploitBench-testissä verrattuna Mythos 5:n 78,0 % tulokseen. Aikarajoitetussa harjoituksessa GLM-5.3 suoritti 105 hyökkäyksen kehitystehtävää kahdessa tunnissa, kun Anthropicin malli suoritti 181.reuters
Kyberturvallisuuden ulkopuolella 743 miljardin parametrin malli saavutti korkeimman pistemäärän avoimen lähdekoodin mallien joukossa Terminal-Bench 3.0 -testissä (28,3), ohittaen Moonshot AI:n Kimi K3 -mallin, ja sai 66,9 pistettä DeepSWE 1.1 -testissä, kertoo Z.ai-brändin takana olevan Zhipu AI:n tekninen raportti. Zhipu totesi, että GLM-5.3:n koodaus- ja agenttikyvykkyydet lähestyvät Anthropicin Claude Fable 5 -mallia.chinadaily
Z.ai kehysti julkaisun suoraksi haasteeksi Mythos-mallin suljetulle pääsylle. Mythos on versio Claude Fable 5:stä, josta on poistettu kyberturvallisuuden suojaukset ja jonka Anthropic tarjoaa vain tarkastetuille organisaatioille. Z.ai väitti, että kehittyneiden kyberpuolustustyökalujen tulisi olla avoimen lähdekoodin kehittäjien ja pienempien tietoturvatiimien saatavilla sen sijaan, että niitä hallitsisi kourallinen suljettujen mallien tarjoajia.reuters
Yhtiö kertoi suunnittelevansa mallin julkaisemista julkisesti noin kahden viikon kuluttua turvallisuusarviointien valmistuttua. Sen arkaluontoisimmat kyberturvallisuustoiminnot ovat saatavilla vain vahvistetuille käyttäjille tarkoitetun luotetun pääsyn ohjelman kautta. Z.ai ilmoitti myös Open Source Shield -aloitteesta, jonka tarkoituksena on auditoida avoimen lähdekoodin projekteja ja tarjota pääsy puolustuksellisiin malleihin.devdiscourse+1
Kriitikot ovat huomauttaneet, että suojauksia on vaikeampi valvoa, kun mallin painoarvot on julkaistu julkisesti, mikä mahdollistaa muiden muokata mallia tai yhdistää sitä ulkoisiin työkaluihin. Z.ai kertoi lisänneensä suojauksia, kuten järjestelmiä riskialttiiden pyyntöjen seulomiseen, tulosten valvontaan ja mallin kouluttamiseen haitallisten tehtävien hylkäämiseksi.reuters
Z.ai ei ole ensimmäinen kiinalainen yritys, joka väittää saavuttaneensa Mythos-tason kyvykkyydet. Kyberturvallisuusyhtiö 360 ilmoitti kesäkuussa, että sen Tulongfeng-järjestelmä oli saavuttanut vastaavan suorituskyvyn yhdistämällä tekoälymalleja tietoturvadataan ja automatisoituihin työkaluihin, vaikka näitäkään väitteitä ei ole vahvistettu. GLM-5.3 rakentuu edeltäjänsä GLM-5.2:n maailmanlaajuisen suosion varaan, joka saavutti suosiota ulkomaisten kehittäjien keskuudessa tarjoamalla johtavia yhdysvaltalaisia malleja lähestyviä kyvykkyyksiä edullisemmin.reuters