Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

reutersreutersreuters+1Den kinesiska AI-startupen Z.ai meddelade på fredagen att deras öppen källkodsmodell GLM-5.3 fick 84,5 % på CyberGym-testet för sårbarhetsdetektering, vilket är en knapp ledning över de 83,8 % som rapporterats för Anthropic begränsade Mythos 5-modell. Resultaten, som inte har verifierats oberoende, markerar det senaste försöket från ett kinesiskt AI-företag att utmana USA:s dominans inom avancerad AI.reuters
Medan GLM-5.3 knep förstaplatsen när det gäller att identifiera mjukvarufel, låg den efter Mythos 5 i att omvandla dessa upptäckter till fungerande utnyttjanden, vilket är en standardkomponent inom defensiv säkerhetsforskning. Z.ai rapporterade att deras modell fick 54,4 % på ExploitBench-testet jämfört med 78,0 % för Mythos 5. I en tidsbegränsad övning slutförde GLM-5.3 105 attackutvecklingsuppgifter på två timmar, jämfört med 181 för Anthropic modell.reuters
Utöver cybersäkerhet fick modellen med 743 miljarder parametrar den högsta poängen bland öppen källkodsmodeller på Terminal-Bench 3.0 med 28,3, före Moonshot AI:s Kimi K3, och fick 66,9 på DeepSWE 1.1, enligt en teknisk rapport från Zhipu AI, företaget bakom varumärket Z.ai. Zhipu hävdar att GLM-5.3:s kodnings- och agentförmågor närmar sig Anthropic Claude Fable 5.chinadaily
Z.ai ramade in lanseringen som en direkt utmaning mot den stängda åtkomstmodellen för Mythos, en version av Claude Fable 5 där cybersäkerhetsskydd tagits bort och som Anthropic endast gör tillgänglig för godkända organisationer. Z.ai argumenterade för att avancerade cybersäkerhetsverktyg bör vara tillgängliga för utvecklare av öppen källkod och mindre säkerhetsteam istället för att kontrolleras av ett fåtal leverantörer av stängda modeller.reuters
Företaget uppger att de planerar att släppa modellen publikt om cirka två veckor efter att säkerhetsutvärderingar slutförts. De mest känsliga cybersäkerhetsfunktionerna kommer endast att finnas tillgängliga via ett program för "betrodd åtkomst" för verifierade användare. Z.ai tillkännagav också ett "Open Source Shield"-initiativ för att granska projekt med öppen källkod och tillhandahålla åtkomst till defensiva modeller.devdiscourse+1
Kritiker har noterat att säkerhetsåtgärder blir svårare att upprätthålla när modellvikter släpps offentligt, vilket gör det möjligt för andra att ändra eller kombinera modellen med externa verktyg. Z.ai uppgav att de har lagt till skydd, inklusive system för att filtrera riskfyllda förfrågningar, övervaka utdata och träna modellen att avvisa skadliga uppgifter.reuters
Z.ai är inte det första kinesiska företaget som hävdar att de har kapacitet på Mythos-nivå. Cybersäkerhetsföretaget 360 sa i juni att deras Tulongfeng-system hade uppnått likvärdig prestanda genom att kombinera AI-modeller med säkerhetsdata och automatiserade verktyg, även om dessa påståenden inte heller var verifierade. GLM-5.3 bygger på den globala framgången för föregångaren GLM-5.2, som blev populär bland utländska utvecklare för att erbjuda förmågor som närmar sig ledande amerikanska modeller till en lägre kostnad.reuters