Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

reutersreutersreuters+1Kinijos dirbtinio intelekto startuolis „Z.ai“ penktadienį paskelbė, kad jo atvirojo kodo „GLM-5.3“ modelis „CyberGym“ pažeidžiamumo aptikimo vertinimo sistemoje surinko 84,5%, šiek tiek aplenkdamas 83,8% rezultatą, gautą tiriant „Anthropic“ riboto naudojimo „Mythos 5“ modelį. Šie rezultatai, kurie nebuvo nepriklausomai patikrinti, žymi naujausią Kinijos DI įmonės pastangą mesti iššūkį JAV dominavimui pažangių DI technologijų srityje.reuters
Nors „GLM-5.3“ šiek tiek pirmauja nustatant programinės įrangos spragas, jis atsiliko nuo „Mythos 5“ paverčiant šiuos atradimus veikiančiais išnaudojimo įrankiais – tai standartinė gynybinio saugumo tyrimų dalis. „Z.ai“ pranešė, kad jos modelis „ExploitBench“ teste surinko 54,4%, palyginti su 78,0% „Mythos 5“ rezultatu. Atliekant laiko limituotą užduotį, „GLM-5.3“ per dvi valandas atliko 105 atakų kūrimo užduotis, o „Anthropic“ modelis – 181.reuters
Be kibernetinio saugumo, 743 milijardų parametrų modelis pasiekė aukščiausią rezultatą tarp atvirojo kodo modelių „Terminal-Bench 3.0“ teste (28,3 balo), aplenkdamas „Moonshot AI“ modelį „Kimi K3“, ir surinko 66,9 balo „DeepSWE 1.1“ teste, teigiama „Zhipu AI“, įmonės, kuriai priklauso „Z.ai“ prekės ženklas, techninėje ataskaitoje. „Zhipu“ teigimu, „GLM-5.3“ programavimo ir agento galimybės priartėja prie „Anthropic“ modelio „Claude Fable 5“.chinadaily
„Z.ai“ pristatė šį paleidimą kaip tiesioginį iššūkį uždaro tipo „Mythos“ modeliui – tai „Claude Fable 5“ versija be kibernetinio saugumo apsaugų, kurią „Anthropic“ teikia tik patikrintoms organizacijoms. „Z.ai“ argumentavo, kad pažangūs kibernetinės gynybos įrankiai turėtų būti prieinami atvirojo kodo kūrėjams ir mažesnėms saugumo komandoms, o ne kontroliuojami kelių uždaro modelio tiekėjų.reuters
Įmonė teigė planuojanti viešai išleisti modelį maždaug po dviejų savaičių, baigus saugumo vertinimus. Jautriausios kibernetinio saugumo funkcijos bus prieinamos tik per „patikimos prieigos“ programą patikrintiems vartotojams. „Z.ai“ taip pat paskelbė apie „Open Source Shield“ iniciatyvą, skirtą atvirojo kodo projektams audituoti ir suteikti prieigą prie gynybinių modelių.devdiscourse+1
Kritikai pažymėjo, kad apsaugos priemones tampa sunkiau užtikrinti, kai modelio svoriai išleidžiami viešai, nes tai leidžia kitiems keisti modelį arba derinti jį su išoriniais įrankiais. „Z.ai“ teigė pridėjusi apsaugos priemonių, įskaitant sistemas, skirtas rizikingoms užklausoms tikrinti, išvesties stebėsenai ir modelio mokymui atmesti kenkėjiškas užduotis.reuters
„Z.ai“ nėra pirmoji Kinijos įmonė, teigianti pasiekusi „Mythos“ lygio galimybes. Kibernetinio saugumo bendrovė „360“ birželį teigė, kad jos „Tulongfeng“ sistema pasiekė lygiaverčius rezultatus derindama DI modelius su saugumo duomenimis ir automatizuotais įrankiais, nors šie teiginiai taip pat nebuvo patikrinti. „GLM-5.3“ remiasi savo pirmtako „GLM-5.2“ sėkme, kuris išpopuliarėjo tarp užsienio kūrėjų dėl galimybių, prilygstančių pirmaujantiems JAV modeliams, tačiau už mažesnę kainą.reuters