Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

reutersreutersreuters+1Čínský startup v oblasti umělé inteligence Z.ai v pátek oznámil, že jeho open-source model GLM-5.3 dosáhl v benchmarku pro detekci zranitelností CyberGym skóre 84,5 %, čímž mírně překonal 83,8 %, které byly hlášeny pro omezený model Mythos 5 od společnosti Anthropic. Výsledky, které nebyly nezávisle ověřeny, představují nejnovější snahu čínské AI společnosti zpochybnit dominanci USA v oblasti špičkových schopností umělé inteligence.reuters
Zatímco GLM-5.3 mírně předstihl konkurenci v identifikaci softwarových chyb, zaostával za Mythos 5 v převádění těchto objevů na funkční exploity, což je standardní součást defenzivního bezpečnostního výzkumu. Z.ai uvedla, že její model dosáhl v testu ExploitBench skóre 54,4 % ve srovnání se 78,0 % u Mythos 5. V časově omezeném cvičení dokončil GLM-5.3 105 úkolů vývoje útoků za dvě hodiny oproti 181 úkolům u modelu Anthropic.reuters
Kromě kybernetické bezpečnosti dosáhl tento model se 743 miliardami parametrů nejvyššího skóre mezi open-source modely v testu Terminal-Bench 3.0 s hodnotou 28,3, čímž předstihl Kimi K3 od Moonshot AI, a získal 66,9 bodu v DeepSWE 1.1, uvádí technická zpráva společnosti Zhipu AI, která stojí za značkou Z.ai. Zhipu uvedla, že schopnosti kódování a agentní funkce GLM-5.3 se blíží schopnostem modelu Claude Fable 5 od Anthropic.chinadaily
Z.ai prezentovala toto spuštění jako přímou výzvu uzavřenému přístupu k Mythos, verzi Claude Fable 5 s odstraněnými bezpečnostními pojistkami, kterou Anthropic zpřístupňuje pouze prověřeným organizacím. Z.ai argumentovala, že pokročilé nástroje kybernetické obrany by měly být dostupné open-source vývojářům a menším bezpečnostním týmům, namísto toho, aby byly kontrolovány hrstkou poskytovatelů uzavřených modelů.reuters
Společnost uvedla, že plánuje model veřejně vydat přibližně za dva týdny po dokončení bezpečnostních hodnocení. Jeho nejcitlivější funkce kybernetické bezpečnosti budou dostupné pouze prostřednictvím programu „důvěryhodného přístupu“ pro ověřené uživatele. Z.ai také oznámila iniciativu „Open Source Shield“ pro audit open-source projektů a poskytování přístupu k defenzivním modelům.devdiscourse+1
Kritici poznamenali, že bezpečnostní pojistky je obtížnější vynutit, jakmile jsou váhy modelu veřejně vydány, což umožňuje ostatním model upravovat nebo kombinovat s externími nástroji. Z.ai uvedla, že přidala ochranné prvky, včetně systémů pro prověřování rizikových požadavků, monitorování výstupů a trénování modelu tak, aby odmítal škodlivé úkoly.reuters
Z.ai není první čínskou firmou, která tvrdí, že dosáhla schopností na úrovni Mythos. Kybernetická bezpečnostní společnost 360 v červnu uvedla, že její systém Tulongfeng dosáhl srovnatelného výkonu kombinací AI modelů s bezpečnostními daty a automatizovanými nástroji, ačkoliv tato tvrzení rovněž nebyla ověřena. GLM-5.3 staví na globálním úspěchu svého předchůdce GLM-5.2, který si získal popularitu mezi zahraničními vývojáři díky tomu, že nabízel schopnosti blížící se předním americkým modelům za nižší cenu.reuters