Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

reutersreutersreuters+1Η κινεζική startup τεχνητής νοημοσύνης Z.ai ανακοίνωσε την Παρασκευή ότι το μοντέλο ανοιχτού κώδικα GLM-5.3 συγκέντρωσε 84,5% στο benchmark εντοπισμού ευπαθειών CyberGym, ξεπερνώντας ελαφρώς το 83,8% που αναφέρθηκε για το περιορισμένο μοντέλο Mythos 5 της Anthropic. Τα αποτελέσματα, τα οποία δεν έχουν επαληθευτεί ανεξάρτητα, αποτελούν την τελευταία προσπάθεια μιας κινεζικής εταιρείας AI να αμφισβητήσει την κυριαρχία των ΗΠΑ στις δυνατότητες τεχνητής νοημοσύνης αιχμής.reuters
Παρόλο που το GLM-5.3 προηγήθηκε στον εντοπισμό κενών ασφαλείας λογισμικού, υστερούσε έναντι του Mythos 5 στη μετατροπή αυτών των ανακαλύψεων σε λειτουργικά exploits, ένα τυπικό στοιχείο της αμυντικής έρευνας ασφαλείας. Η Z.ai ανέφερε ότι το μοντέλο της συγκέντρωσε 54,4% στο τεστ ExploitBench σε σύγκριση με το 78,0% του Mythos 5. Σε μια χρονομετρημένη άσκηση, το GLM-5.3 ολοκλήρωσε 105 εργασίες ανάπτυξης επιθέσεων σε δύο ώρες έναντι 181 του μοντέλου της Anthropic.reuters
Πέρα από την κυβερνοασφάλεια, το μοντέλο των 743 δισεκατομμυρίων παραμέτρων πέτυχε την υψηλότερη βαθμολογία μεταξύ των μοντέλων ανοιχτού κώδικα στο Terminal-Bench 3.0 με 28,3, μπροστά από το Kimi K3 της Moonshot AI, και σημείωσε 66,9 στο DeepSWE 1.1, σύμφωνα με τεχνική έκθεση της Zhipu AI, της εταιρείας πίσω από το brand Z.ai. Η Zhipu δήλωσε ότι οι δυνατότητες κώδικα και πρακτόρων του GLM-5.3 πλησιάζουν εκείνες του Claude Fable 5 της Anthropic.chinadaily
Η Z.ai πλαισίωσε την κυκλοφορία ως άμεση πρόκληση στην προσέγγιση κλειστής πρόσβασης του Mythos, μιας έκδοσης του Claude Fable 5 με αφαιρεμένες τις δικλείδες ασφαλείας κυβερνοασφάλειας, την οποία η Anthropic διαθέτει μόνο σε ελεγμένους οργανισμούς. Η Z.ai υποστήριξε ότι τα προηγμένα εργαλεία κυβερνοάμυνας πρέπει να είναι προσβάσιμα σε προγραμματιστές ανοιχτού κώδικα και μικρότερες ομάδες ασφαλείας αντί να ελέγχονται από λίγους παρόχους κλειστών μοντέλων.reuters
Η εταιρεία δήλωσε ότι σχεδιάζει να κυκλοφορήσει το μοντέλο δημόσια σε περίπου δύο εβδομάδες μετά την ολοκλήρωση των αξιολογήσεων ασφαλείας. Οι πιο ευαίσθητες λειτουργίες κυβερνοασφάλειας θα είναι διαθέσιμες μόνο μέσω ενός προγράμματος έμπιστης πρόσβασης για επαληθευμένους χρήστες. Η Z.ai ανακοίνωσε επίσης μια πρωτοβουλία Open Source Shield για τον έλεγχο έργων ανοιχτού κώδικα και την παροχή πρόσβασης σε αμυντικά μοντέλα.devdiscourse+1
Οι επικριτές έχουν επισημάνει ότι οι δικλείδες ασφαλείας γίνονται πιο δύσκολο να επιβληθούν μόλις τα βάρη του μοντέλου κυκλοφορήσουν δημόσια, επιτρέποντας σε άλλους να τροποποιήσουν ή να συνδυάσουν το μοντέλο με εξωτερικά εργαλεία. Η Z.ai δήλωσε ότι έχει προσθέσει προστασίες, συμπεριλαμβανομένων συστημάτων για τον έλεγχο επικίνδυνων αιτημάτων, την παρακολούθηση των αποτελεσμάτων και την εκπαίδευση του μοντέλου ώστε να απορρίπτει κακόβουλες εργασίες.reuters
Η Z.ai δεν είναι η πρώτη κινεζική εταιρεία που ισχυρίζεται δυνατότητες επιπέδου Mythos. Η εταιρεία κυβερνοασφάλειας 360 δήλωσε τον Ιούνιο ότι το σύστημα Tulongfeng είχε επιτύχει αντίστοιχη απόδοση συνδυάζοντας μοντέλα AI με δεδομένα ασφαλείας και αυτοματοποιημένα εργαλεία, αν και αυτοί οι ισχυρισμοί δεν είχαν επίσης επαληθευτεί. Το GLM-5.3 βασίζεται στην παγκόσμια απήχηση του προκατόχου του GLM-5.2, το οποίο κέρδισε δημοτικότητα μεταξύ των ξένων προγραμματιστών προσφέροντας δυνατότητες που πλησιάζουν τα κορυφαία μοντέλα των ΗΠΑ με χαμηλότερο κόστος.reuters