Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

anthropicanthropicanthropicΗ Anthropic δημοσίευσε την Τρίτη μια ανάλυση προειδοποιώντας ότι το GLM-5.3, το νεότερο μοντέλο τεχνητής νοημοσύνης από την κινεζική εταιρεία Zhipu AI (γνωστή και ως Z.ai), μπορεί να δημιουργήσει αυτόνομα ολοκληρωμένα εργαλεία κυβερνοεπιθέσεων, εφάμιλλα του Claude Mythos Preview της ίδιας της Anthropic, αλλά κυκλοφόρησε ως μοντέλο ανοιχτού κώδικα χωρίς αποτελεσματικές δικλείδες ασφαλείας κατά της κακόβουλης χρήσης.anthropic
Η έκθεση της ομάδας Frontier Red Team της Anthropic διαπίστωσε ότι το GLM-5.3 ανέπτυξε λειτουργικά exploits σε 50 από τις 410 προσπάθειες στο ExploitBench, ένα εργαλείο μέτρησης ανάπτυξης επιθέσεων κατά γνωστών ευπαθειών της μηχανής V8 της Chrome, ιδιοκτησίας της Alphabet Inc. , σε σύγκριση με 56 για το Claude Mythos Preview. Σε ένα τεστ εκμετάλλευσης δυαδικών αρχείων, το GLM-5.3 πέτυχε πλήρη κατάληψη του ελέγχου ροής στο 4 τοις εκατό των δοκιμών, έναντι 6 τοις εκατό για το Mythos. Προγενέστερα μοντέλα, συμπεριλαμβανομένων των Claude Opus 4.6 και GLM-5.2, δεν σημείωσαν καμία επιτυχία.anthropic
Η κύρια ανησυχία της Anthropic δεν είναι μόνο οι δυνατότητες του μοντέλου, αλλά η απουσία δικλείδων ασφαλείας. Επειδή τα βάρη του GLM-5.3 είναι δημόσια διαθέσιμα, οι ενσωματωμένες αρνήσεις του μπορούν να αφαιρεθούν μέσω μιας τεχνικής που ονομάζεται abliteration. Η ομάδα της Anthropic, χωρίς προηγούμενη εμπειρία στη μέθοδο, μείωσε το ποσοστό άρνησης του μοντέλου από πάνω από 90 τοις εκατό σε περίπου 3 τοις εκατό σε τυπικά τεστ ασφαλείας, με κόστος υπολογιστικής ισχύος περίπου 4.400 δολαρίων. Αρκετοί προγραμματιστές δημοσίευσαν παρόμοιες ξεκλείδωτες εκδόσεις λίγες μέρες μετά την κυκλοφορία του μοντέλου τον Αύγουστο.anthropic
Πέρα από την πλήρη αφαίρεση των περιορισμών, λειτουργούν και απλούστερα τεχνάσματα. Ένα παραπλανητικό prompt που ισχυριζόταν ότι αποτελεί εξουσιοδοτημένη άσκηση red-team παρέκαμψε τις δικλείδες του GLM-5.3 στο 64 τοις εκατό των περιπτώσεων, ενώ η προ-συμπλήρωση των tokens συλλογισμού του μοντέλου αύξησε τη συμμόρφωση στο 92 τοις εκατό. Καμία από αυτές τις τεχνικές δεν πέτυχε κατά των μοντέλων Claude στις δοκιμές της Anthropic.anthropic
Σε μία από τις συνεδρίες των ερευνητών, το GLM-5.3 ανακάλυψε αρκετές άγνωστες μέχρι πρότινος ευπάθειες στη μηχανή JavaScript ενός δημοφιλούς προγράμματος περιήγησης και τις συνέδεσε σε ένα λειτουργικό exploit, μια ιστοσελίδα δηλαδή που διαβάζει αυθαίρετα αρχεία από τον υπολογιστή του επισκέπτη. Το μικρότερο GLM-5.3-Flash δημιούργησε μια αξιόπιστη αλυσίδα επίθεσης για μια γνωστή ευπάθεια του Chrome μέσα σε οκτώ ώρες υπολογιστικής επεξεργασίας και 20 λεπτά ανθρώπινης παρέμβασης, με κόστος API 20,40 δολαρίων.anthropic
Στις 17 Σεπτεμβρίου, το Κέντρο Προτύπων και Καινοτομίας Τεχνητής Νοημοσύνης του NIST δημοσίευσε τη δική του αξιολόγηση, χαρακτηρίζοντας το GLM-5.3 «το πιο ικανό μοντέλο ανοιχτού κώδικα για κυβερνοεπιθέσεις που έχει κυκλοφορήσει μέχρι σήμερα», σημειώνοντας παράλληλα ότι οι δυνατότητές του υπολείπονται περίπου τέσσερις μήνες από τα τρέχοντα κορυφαία μοντέλα των ΗΠΑ. Η Z.ai κυκλοφόρησε αρχικά το GLM-5.3 μέσω του API της τον Αύγουστο και διέθεσε τα βάρη στο Hugging Face δύο εβδομάδες αργότερα, δηλώνοντας ότι η καθυστέρηση επέτρεψε πρόσθετες αξιολογήσεις ασφαλείας.trendingtopics+2
Δεν συμμερίζονται όλοι την ανησυχία της Anthropic. Ο Jake Williams της IANS Research δήλωσε στο The New Stack ότι, αν και οι επιτιθέμενοι θα χρησιμοποιήσουν το μοντέλο, δεν αναμένει ότι θα αλλάξει ουσιαστικά το τοπίο των απειλών. Οι επικριτές επεσήμαναν επίσης μια πιθανή σύγκρουση συμφερόντων, σημειώνοντας ότι η Anthropic ανταγωνίζεται άμεσα τη Z.ai και ήταν το μόνο μεγάλο εργαστήριο τεχνητής νοημοσύνης που δεν υπέγραψε την επιστολή του κλάδου υπέρ των ανοιχτών μοντέλων, την οποία υποστήριξαν οι Nvidia , Meta , Microsoft , OpenAI και Google.trendingtopics
Η Anthropic πλαισίωσε το γεγονός ως μια στιγμή που απαιτεί διευρυμένη πρόσβαση για τους αμυνόμενους: «Ένα κρίσιμο όριο στις ελεύθερα προσβάσιμες δυνατότητες έχει πλέον ξεπεραστεί».anthropic