Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

wiredwiredlinkedinΜια ομάδα ερευνητών ανέπτυξε μια τεχνική για την εξαγωγή κρυφών ιχνών συλλογισμού από κορυφαία μοντέλα τεχνητής νοημοσύνης, αποκαλύπτοντας ενδείξεις ότι τουλάχιστον ένα κινεζικό σύστημα AI ενδέχεται να έχει εκπαιδευτεί μέσω απόσταξης γνώσης από αμερικανικά αντίστοιχα συστήματα, αν και οι ερευνητές τονίζουν ότι τα ευρήματά τους δεν αποτελούν οριστική απόδειξη.
Επιστήμονες υπολογιστών από το Πανεπιστήμιο του Τίμπινγκεν, το Ινστιτούτο Μαξ Πλανκ, τον οργανισμό ασφάλειας AI MATS Research και την εταιρεία κυβερνοασφάλειας Snyk ανακάλυψαν μια ευπάθεια σε μοντέλα των OpenAI, Anthropic και Google Alphabet Inc. , η οποία επιτρέπει την εξαγωγή κρυφών βημάτων συλλογισμού, δηλαδή των λεπτομερών διαδικασιών αλυσίδας σκέψης που χρησιμοποιούν αυτά τα συστήματα για την επίλυση σύνθετων προβλημάτων.wired
«Όλοι οι κορυφαίοι πάροχοι μοντέλων που εξετάσαμε παρουσιάζουν αυτή την ευπάθεια», δήλωσε ο Alexander Panfilov, επιστήμονας υπολογιστών στο Πανεπιστήμιο του Τίμπινγκεν που συμμετείχε στην έρευνα. «Αυτό θα μπορούσε να οδηγήσει σε διαρροή προσωπικών δεδομένων και διευκολύνει επιθέσεις απόσταξης συλλογιστικής μεγάλης κλίμακας».wired
Στην εργασία τους, οι ερευνητές δείχνουν ότι το μοντέλο ανοιχτών βαρών Kimi K3 της Moonshot AI παράγει αποτελέσματα «εξαιρετικά παρόμοια» με τα κρυφά ίχνη συλλογισμού των Claude Opus 4.8 και GPT 5.6 Sol για ορισμένα ερωτήματα. Ωστόσο, προειδοποιούν ότι η εργασία τους «δεν μπορεί να αποδείξει αιτιωδώς την απόσταξη». Οι ερευνητές διαπίστωσαν επίσης ότι δύο άλλα μοντέλα ανοιχτών βαρών, το DeepSeek της Κίνας και το Inkling της αμερικανικής Thinking Machines, δεν παρουσίασαν την ίδια ομοιότητα συλλογισμού με το Claude Opus.wired
Πέρα από το ζήτημα της απόσταξης, η τεχνική αποκάλυψε μια ευπάθεια ασφαλείας που θα μπορούσε να αξιοποιηθεί για την ανάκτηση ευαίσθητων πληροφοριών, όπως κωδικοί πρόσβασης και κλειδιά API, από τον εσωτερικό συλλογισμό ενός μοντέλου. Ο Panfilov και οι συνεργάτες του ειδοποίησαν την OpenAI, την Anthropic και την Google για το ζήτημα, και κάθε εταιρεία προσαρμοσε το API της για να μετριάσει το πρόβλημα. Αν και η εξαγωγή ιδιωτικών πληροφοριών δεν είναι πλέον δυνατή, ο Panfilov δήλωσε ότι ορισμένα ίχνη συλλογισμού μπορούν ακόμα να αποκαλυφθούν με τη χρήση της μεθόδου, και ότι η πλήρης διόρθωση του κινδύνου απόσταξης θα απαιτούσε «μια θεμελιώδη αναθεώρηση του τρόπου λειτουργίας των API αυτών των εταιρειών».linkedin
Τα ευρήματα έρχονται εν μέσω συνεχιζόμενων εντάσεων σχετικά με την απόσταξη AI μεταξύ αμερικανικών και κινεζικών εταιρειών. Τον Φεβρουάριο του 2026, η Anthropic και η OpenAI δημοσίευσαν στοιχεία για συστηματικές εκστρατείες απόσταξης από κινεζικές εταιρείες AI. Πιο πρόσφατα, όταν η Moonshot AI κυκλοφόρησε το Kimi K3 τον Ιούλιο, ο σύμβουλος επιστήμης του Λευκού Οίκου Michael Kratsios κατηγόρησε την εταιρεία για αντιγραφή της τεχνολογίας της Anthropic. Ανεξάρτητοι ειδικοί, ωστόσο, έχουν αμφισβητήσει αν το χρονικό διάστημα μεταξύ της δημόσιας κυκλοφορίας του Claude και της κυκλοφορίας του Kimi K3 ήταν αρκετά μικρό ώστε να υποστηρίξει αυτόν τον ισχυρισμό.iaps+2
Η νέα έρευνα της ομάδας του Panfilov προσθέτει μια τεχνική διάσταση στη συζήτηση, προσφέροντας μια μέθοδο που θα μπορούσε, κατ' αρχήν, να ανιχνεύσει την απόσταξη σε μεγάλη κλίμακα, υπογραμμίζοντας παράλληλα πώς τα ίδια εργαλεία διαφάνειας που προάγουν την ασφάλεια της AI μπορεί επίσης να εκθέσουν τα μοντέλα σε ανταγωνιστική εξαγωγή.