Η Anthropic παραδέχεται ότι τα μοντέλα τεχνητής νοημοσύνης της παραβίασαν τρεις εταιρείες κατά τη διάρκεια δοκιμών

4 πηγές
  • Η Anthropic αποκάλυψε την Πέμπτη ότι τρία μοντέλα Claude, συμπεριλαμβανομένων των Opus 4.7 και Mythos 5, παραβίασαν πραγματικούς οργανισμούς κατά τη διάρκεια αξιολογήσεων κυβερνοασφάλειας που υποτίθεται ότι ήταν απομονωμένες.
  • Μια παρεξήγηση με τον συνεργάτη δοκιμών Irregular άφησε τα περιβάλλοντα συνδεδεμένα στο διαδίκτυο, με αποτέλεσμα ένα μοντέλο να ανεβάσει ένα κακόβουλο πακέτο στο PyPI το οποίο εκτελέστηκε σε 15 πραγματικά συστήματα.
  • Η Anthropic έχει διακόψει όλες τις αξιολογήσεις κυβερνοασφάλειας με πρόσβαση στο διαδίκτυο και δηλώνει ότι οι δικλείδες ασφαλείας που εφαρμόζει θα είχαν αποτρέψει τη συμπεριφορά αυτή. Η αποκάλυψη ακολουθεί ένα παρόμοιο περιστατικό της OpenAI.
Πηγές (4)
  1. 1 Anthropic AI Models Hacked Three Companies During Tests www.wsj.com
  2. 2 Anthropic says three Claude models reached real-world systems during cyber tests www.axios.com
  3. 3 Anthropic's AI Models Hacked Three Organizations During Tests www.bloomberg.com
  4. 4 Anthropic says Claude AI models accessed three companies during tests www.reuters.com