Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

techcrunch+1techcrunch+1cryptonomist+1Η Anthropic ανακοίνωσε την Παρασκευή ότι η αυτόματη λειτουργία του Claude Code θα γίνει η προεπιλεγμένη ρύθμιση για νέες συνεδρίες σε λογαριασμούς Pro, Max και Team από τις 14 Αυγούστου, αντικαθιστώντας τις ειδοποιήσεις χειροκίνητης έγκρισης τις οποίες οι προγραμματιστές ενέκριναν μηχανικά. Η αλλαγή αυτή μεταβιβάζει τις ρουτινιάρικες αποφάσεις αδειών σε έναν ιδιοταγή ταξινομητή, ο οποίος αξιολογεί κάθε κλήση εργαλείου και παρεμβαίνει μόνο όταν μια ενέργεια θεωρείται μη αναστρέψιμη, καταστροφική ή κατευθυνόμενη εκτός του περιβάλλοντος του χρήστη.techcrunch+1
Η αλλαγή βασίζεται σε αυτό που η Anthropic περιγράφει ως κόπωση επιβεβαίωσης. Σύμφωνα με την εταιρεία, οι χρήστες εγκρίνουν το 97% των αιτημάτων αδείας στο Claude Code, ένα ποσοστό που υποδηλώνει ότι ο μηχανισμός ασφαλείας είχε γίνει αντανακλαστικός παρά προστατευτικός. Η εσωτερική τηλεμετρία ενισχύει αυτή την εικόνα: έως τον Ιούνιο, το 62% των χρηστών είχε προσπαθήσει να παρακάμψει τις άδειες ή είχε επιλέξει "να μην ερωτηθώ ξανά" για εντολές Bash, ενώ το 49,5% των ενεργών χρηστών CLI είχε δημιουργήσει κανόνα επιτροπής για το Bash.techi+1
Σε μια μελέτη με 1.053 αμειβόμενους δοκιμαστές, η Anthropic εισήγαγε μια σαφώς επικίνδυνη εντολή ανάμεσα σε συνηθισμένα αιτήματα αδείας. Η αυτόματη λειτουργία μπλόκαρε το 89% αυτών των εντολών. Οι άνθρωποι δοκιμαστές απέρριψαν μόλις το 13,6%. Η ανθρώπινη επαγρύπνηση μειώθηκε ακόμη περισσότερο όσο παρατεινόταν η συνεδρία, πέφτοντας στο 5% περίπου μετά από 50 ή περισσότερα αιτήματα.techcrunch+2
Ο επικεφαλής του Claude Code, Boris Cherny, έγραψε στο X ότι η ομάδα του χρησιμοποιεί την αυτόματη λειτουργία αποκλειστικά "εδώ και πολλούς μήνες" και δεν θα μπορούσε να φανταστεί την επιστροφή στα αιτήματα αδείας.techcrunch
Το ποσοστό αποκλεισμού 89% αφήνει ένα ποσοστό αποτυχίας 11%: 116 από τις 1.053 εντολές πέρασαν απαρατήρητες. Μια ξεχωριστή συνθετική αξιολόγηση με την Apollo Research μείωσε το ποσοστό αποτυχίας στο 7% μετά την ενίσχυση του ταξινομητή, αν και η Anthropic σημείωσε ότι το συγκεκριμένο νούμερο προέρχεται από ένα εσκεμμένα εχθρικό σύνολο δεδομένων και δεν αποτελεί μέτρηση πραγματικής κυκλοφορίας.techi
Όσον αφορά την έγχυση εντολών (prompt injection), η Anthropic ανέθεσε στην Trajectory Labs τη διεξαγωγή 720 έμμεσων επιθέσεων έγχυσης κατά των Claude Fable 5, Opus 5 και Sonnet 5 στην αυτόματη λειτουργία. Καμία δεν πέτυχε. Ωστόσο, ο προγραμματιστής και ερευνητής Simon Willison προειδοποίησε ότι το μηδενικό ποσοστό επιτυχίας σε επιλεγμένα σενάρια δεν εγγυάται ανθεκτικότητα απέναντι σε επιθέσεις στην εφοδιαστική αλυσίδα, όπως κακόβουλα πακέτα τρίτων που δίνουν εντολή σε έναν πράκτορα να ανακτήσει και να εκτελέσει πρόσθετα αρχεία.cryptonomist
Όταν η αυτόματη λειτουργία μπλοκάρει μια ενέργεια, το Claude επιχειρεί μια ασφαλέστερη εναλλακτική ή ζητά ρητή εξουσιοδότηση. Τρεις διαδοχικές απορρίψεις ή 20 συνολικά σε μια αλληλεπιδραστική συνεδρία επαναφέρουν το εργαλείο στις χειροκίνητες εγκρίσεις. Οι αυτόνομες εκτελέσεις (headless) τερματίζονται. Οι ομάδες μπορούν να αυστηροποιήσουν περαιτέρω τους ελέγχους με ρητούς κανόνες ερώτησης για λειτουργίες όπως pushes ή pull requests, καθώς και με κανόνες απαγόρευσης που δεν μπορούν να παρακαμφθούν.techi
Η Anthropic επιβεβαίωσε ότι δεν θα χρεώσει τους χρήστες των πακέτων Pro, Max και Team για τη μικρή επιβάρυνση σε tokens που προσθέτει ο ταξινομητής σε κάθε κλήση εργαλείου. Οι εταιρικές εφαρμογές (Enterprise), οι υλοποιήσεις API και οι πλατφόρμες στα Amazon Web Services Amazon.com, Inc. , Google Cloud Alphabet Inc. και Microsoft Foundry παραμένουν προαιρετικές (opt-in) ενώ προετοιμάζεται ευρύτερη σταδιακή διάθεση.cryptonomist+1