Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

techcrunch+1techcrunch+1cryptonomist+1Anthropic-მა პარასკევს გამოაცხადა, რომ 14 აგვისტოდან Pro, Max და Team ანგარიშებზე ახალი სესიებისთვის Claude Code-ის ავტო-რეჟიმი ნაგულისხმევი პარამეტრი გახდება. ეს ჩაანაცვლებს ხელით დადასტურების მოთხოვნებს, რომლებსაც დეველოპერები დიდი ყურადღების გარეშე აჭერდნენ ხელს. ცვლილება სტანდარტულ ნებართვებზე გადაწყვეტილების მიღებას საკუთარ კლასიფიკატორს გადასცემს, რომელიც აფასებს ინსტრუმენტის თითოეულ გამოძახებას და ერევა მხოლოდ მაშინ, როდესაც მოქმედება მიჩნეულია შეუქცევადად, დამანგრევლად ან მომხმარებლის გარემოს გარეთ მიმართულად.techcrunch+1
ეს ცვლილება ეფუძნება იმას, რასაც Anthropic-ი „დადასტურების დაღლილობას“ უწოდებს. კომპანიის მონაცემებით, მომხმარებლები Claude Code-ში ნებართვის მოთხოვნების 97%-ს ამტკიცებენ, რაც იმაზე მიუთითებს, რომ უსაფრთხოების მექანიზმი დამცავის ნაცვლად რეფლექსური გახდა. შიდა ტელემეტრია ამ ტენდენციას ადასტურებს: ივნისისთვის მომხმარებელთა 62%-მა სცადა ნებართვების გვერდის ავლა ან აირჩია „აღარ მკითხო“ Bash ბრძანებებისთვის, ხოლო აქტიური CLI მომხმარებლების 49.5%-მა შექმნა Bash-ის დაშვების წესი.techi+1
1,053 ანაზღაურებად ტესტერზე ჩატარებულ კვლევაში Anthropic-მა ჩვეულებრივ მოთხოვნებს შორის აშკარად სახიფათო ბრძანება ჩასვა. ავტო-რეჟიმმა ამ ბრძანებების 89% დაბლოკა, ხოლო ადამიანმა ტესტერებმა მხოლოდ 13.6% უარყვეს. სესიების ხანგრძლივობის ზრდასთან ერთად ადამიანების ყურადღება კიდევ უფრო შემცირდა და 50 ან მეტი მოთხოვნის შემდეგ დაახლოებით 5%-მდე დაეცა.techcrunch+2
Claude Code-ის ხელმძღვანელმა Boris Cherny-მ X-ზე დაწერა, რომ მისი გუნდი „მრავალი თვეა“ ექსკლუზიურად ავტო-რეჟიმს იყენებს და ვეღარ წარმოუდგენია ნებართვის მოთხოვნებთან დაბრუნება.techcrunch
დაბლოკვის 89%-იანი მაჩვენებელი ტოვებს ცდომილების 11%-იან მაჩვენებელს: 1,053 ჩასმული ბრძანებიდან 116-მა გაიარა შემჩნევის გარეშე. Apollo Research-თან ერთად ჩატარებულმა ცალკეულმა სინთეზურმა შეფასებამ, კლასიფიკატორის გაძლიერების შემდეგ, ცდომილების მაჩვენებელი 7%-მდე შეამცირა, თუმცა Anthropic-მა აღნიშნა, რომ ეს ციფრი მიღებულია განზრახ მტრული მონაცემთა სიმრავლიდან და არ წარმოადგენს რეალური ტრაფიკის გაზომვას.techi
Prompt injection-ის შეტევებზე Anthropic-მა Trajectory Labs-ს დაავალა 720 არაპირდაპირი ინექციური შეტევის განხორციელება Claude Fable 5-ის, Opus 5-ის და Sonnet 5-ის წინააღმდეგ ავტო-რეჟიმში. არცერთმა შეტევამ არ გაამართლა. თუმცა, დეველოპერმა და მკვლევარმა Simon Willison-მა გააფრთხილა, რომ მომზადებულ სცენარებში ნულოვანი წარმატება არ იძლევა მიწოდების ჯაჭვის ტიპის შეტევებისგან დაცვის გარანტიას, მაგალითად, მავნე მესამე მხარის პაკეტებისგან, რომლებიც აგენტს დამატებითი ფაილების გამოძახებასა და შესრულებას ავალებენ.cryptonomist
როდესაც ავტო-რეჟიმი ბლოკავს მოქმედებას, Claude ცდილობს უფრო უსაფრთხო ალტერნატივას ან ითხოვს პირდაპირ დადასტურებას. ინტერაქტიულ სესიაში ზედიზედ სამი უარყოფა ან სულ 20 უარყოფა ინსტრუმენტს ხელით დადასტურების რეჟიმში აბრუნებს, ხოლო headless გაშვებები ამის ნაცვლად წყდება. გუნდებს შეუძლიათ კონტროლის უფრო მეტად გამკაცრება ისეთი ოპერაციებისთვის, როგორებიცაა push ან pull request-ები, და აკრძალვის წესების დაწესება, რომელთა გვერდის ავლაც შეუძლებელია.techi
Anthropic-მა დაადასტურა, რომ Pro, Max და Team მომხმარებლებს არ დააკისრებს დამატებით საფასურს ტოკენების მცირე დანახარჯზე, რომელსაც კლასიფიკატორი თითოეულ გამოძახებაზე ამატებს. Enterprise, API და პლატფორმის დანერგვები Amazon Web Services Amazon.com, Inc. , Google Cloud Alphabet Inc. და Microsoft Foundry-ზე ნებაყოფლობითი რჩება, სანამ უფრო ფართო დანერგვა მზადდება.cryptonomist+1