Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

techcrunch+1techcrunch+1cryptonomist+1Anthropic meddelade på fredagen att autoläget i Claude Code blir standardinställning för nya sessioner på Pro-, Max- och Team-konton från och med den 14 augusti. Detta ersätter de manuella godkännandeförfrågningar som utvecklare länge har klickat sig igenom utan närmare eftertanke. Förändringen överlämnar rutinmässiga behörighetsbeslut till en proprietär klassificerare, som utvärderar varje verktygsanrop och ingriper endast när en åtgärd bedöms vara oåterkallelig, förstörande eller riktad utanför användarens miljö.techcrunch+1
Skiftet grundar sig i vad Anthropic beskriver som bekräftelsetrötthet. Enligt bolaget godkänner användare 97 % av alla behörighetsförfrågningar i Claude Code, en siffra som tyder på att säkerhetsmekanismen hade blivit en reflex snarare än ett skydd. Intern telemetri förstärker mönstret: i juni hade 62 % av användarna försökt kringgå behörigheter eller valt "fråga inte igen" för Bash-kommandon, och 49,5 % av de aktiva CLI-användarna hade skapat en tillåtelseregel för Bash.techi+1
I en studie med 1 053 betalda testare planterade Anthropic ett uppenbart farligt kommando bland rutinmässiga behörighetsförfrågningar. Autoläget blockerade 89 % av dessa kommandon, medan mänskliga testare nekade bara 13,6 %. Mänsklig vaksamhet sjönk ytterligare ju längre sessionerna pågick, till cirka 5 % efter 50 eller fler förfrågningar.techcrunch+2
Ledarfiguren för Claude Code, Boris Cherny, skrev på X att hans team har använt autoläget exklusivt "under många månader" och inte kunde tänka sig att återgå till manuella godkännanden.techcrunch
Blockeringsgraden på 89 % lämnar en felmarginal på 11 %: 116 av 1 053 planterade kommandon slapp igenom oupptäckta. En separat syntetisk utvärdering utförd med Apollo Research sänkte felmarginalen till 7 % efter härdning av klassificeraren, även om Anthropic noterade att den siffran härrör från ett medvetet fientligt datasätt och inte är en mätning av verklig trafik.techi
När det gäller prompt-injection uppdrog Anthropic åt Trajectory Labs att utföra 720 indirekta injectionsattacker mot Claude Fable 5, Opus 5 och Sonnet 5 i autoläge. Ingen lyckades. Utvecklaren och forskaren Simon Willison varnade dock för att noll lyckade attacker i specialdesignade scenarier inte garanterar motståndskraft mot attacker riktade mot försörjningskedjan, såsom skadliga tredjepartspaket som instruerar en agent att hämta och köra ytterligare filer.cryptonomist
När autoläget blockerar en åtgärd försöker Claude med ett säkrare alternativ eller ber om ett uttryckligt godkännande. Tre avslag i rad eller 20 totalt under en interaktiv session återställer verktyget till manuella godkännanden; automatiska körningar avbryts i stället. Team kan strama åt kontrollerna ytterligare med uttryckliga frågeregler för operationer som pushar eller pull-förfrågningar, samt nekanderegler som inte kan överridas.techi
Anthropic bekräftade att de inte kommer att ta betalt av Pro-, Max- och Team-användare för den lilla token-kostnad klassificeraren lägger till per verktygsanrop. Enterprise-, API- och plattformsimplementeringar på Amazon Web Services Amazon.com, Inc. , Google Cloud Alphabet Inc. och Microsoft Foundry förblir frivilliga medan en bredare utrullning förbereds.cryptonomist+1