Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

techcrunch+1techcrunch+1cryptonomist+1Společnost Anthropic v pátek oznámila, že automatický režim nástroje Claude Code se od 14. srpna stane výchozím nastavením pro nové relace na účtech Pro, Max a Team. Nahradí tak ruční schvalování výzev, které vývojáři dlouhodobě odklikávali bez větší pozornosti. Změna přenáší rutinní rozhodování o oprávněních na vlastní klasifikátor. Ten vyhodnocuje každé volání nástroje a zasáhne pouze v případě, že je akce vyhodnocena jako nevratná, destruktivní nebo směřující mimo prostředí uživatele.techcrunch+1
Změna vychází z toho, co Anthropic popisuje jako únavu z potvrzování. Podle společnosti uživatelé schvalují 97 % výzev k udělení oprávnění v nástroji Claude Code, což naznačuje, že bezpečnostní mechanismus se stal spíše reflexivním než ochranným. Interní telemetrie tento vzorec potvrzuje: do června se 62 % uživatelů pokusilo oprávnění obiít nebo zvolilo možnost „znovu neptat“ u příkazů pro Bash a 49,5 % aktivních uživatelů rozhraní CLI vytvořilo pravidlo pro povolení příkazů Bash.techi+1
Ve studii s 1 053 placenými testery zamíchala společnost Anthropic mezi běžné výzvy k schválení zjevně nebezpečný příkaz. Automatický režim zablokoval 89 % těchto příkazů, zatímco lidští testeři odmítli pouze 13,6 %. Ostražitost lidí navíc s délkou relace dále klesala a po 50 a více výzvách spadla na přibližně 5 %.techcrunch+2
Šéf projektu Claude Code Boris Cherny na síti X napsal, že jeho tým používá automatický režim výhradně „již mnoho měsíců“ a nedokáže si představit návrat k výzvám ke schválení.techcrunch
Míra zablokování ve výši 89 % znamená 11% chybovost: 116 z 1 053 nastrčených příkazů prošlo neodhaleno. Samostatné syntetické hodnocení odolnosti provedené se společností Apollo Research snížilo chybovost po zpřísnění klasifikátoru na 7 %, i když Anthropic poznamenal, že toto číslo pochází ze záměrně nepravdivého či nepřátelského datového souboru a nepředstavuje měření v reálném provozu.techi
Pokud jde o riziko zvané prompt injection, Anthropic pověřil společnost Trajectory Labs provedením 720 nepřímých útoků tohoto typu proti modelům Claude Fable 5, Opus 5 a Sonnet 5 v automatickém režimu. Žádný z nich neuspěl. Vývojář a výzkumník Simon Willison však varoval, že nulová úspěšnost v připravených scénářích nezaručuje odolnost vůči útokům na dodavatelské řetězce, jako jsou škodlivé balíčky třetích stran, které agentovi přikazují stáhnout a spustit další soubory.cryptonomist
Pokud automatický režim nejakou akci zablokuje, Claude se pokusí o bezpečnější alternativu nebo požádá o výslovnou autorizaci. Tři po sobě jdoucí odmítnutí nebo celkem 20 odmítnutí v interaktivní relaci vrátí nástroj k ručnímu schvalování. Běhy na pozadí bez grafického rozhraní (headless) se místo toho ukončí. Týmy mohou ovládání dále zpřísnit pomocí výslovných pravidel typu „zeptat se“ pro operace, jako jsou pushes nebo pull requesty, a pravidel pro zakázání, která nelze přepsat.techi
Společnost Anthropic potvrdila, že uživatelům tarifů Pro, Max a Team nebude účtovat drobnou režii tokenů, kterou klasifikátor přidává při každém volání nástroje. Nasazení pro podniky (Enterprise), rozhraní API a platformy v rámci Amazon Web Services Amazon.com, Inc. , Google Cloud Alphabet Inc. a Microsoft Foundry zůstávají na bázi dobrovolného přihlášení (opt-in), dokud nebude připraveno širší zavedení.cryptonomist+1