Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

techcrunch+1techcrunch+1cryptonomist+1Penktadienį bendrovė „Anthropic“ pranešė, kad nuo rugpjūčio 14 d. „Claude Code“ automatinis režimas taps standartiniu nustatymu naujoms sesijoms „Pro“, „Max“ ir „Team“ paskyrose. Jis pakeis rankinius leidimų prašymus, kuriuos kūrėjai ilgai spaudinėdavo beveik netikrindami. Šis pokytis kasdienius sprendimus dėl leidimų perduoda autoriniam klasifikatoriui, kuris įvertina kiekvieną įrankio iškvietimą ir įsikiša tik tada, kai veiksmas laikomas negrįžtamu, naikinamuoju arba nukreiptu už vartotojo aplinkos ribų.techcrunch+1
Šio pokyčio priežastis: reiškinys, kurį „Anthropic“ apibūdina kaip patvirtinimų nuovargį. Bendrovės teigimu, naudotojai patvirtina 97 % leidimų prašymų „Claude Code“ sistemoje. Šis rodiklis rodo, kad saugumo mechanizmas tapo pasąmoningu veiksmu, o ne apsauga. Vidinė telemetrija patvirtina šią tendenciją: iki birželio mėnesio 62 % naudotojų bandė apreiti leidimus arba pasirinko „daugiau neklausti“ „Bash“ komandoms, o 49,5 % aktyvių CLI naudotojų buvo sukūrę „Bash“ leidimų taisyklę.techi+1
Apmokamame tyrimuose su 1 053 testuotojais „Anthropic“ tarp įprastų leidimų prašymų įterpė aiškiai pavojingą komandą. Automatinis režimas užblokavo 89 % šių komandų, o testuotojai žmonės atmetė tik 13,6 %. Žmonių budrumas dar labiau sumažėjo ilgesnių sesijų metu, krisdamas iki maždaug 5 % po 50 ar daugiau prašymų.techcrunch+2
„Claude Code“ vadovas Boris Cherny tinkle „X“ parašė, kad jo komanda automatinį režimą naudoja išskirtinai „jau daugelį mėnesių“ ir neįsivaizduoja grįžimo prie leidimų prašymų.techcrunch
89 % užblokavimo rodiklis palieka 11 % praleistų grėsmių rodiklį: 116 iš 1 053 įterptų komandų praėjo nepastebėtos. Atskiras sintetinis atakos vertinimas, atliktas kartu su „Apollo Research“, sustiprinus klasifikatorių sumažino klaidos rodiklį iki 7 %, nors „Anthropic“ pažymėjo, kad šis skaičius gautas iš tyčia priešiško duomenų rinkinio ir neatspindi tikrojo srauto.techi
Vertindama užklausų įterpimo atakas (angl. prompt injection), „Anthropic“ užsakė bendrovei „Trajectory Labs“ atlikti 720 netiesioginių atakų prieš „Claude Fable 5“, „Opus 5“ ir „Sonnet 5“ automatiniu režimu. Nė viena ataka nebuvo sėkminga. Vis dėlto programuotojas ir tyrėjas Simon Willison įspėjo, kad nulinis sėkmės rodiklis atrinktuose scenarijuose negarantuoja atsparumo tiekimo grandinės tipo atakoms, pavyzdžiui, kenkėjiškiems trečiųjų šalių paketams, nurodantiems agentui atsiųsti ir įvykdyti papildomus failus.cryptonomist
Kai automatinis režimas užblokuoja veiksmą, „Claude“ bando saugesnę alternatyvą arba prašo aiškaus leidimo. Trijų iš eilės atmetimų arba iš viso 20 atmetimų interaktyvioje sesijoje atveju įrankis grįžta prie rankinio tvirtinimo, o neinteraktyvūs procesai vietoj to nutraukiami. Komandos gali dar labiau sugriežtinti kontrolę nustatydamos aiškias klausimo taisykles tokioms operacijoms kaip „push“ arba „pull request“, taip pat draudimo taisykles, kurių negalima pakeisti.techi
Bendrovė „Anthropic“ patvirtino, kad netaikys papildomo mokesčio „Pro“, „Max“ ir „Team“ naudotojams už nedidelį žetonų kiekį, kurį klasifikatorius išnaudoja kiekvienam įrankio iškvietimui. Sprendimai verslui („Enterprise“), API ir platformų įdiegimai „Amazon Web Services“ Amazon.com, Inc. , „Google Cloud“ Alphabet Inc. bei „Microsoft“ „Foundry“ išlieka pasirenkami, kol rengiamas platesnis paslaugos pristatymas.cryptonomist+1