Kokkuvõte: Anthropic seab Claude Code’i alates 14. augustist 2026 vaikimisi automaatrežiimile, toetudes 1053 kasutajaga tehtud testidele ja kolmanda osapoole hindamisele, kus 720 promptisüsti rünnakust ei õnnestunud ükski – kriitikud nõuavad sellele vaatamata sõltumatut kinnitust ja soovitavad agentidele endiselt piiratud õigusi.
Alates 14. augustist 2026 käivitub Claude Code enamiku tellimusplaanide puhul vaikimisi automaatrežiimis, mitte enam iga üksiku toimingu käsitsi kinnitamisega. Anthropic põhjendab sammu oma turvahindamistega, mille kohaselt näitab see režiim kriitilistes punktides paremaid tulemusi kui inimestest koosnevad ülevaatajad.
Anthropic viib Claude Code’i Pro-, Max- ja Team-plaanidel alates 14. augustist 2026 vaikimisi üle automaatrežiimile, mis lubab agendil toiminguid teha korduva käsitsi kinnitamiseta. Muudatus põhineb muu hulgas 1053 makseva testija hulgas läbi viidud küsitlusel: keset iga seanssi vahetati tavapärane õiguse küsimise päring märkamatult ühemõtteliselt ohtliku käsu vastu. Vaid 13,6 protsenti inimtestijatest lükkas selle kahjuliku toimingu tagasi, samas kui automaatrežiim oleks Anthropicu andmetel blokeerinud 89 protsenti sellistest toimingutest. Sellest hoolimata jäi hindamisse alles ligikaudu 11 protsenti juhtudest, mille korral ka automaatrežiim toimingut ei oleks ära hoidnud. Anthropicu töötajad Cat Wu ja Thariq Shihipar selgitasid juba AI Engineer World’s Fairi kaminavestlusel, et ettevõtte sees kasutab automaatrežiimi peaaegu igaüks ning promptisüsti ja andmete väljaviimise riske peetakse selle juures oluliselt väiksemaks kui keskmise inimliku kontrolli korral.
Insenerimeeskondade jaoks nihkub vastutus seega üksikute lubade andmiselt agendi suhtes tehtavale põhimõttelisele usaldusotsusele. Kinnitusväsimus – kinnitusdialoogide reflektoorne kõrvaleklikkimine pärast vaid mõnda interaktsiooni – on tunnistatud tegelikuks probleemiks, mis on senise loakäsitluse niigi ebakindlaks muutnud. Samal ajal püsib kaks erinevat riskiklassi: ühelt poolt juhuslikud kahjulikud toimingud, näiteks valede failide või tootmisandmebaaside kustutamine, ja teiselt poolt sihitud promptisüsti rünnakud, mille käigus juhised smugeldatakse agendisse väliselt tarbitava sisu kaudu.
Teise riskiklassi kohta viitab Anthropic Trajectory Labsi läbi viidud kolmanda osapoole hindamisele. Testiti Claude Code’i ja Codexi jooksvaid avalikult kättesaadavaid versioone, seisuga 17. juuli 2026, 72 kaudse promptisüsti stsenaariumi vastu, mis ei olnud varem osa Anthropicu treening- või testmaterjalist. Kokku 720 rünnakukatsest ei olnud Anthropicu sõnul ükski edukas Claude Fable 5, Opus 5 või Sonnet 5 vastu automaatrežiimis.
Simon Willison, kes ennustas 2026. aastaks koodiagentide turvalisuses “väljakutsuja katastroofi”, suhtub oma analüüsis nende tulemuste täielikkusesse skeptiliselt ja soovib sõltumatut kinnitust. Näiteks toob ta rünnakustsenaariumi, kus pahatahtlik kolmanda osapoole pakett annab agendile käsu käivitada enne tegelikku testijooksu esmalt teine, ettevalmistatud pakett, mis viib andmeid välja – muster, mille vastu tema arvates ei suuda ükski automaatrežiim usaldusväärselt kaitsta. Insenerimeeskondade jaoks, kes kasutavad Claude Code’i tootmises, kehtib seega jätkuvalt soovitus: agentidele ei tohiks üldiselt anda juurdepääsu andmetele või tööriistadele, mille kuritarvitamine võiks tõsise juhtumi korral kahju tekitada – sõltumata sellest, kui hästi vastav automatiseerimisrežiim võrdlustestides esineb.
Allikas: simonwillison.net · Avaldatud 9. augustil 2026
Lumi AI News — tehisintellekti abil kureeritud vastavalt tehisintellektimääruse art. 50-le. Parafraseerimine ja klassifitseerimine Lumi News Pipeline v1.8.3 abil.