Lühidalt: Anthropic aktiveerib alates 14. augustist Claude Code’is automaatrežiimi vaikimisi, tuginedes testidele, mis näitavad 89-protsendilist blokeerimismäära kahjulike käskude vastu ning nullis edukat rünnet 720 viipasüsti katse seas – sõltumatu kinnitus nende arvude kohta seni puudub.
Alates 14. augustist aktiveerib Anthropic Claude Code’is automaatrežiimi vaikimisi uute sessioonide jaoks enamiku plaanide puhul. Sellega kaasneb ettevõtte avaldatud turvalisusandmestik, mis peaks tõestama, et automatiseeritud lubade andmine takistab kahjulikke tegevusi usaldusväärsemalt kui inimüle vaatajad.
Anthropicu töötajad Cat Wu ja Thariq Shihipar selgitasid AI Engineer World’s Fairi vestlusringis, et Anthropicu sees kasutab automaatrežiimi peaaegu kõik. Seda põhjendatakse uute hindamisandmetega: 1053 maksva kasutajaga läbi viidud testis vahetati iga sessiooni keskel loavihje selgelt ohtliku käsu vastu. Ainult 13,6 protsenti inimtestijatest keeldus kahjulikku tegevust täitmast, samas kui automaatrežiim oleks blokeerinud 89 protsenti neist tegevustest. Ülejäänud 11 protsendi juhtudest ei oleks automaatrežiim tegevust ära hoidnud.
Lisaks tellis Anthropic kolmandalt osapoolelt Trajectory Labsilt uuringu kaudsete viipasüsti (prompt injection) rünnakute kohta Claude Code’i ja Codexi tollal kehtivate avalike versioonide vastu, seisuga 17. juuli 2026. Testiti 72 stsenaariumi kokku 720 ründekatsega. Anthropicu andmetel ei õnnestunud ükski neist rünnakutest Claude Fable 5, Opus 5 ega Sonnet 5 vastu automaatrežiimis.
Inseneritiimide jaoks tähendab üleminek seda, et Claude Code töötab tüüpilistes töövoogudes edaspidi ilma pideva käsitsi kinnituseta – lähenemine, mis peaks leevendama nn kinnitusväsimust, mille korral kasutajad klõpsavad korduvaid kinnitusdialooge lõpuks refleksiivselt läbi. Hinnangu andmisel jäävad olulisteks kaks erinevat riskiklassi: agendi enda tahtmatud kahjulikud tegevused (näiteks kustutatud failid või tühjendatud tootmisandmebaas) ning kaudne viipasüst, mille käigus süstitakse pahatahtlikke juhiseid välise sisu kaudu.
Simon Willison, kes ennustas avalikult 2026. aastaks kodeerimisagentide turvakriisi, suhtub Trajectory Labsi tulemustesse skeptiliselt ja nõuab sõltumatut kinnitust. Näitena toob ta stsenaariumi, kus pahatahtlik kolmanda osapoole pakett esitab testijuhise, mis käivitab kõigepealt käsu “uvx fetch-model-files .” – manipuleeritud paketi, mis eksfiltreerib andmeid enne, kui üldse algab tegelik pytest’iga testikäik. Sellise ründevektori vastu ei näe ta automaatrežiimil mingit toimivat kaitsemehhanismi.
Praktilise kasutuse jaoks järeldub sellest: kes kasutab Claude Code’i automaatrežiimis, peaks lisaks arhitektuuri tasandil tagama, et agentidel ei oleks juurdepääsu andmetele ega tööriistadele, mille väärkasutus kahjujuhtumi korral tooks kaasa tõsiseid tagajärgi – sõltumata sellest, kui usaldusväärsed tootja poolt avaldatud testitulemused tegelikult on.
Allikas: simonwillison.net · Avaldatud 9. augustil 2026
Lumi AI News — tehisintellekti abil kureeritud vastavalt tehisintellektimääruse art 50-le. Parafraseerimine ja klassifitseerimine Lumi News Pipeline v1.8.3 abil.