Skip to content

Anthropic muudab automaatrežiimi Claude Code’i vaikeseadeks Pro-, Max- ja Team-plaanidel

Lühidalt: Anthropic seab Claude Code’i alates 14. augustist 2026 vaikimisi automaatrežiimile, tuginedes 1053 kasutajaga tehtud testidele ja kolmanda osapoole hindamisele, mis hõlmas 720 edukatuks jäänud viipainjektsiooni-rünnet – kriitikud nõuavad sellegipoolest sõltumatut kinnitust ja soovitavad agentidele endiselt piiratud juurdepääsuõigusi.

Alates 14. augustist 2026 käivitub Claude Code enamiku tellimusplaanide puhul vaikimisi automaatrežiimis, mitte enam iga üksiku toimingu käsitsi kinnitamisega. Anthropic põhjendab seda samma ettevõtte sisese turvahinnangutega, mille kohaselt on see režiim kriitilistes punktides parem kui inimestest koosnevad ülevaatajad.

Anthropic viib Claude Code’i Pro-, Max- ja Team-plaanidel alates 14. augustist 2026 vaikimisi üle automaatrežiimile, mis lubab agendi toiminguid teha korduva käsitsi kinnitamiseta. Otsuse aluseks on muu hulgas 1053 makseva testija seas läbi viidud katse: keset iga seanssi vahetati tavapärane õigusnõude taotlus märkamatult üheselt ohtliku käsu vastu. Vaid 13,6 protsenti inimtestijatest lükkas selle kahjuliku toimingu tagasi, samas kui automaatrežiim oleks Anthropicu andmetel blokeerinud 89 protsenti sellistest toimingutest. Hinnangu kohaselt jäi siiski umbes 11 protsenti juhtumitest, mille puhul ka automaatrežiim ei oleks toimingut ära hoidnud. Anthropicu töötajad Cat Wu ja Thariq Shihipar olid AI Engineer World’s Fair’i vestlusringis juba varem selgitanud, et ettevõtte sees kasutab automaatrežiimi peaaegu kõik ja et viipainjektsiooni ning andmete väljaviimise riske peetakse selle puhul oluliselt väiksemaks kui keskmise inimliku ülevaatuse korral.

Inseneritiimide jaoks nihkub vastutus seega üksikute lubade andmiselt agendi suhtes tehtavale põhimõttelisele usaldusotsusele. Kinnituse väsimus – reflektoorne kinnitusdialoogide kõrvale klõpsamine pärast paari korda – on tuntud probleem, mis on senise kinnitamispraktika niikuinii ebakindlaks muutnud. Samal ajal püsib kaks erinevat riskiklassi: ühelt poolt tahtmatud kahjulikud toimingud, näiteks valede failide või tootmisandmebaaside kustutamine, ja teiselt poolt sihilikud viipainjektsiooni-rünnakud, mille käigus juhised smugeldatakse agenti väljastpoolt tarbitava sisu kaudu.

Teise riskiklassi kohta viitab Anthropic ettevõtte Trajectory Labs läbi viidud kolmanda osapoole hindamisele. Testiti Claude Code’i ja Codexi jooksvalt avalikult kättesaadavaid versioone seisuga 17. juuli 2026 kokku 72 kaudse viipainjektsiooni stsenaariumi vastu, mis eelnevalt ei olnud Anthropicu treenimis- või testmaterjali osa. Kokku 720 ründekatsest ei olnud Anthropicu sõnul ükski edukas Claude Fable 5, Opus 5 või Sonnet 5 vastu automaatrežiimis.

Simon Willison, kes ennustas 2026. aastaks kodeerimisagentide turvalisuses “väljakutsuja katastroofi”, suhtub oma analüüsis nende tulemuste täielikkusesse skeptiliselt ja soovib sõltumatut kinnitust. Näitena toob ta rünnakustsenaariumi, mille puhul pahatahtlik kolmanda osapoole pakett annab agendile korralduse käivitada enne tegelikku testijooksu esmalt teine, ettevalmistatud pakett, mis viib andmed välja – tema hinnangul mustri, mille vastu ükski automaatrežiim usaldusväärselt kaitsta ei suuda. Inseneritiimidele, kes kasutavad Claude Code’i tootmises, jääb seega asjakohaseks soovitus, et agentidele ei tuleks põhimõtteliselt anda juurdepääsu andmetele või tööriistadele, mille väärkasutus võiks tõsise juhtumi korral kahju tekitada – sõltumata sellest, kui hästi vastav automatiseerimisrežiim võrdlustestides toimib.


Allikas: simonwillison.net · Avaldatud 9. augustil 2026
Lumi AI News — tehisintellekti abil kureeritud vastavalt tehisintellektimääruse artiklile 50. Parafraas ja klassifikatsioon Lumi News Pipeline v1.8.3 poolt.

Share on: