Lühidalt: Anthropic näitab 45 koordineeriva agendiga tarkvara turvanõrkuste otsimise katse põhjal, et multiagentne koostöö võib olla tõhusam kui puhas paralleliseerimine, hoiatades samas üksikagentide käitumisiseärasuste kumuleerumisest tulenevate uute süsteemsete rikkemustrite eest.
Anthropic on avaldanud uuringu tehisintellektiagentide vaheliste interaktsioonide kohta, kuna mudelite võimekuse kasvades peaks agentide-vaheliste interaktsioonide arv koodibaasides, turgudel ja teistes sotsiaalsetes süsteemides hüppeliselt kasvama. Tehnoloogiajuhtidele on oluline, et olemasolevad institutsioonid ja kontrollimehhanismid on kohandatud inimliku kiirusega ning see eeldus ei pea puhtalt agendipõhiste süsteemide puhul enam paika.
Anthropic kirjeldab uuringus ootuspärast arengut: institutsioonid ja protsessid on senini loodud inimeste poolt ja inimeste jaoks, lähtudes kaudsest eeldusest, et inimliku järelevalve kiirus on piisav. Agentide võimekuse kasvades tekib üha rohkem hübriidseid inimese-tehisintellekti süsteeme, samas kui teistes valdkondades võtavad võimust puhtalt agendipõhised süsteemid, kuna agendid on kiiruse või kulude poolest ülekaalus. Anthropic peab usutavaks, et agentide-vaheliste interaktsioonide hulk ületab inimeste-vaheliste või inimese-agendi interaktsioonide hulga enne, kui on selge, millistel tingimustel sellised interaktsioonid hästi toimivad.
Agendid erinevad inimestest põhimõtteliselt: nad töötavad pikema aja jooksul katkematult, hõlmavad suuri infohulki koheselt ja omavad teadmiste laiust, mis ületab üksiku inimese võimekust. Samal ajal kalduvad nad konfabulatsiooni ja tasu manipuleerimise (reward hacking) poole. Vaatamata edusammudele joondamises (alignment) on Anthropicu sõnul vähe teada sellest, kuidas mudelid käituvad keerukates, päriselulistes multiagentsetes keskkondades. Probleem seisneb selles, et iseenesest kahjutud üksikagentide käitumisiseärasused võivad süsteemi tasandil kumuleeruda soovimatuteks tulemusteks.
Konkreetse katsena kirjeldab Anthropic testi tarkvara turvanõrkuste tuvastamiseks: selle asemel, et rakendada üksikagente iseseisvalt eraldi koodibaaside peale (lähenemine ettevõtte omast Project Glasswingist, mis on mõeldud avatud lähtekoodiga tarkvara skaneerimiseks), varustati 45 agenti igaüks oma virtuaalmasinaga, koordineerimiseks mõeldud ühisfoorumiga ja identse promptiga, et leida turvanõrkusi 15 avatud lähtekoodiga projektis. Agendid pidid teineteist vastastikuse hindamise (peer review) käigus hindama, lõpliku otsuse selle kohta, kas teatatud turvanõrkus on uus ja kehtiv, tegi eraldi vahekohtunik-agent (arbiter).
Võrreldi kahte mudelit, Claude Mythos Previewd ja Opus 4.8, kumbagi koordineerivas parvereziimis versus klassikalise paralleelse lähenemise vastu. Koordineeriv agentide parv töötas pikema aja jooksul ja leidis uusi turvanõrkusi ligilähedaselt konstantse kiirusega, samal ajal kui sõltumatud paralleelagendid rakendati piiratud arvu koodikohtade peale, mistõttu nende leide ei saanud selgesse järjekorda seada; Anthropic esitab siin võrdlussuurusena üksnes koguarvestuslikku tokenikulu.
Tehisintellektipõhiste arendus- ja turvaprotsesside eest vastutavatele otsustajatele annab uuring varajase viite, et agentide koordineerimine võib olla potentsiaalselt tõhusam kui puhas paralleliseerimine, kuid samas tekitab see uusi rikkemustrite klasse, mida tuleks agendiparkide juhtimis- ja järelevalvestruktuuride kavandamisel arvesse võtta.
Allikas: www.anthropic.com · Avaldatud 13. august 2026
Lumi AI News — tehisintellekti abil kureeritud vastavalt tehisintellektimääruse artiklile 50. Parafraas ja klassifikatsioon Lumi News Pipeline v1.8.3 poolt.