Mitiga teadlased leidsid GitHubist manipuleeritud tehisintellekti agentide seadistusfaile, mis lekitavad päringuid ja juurdepääsuandmeid ilma, et EDR-süsteemid neid tuvastaksid.
Jamf integreerib Maci süsteemitasandile tehisintellekti nähtavuse ja reeglipõhise kontrolli Claude Code’i, Claude Desktopi ja OpenAI Codexi jaoks, ilma et see tooks olemasolevatele klientidele kaasa lisakulusid.
Viis juhtivat suurt keelemudelit hallutseerivad järjekindlalt samu 127 paketinime, millest 53 on veel registreerimiseks vabad ja kujutavad endast slopsquatting-riski.
WorkBuddy Bench raamistik valideerib kodeerimisagente neljas praktilises valdkonnas, kasutades saastumiskindlat ülesannete koostamist ja avaliku avaldamise kaudu täielikku korratavust.
Kontrollisilmused võimaldavad Claude’il iseseisvalt teostada ja korrata deterministlikke ning projektipõhiseid kvaliteedikontrolle, ilma et arendussammude vahel oleks vaja käsitsi sekkuda.
Anthropic on välja töötanud turvaprotsessid tehisintellekti agentide domineeritud tarkvaraarenduse elutsükli jaoks, kus Claude kirjutab 80 protsenti koodist, säilitades samal ajal inimeste tehtavad ülevaatused ja juurdepääsukontrollid…
Datadog võttis kasutusele Temperi kui struktuurse platvormi, mis varustab agente täpsete tööriistade, mõõdikute ja turvamehhanismidega, mida on vaja kriitiliste süsteemide autonoomseks haldamiseks.
Claude Code vähendab paremate mudeliomaduste toel käsitsi järelevalve vajadust, samas kui Claude Tag genereerib juba 65% meeskonna toote pull request’idest.
Pideva enesekontrolli tõttu võimaldab Claude Fable 5 mitmetunniseid autonoomseid agenditsükleid ilma inimese vahepealse kontrollita, mis säästab Rakutenil aega tehisintellektipõhiste äriprotsesside skaleerimisel.
Tehisintellekti agentide osalusega koodiülevaatused kiirendavad mõõdetavalt ülevaatusotsuste tegemist, kuid ei paranda ülevaatuse kvaliteeti – see on kvaliteedikontrolli automatiseerimise võtmeprobleem.