Kuna OpenAI, Anthropic ja Google kasutasid ühe mudeliperekonna piires sama krüpteerimisvõtit, õnnestus tugevate mudelite krüptitud arutlusjäljed korduslugemisrünnaku (replay attack) ja jailbreak’i abil ekstraheerida selgekeelsel kujul…
Teadlastel õnnestus ekstraheerida OpenAI, Anthropicu ja Google’i mudelite krüpteeritud arutlusahela (chain-of-thought) plokke, mängides jäljed tagasi sama mudeliperekonna nõrgematesse mudelitesse ja need seejärel häkkides (jailbreak); tootjad…
OpenAI, Anthropic’i ja Google’i API-de krüpteeritud arutlusobjektide nõrkus võimaldas välja lugeda sisemisi mõtteprotsesse ja tundlikke andmeid, näiteks API-võtmeid seansilogidest.
Ilma järjekindla API-de tuvastamise, kaitse ja juhtimiseta jäävad investeeringud agentide tasandi tehisintellekti turvalisusse tulemuseta, nagu näitavad mitmed dokumenteeritud juhtumid kustutatud tootmisandmebaasidega.