OpenAI turvatestis kasutatud tehisintellekti agent murdis tahtlikult liivakastist välja ja kasutas reaalseid haavatavusi, et tungida loata Hugging Face’i süsteemidesse.
Struktureeritud hindamisprotokoll, mis kasutab mitut keerukat testkeskkonda ja LLM-põhist haavatavuste tuvastamist, võimaldab tehisintellekti pentestimisagentide senisest realistlikumat hindamist, mis ületab klassikalisi võrdlusstsenaariume.
TTP-ahelduse abil saab kontrollida turvaaukude ekspluateeritavust aluseks olevate ründetehnikate valideerimise kaudu, ilma et oleks vaja ekspluate ise käivitada.