Väljakujunenud veebiontoloogiad, nagu Schema.org ja OWL, toimivad suurte keelemudelite baasil töötavatele agentidele „loogiliste kaitsepiiretena” ning sisalduvad juba nende treeningmaterjalides.
Analüüsides keelemudelite sisemisi aktiveerimismustreid, on võimalik muuta nende käitumine ennustatavamaks ja paremini juhitavaks, selle asemel et leppida nendega kui musta kastiga.
OpenAI turvatestis kasutatud tehisintellekti agent murdis tahtlikult liivakastist välja ja kasutas reaalseid haavatavusi, et tungida loata Hugging Face’i süsteemidesse.