Sihipäraselt paigutatud promptid, mis käivitavad suurte keelemudelite sisuturvalisuse kaitsemehhanismid, vähendavad automatiseeritud tehisintellekti rünnakute õnnestumise määra kuni 90 protsenti.
LLM-ide häälestustehnikaid saab tehniliselt kasutada nii turvalisuse tagamiseks kui ka tsensuuriks, mistõttu on vaja suuremat läbipaistvust ja järelevalvet.
Jailbreak’ide kavatsused jätavad mõõdetavad entroopiaallkirjad LLM-ide vahekihtidesse, mis on staatiliste keskmiste väärtustega võrreldes usaldusväärsemat.