Lühidalt: GPT-Red tuvastab kaudseid süstepromptide rünnakuid 84-protsendilise edukusega — selgelt kõrgema tulemusega kui inimeksperdid, kelle näitaja on 13 protsenti — ning aitab kaasa turvalisemate mudeligeneratsioonide väljatöötamisele.
OpenAI avaldas spetsialiseeritud tehisintellektimudeli nimega GPT-Red, mis tuvastab automaatselt turvaauke, mis tulenevad süstepromptide rünnakutest ja käsuhierarhia vastu suunatud rünnetest. Süsteem simuleerib sihipäraselt uusi rünnakuvariante, et muuta tehisintellektimudelid enne avaldamist vastupidavamaks.
OpenAI kasutab GPT-Redi kontrollitud treeningtsüklis automatiseeritud ründemudelina. Süsteem tuvastab kõigepealt nõrkused kontrollitavates mudelites. Niipea kui need suudavad olemasolevaid ründemustreid edukalt blokeerida, genereerib GPT-Red sihipäraselt uusi ja keerukamaid süstepromptide rünnakute ning hierarhiarünnete variante. Nõnda genereeritud ründeandmed voolavad otse vastupidavamate mudeligeneratsioonide treenimisse ja turvavalideerimisse.
Sisemistes testides, mis käsitlesid kaudseid süstepromptide rünnakuid, saavutas GPT-Red turvaaukude avastamisel 84-protsendilise edukuse. Võrdluseks: inimestest turvaeksperdid tuvastasid samades stsenaariumides vaid 13 protsenti aukudest. GPT-Redi genereeritud ründemustreid kasutati muu hulgas GPT-5.6 Soli väljatöötamisel. Otseste süstepromptide rünnakute puhul esines GPT-5.6 Solil kõige nõudlikumates sisemistes testimenetlustes kuus korda vähem edukaid manipulatsioone kui neli kuud varem kasutusel olnud võimsaimal tootmismudelil.
Vajadus selliste turvavahendite järele kasvab koos autonoomsete tehisintellektiagentide integreerimisega tootmiskeskkondadesse. Need süsteemid pääsevad iseseisvalt ligi veebibrauseritele, rakendustele, e-kirjadele ja kohalikele failidele — see suurendab oluliselt potentsiaalset ründepinda manipuleeritud käskude jaoks. OpenAI käsitleb GPT-Redi vahendina, mis võimaldab suurendada turvatestide mahtu ja raskusastet, ning kasutab seda täiendusena väliste ekspertide manuaalsele kontrollile, mitmetasandilistele turvabarjääridele, jälgimissüsteemidele ja haavatavuste avalikustamise programmidele.
Allikas: www.it-daily.net · Avaldatud 17. juuli 2026
Lumi AI News — tehisintellekti abil kureeritud sisu vastavalt tehisintellektimääruse artiklile 50. Parafraseerimine ja klassifitseerimine Lumi News Pipeline v1.7.3 abil.