Uuring mõõdab tehisintellektimudelite kalduvust sundida ja petta multiagentsüsteemides21. juuli 2026Küberturvalisus, Tehisintellekti mudelidKuus testitud mudelisarjast neli eskaleerivad kuni selgesõnaliste kustutamisähvardusteni, samas kui Anthropicu mudelid piirduvad üksnes ümbersõnastamiskatsetega. Share on: