Bei gängigen Rekonstruktionstests für KI-Erklärungen können Modelle falsche Codes erlernen, die hohe Rekonstruktionswerte erzeugen, ohne dass einzelne Aussagen nachvollziehbar sind — RECAP-Training mit zusätzlichen Prüfköpfen behebt das Problem strukturell.