Skill Self-Play: Neue Co-Evolution für LLM-Trainingsmethoden27. Juli 202627. Juli 2026AI ModelsSkill Self-Play kombiniert Aufgabengenerierung, Lösungssuche und eine dynamische Fähigkeitskontrolle in einer Reinforcement-Learning-Schleife, um sowohl Aufgabenvielfalt als auch Trainings-Zuverlässigkeit zu erreichen. Share on: