TriPlay-RL: Tri-Role Self-Play Reinforcement Learning for LLM Safety Alignment.
Zhewen Tan, Wenhan Yu, Jianfeng Si, Tongxin Liu, Kaiqi Guan, Huiyan Jin, Jiawen Tao, Xiaokun Yuan, Xiangzheng Zhang, Duohe Ma, Tong Yang, Lin Sun
Browse the full ACL paper archive.