Skip to content

TriPlay-RL: Tri-Role Self-Play Reinforcement Learning for LLM Safety Alignment.

Zhewen Tan, Wenhan Yu, Jianfeng Si, Tongxin Liu, Kaiqi Guan, Huiyan Jin, Jiawen Tao, Xiaokun Yuan, Xiangzheng Zhang, Duohe Ma, Tong Yang, Lin Sun

VenueA*ACL
Year2026
ProceedingsACL (1)

Browse the full ACL paper archive.