LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance.
Yuchun Fan, Bei Li, Peiguang Li, Yilin Wang, Yongyu Mu, Jian Yang, Xin Chen, Rongxiang Weng, Jingang Wang, Xunliang Cai, JingBo Zhu, Tong Xiao
Browse the full ACL paper archive.