| 2026 | AAAI | Beware of Reasoning Overconfidence: Pitfalls in the Reasoning Process for Multi-solution Tasks. | Jiannan Guan, Qiguang Chen, Libo Qin, Dengyun Peng, Jinhao Liu, Liangyu Huo, Jian Xie, Wanxiang Che |
| 2026 | AAAI | MRACL: Multi-Reward Space Guided Adaptive Curriculum Reinforcement Learning for LLMs. | Wenxuan Liu, Liangyu Huo, Yi Jing, Xiyuan Zhang, Jian Xie |
| 2026 | ACL | MCGA: A Multi-task Classical Chinese Literary Genre Audio Corpus. | Yexing Du, Kaiyuan Liu, Bihe Zhang, Youcheng Pan, Bo Yang, Liangyu Huo, Xiyuan Zhang, Jian Xie, Daojing He, Yang Xiang, Ming Liu, Bing Qin |
| 2026 | ACL | LCR-RAG: Enhancing Logical Consistency in Retrieval-Augmented Generation via Neuro-symbolic Reinforcement Learning. | Wenxiang Zheng, Guo Tang, Shixin Jiang, Liangyu Huo, Xiyuan Zhang, Jian Xie, Ming Liu |
| 2025 | NAACL | Beyond Excess and Deficiency: Adaptive Length Bias Mitigation in Reward Models for RLHF. | Yuyan Bu, Liangyu Huo, Yi Jing, Qing Yang |
| 2023 | AAAI | Learning Noise-Induced Reward Functions for Surpassing Demonstrations in Imitation Learning. | Liangyu Huo, Zulin Wang, Mai Xu |
| 2020 | ICASSP | Anti-Jamming Routing For Internet of Satellites: a Reinforcement Learning Approach. | Chen Han, Aijun Liu, Liangyu Huo, Haichao Wang, Xiaohu Liang |
| 2020 | ICASSP | Learning Diverse Sub-Policies via a Task-Agnostic Regularization on Action Distributions. | Liangyu Huo, Zulin Wang, Mai Xu, Yuhang Song |
| 2019 | ICASSP | Optimizing QoE of Multiple Users over DASH: A Meta-learning Approach. | Liangyu Huo, Zulin Wang, Mai Xu, Zhiguo Ding, Xiaoming Tao |