| 2026 | ACL | Memory-Augmented LLM-based Multi-Agent System for Automated Feature Generation on Tabular Data. | Fengxian Dong, Zhi Zheng, Xiao Han, Wei Chen, Jingqing Ruan, Tong Xu, Yong Chen, Enhong Chen |
| 2026 | ACL | PaTaRM: Bridging Pairwise and Pointwise Signals via Preference-Aware Task-Adaptive Reward Modeling. | Ai Jian, Jingqing Ruan, Xing Ma, Dailin Li, Weipeng Zhang, Ke Zeng, Xunliang Cai |
| 2026 | ACL | Harmonizing Dense and Sparse Signals in Multi-turn RL: Dual-Horizon Credit Assignment for Industrial Sales Agents. | Haojin Yang, Ai Jian, Yiwei Wang, Xinyue Huang, Weipeng Zhang, Ke Zeng, Xunliang Cai, Jingqing Ruan |
| 2026 | ACL | Revisiting Entropy Regularization: Adaptive Coefficient Unlocks Its Potential for LLM Reinforcement Learning. | Xiaoyun Zhang, Xiaojian Yuan, Di Huang, Wang You, Chen Hu, Jingqing Ruan, Kejiang Chen, Xing Hu |
| 2025 | ACL | AMoPO: Adaptive Multi-objective Preference Optimization without Reward Models and Reference Models. | Qi Liu, Jingqing Ruan, Hao Li, Haodong Zhao, Desheng Wang, Jiansong Chen, Guanglu Wan, Xunliang Cai, Zhi Zheng, Tong Xu |
| 2025 | EMNLP | A Reasoner for Real-World Event Detection: Scaling Reinforcement Learning via Adaptive Perplexity-Aware Sampling Strategy. | Xiaoyun Zhang, Jingqing Ruan, Xing Ma, Yawen Zhu, Jiansong Chen, Ke Zeng, Xunliang Cai |
| 2025 | EMNLP | When to Continue Thinking: Adaptive Thinking Mode Switching for Efficient Reasoning. | Xiaoyun Zhang, Jingqing Ruan, Xing Ma, Yawen Zhu, Haodong Zhao, Hao Li, Jiansong Chen, Ke Zeng, Xunliang Cai |
| 2024 | EMNLP | TPTU-v2: Boosting Task Planning and Tool Usage of Large Language Model-based Agents in Real-world Industry Systems. | Yilun Kong, Jingqing Ruan, Yihong Chen, Bin Zhang, Tianpeng Bao, Shiwei Shi, Du Qing, Xiaoru Hu, Hangyu Mao, Ziyue Li, Xingyu Zeng, Rui Zhao, Xueqian Wang |
| 2024 | ICASSP | MaDE: Multi-Scale Decision Enhancement for Multi-Agent Reinforcement Learning. | Jingqing Ruan, Runpeng Xie, Xuantang Xiong, Shuang Xu, Bo Xu |
| 2024 | ICASSP | UNeC: Unsupervised Exploring In Controllable Space. | Xuantang Xiong, Linghui Meng, Jingqing Ruan, Shuang Xu, Bo Xu |
| 2024 | ICML | Learning Causal Dynamics Models in Object-Oriented Environments. | Zhongwei Yu, Jingqing Ruan, Dengpeng Xing |
| 2024 | IJCAI | X-Light: Cross-City Traffic Signal Control Using Transformer on Transformer as Meta Multi-Agent Reinforcement Learner. | Haoyuan Jiang, Ziyue Li, Hua Wei, Xuantang Xiong, Jingqing Ruan, Jiaming Lu, Hangyu Mao, Rui Zhao |
| 2024 | KDD | CoSLight: Co-optimizing Collaborator Selection and Decision-making to Enhance Traffic Signal Control. | Jingqing Ruan, Ziyue Li, Hua Wei, Haoyuan Jiang, Jiaming Lu, Xuantang Xiong, Hangyu Mao, Rui Zhao |
| 2023 | ECAI | Learning to Collaborate by Grouping: A Consensus-Oriented Strategy for Multi-Agent Reinforcement Learning. | Jingqing Ruan, Xiaotian Hao, Dong Li, Hangyu Mao |
| 2023 | ECAI | Cardsformer: Grounding Language to Learn a Generalizable Policy in Hearthstone. | Wannian Xia, Yiming Yang, Jingqing Ruan, Dengpeng Xing, Bo Xu |
| 2023 | ECAI | Task-Prompt Generalised World Model in Multi-Environment Offline Reinforcement Learning. | Xuantang Xiong, Linghui Meng, Jingqing Ruan, Qingyang Zhang, Guoqi Li, Dengpeng Xing, Bo Xu |
| 2023 | ICONIP | Efficient Hierarchical Reinforcement Learning via Mutual Information Constrained Subgoal Discovery. | Kaishen Wang, Jingqing Ruan, Qingyang Zhang, Dengpeng Xing |
| 2023 | IJCAI | Explainable Reinforcement Learning via a Causal World Model. | Zhongwei Yu, Jingqing Ruan, Dengpeng Xing |
| 2023 | IJCNN | Balancing Exploration and Exploitation in Hierarchical Reinforcement Learning via Latent Landmark Graphs. | Qingyang Zhang, Yiming Yang, Jingqing Ruan, Xuantang Xiong, Dengpeng Xing, Bo Xu |
| 2022 | IJCNN | Learning in Bi-level Markov Games. | Linghui Meng, Jingqing Ruan, Dengpeng Xing, Bo Xu |