| 2026 | AAAI | Causality-Aware Efficient Exploration for Cooperative Multi-Agent Reinforcement Learning. | Hongye Cao, Tianpei Yang, Fan Feng, Hammadi Rafik Ouariachi, Yali Du, Meng Fang, Jing Huo, Yang Gao |
| 2026 | AAAI | Safe Multi-agent Reinforcement Learning with Natural Language Constraints. | Ziyan Wang, Meng Fang, Tristan Tomilin, Fei Fang, Yali Du |
| 2026 | ACL | Entropy-Aware Reshaping of Reinforcement Signals for Multi-Answer Reasoning. | Zhi Li, Huidan Xu, Zhen Hu, Yali Du, Ying Liu |
| 2026 | ICAART | Safe Reward Learning from Human Preferences and Justifications. | Ilias Kazantzidis, Timothy J. Norman, Yali Du, Christopher T. Freeman |
| 2025 | AAAI | RAT: Adversarial Attacks on Deep Reinforcement Agents for Targeted Behaviors. | Fengshuo Bai, Runze Liu, Yali Du, Ying Wen, Yaodong Yang |
| 2025 | ACL | ATLAS: Agent Tuning via Learning Critical Steps. | Zhixun Chen, Ming Li, Yuxuan Huang, Yali Du, Meng Fang, Tianyi Zhou |
| 2025 | EMNLP | VLP: Vision-Language Preference Learning for Embodied Manipulation. | Runze Liu, Chenjia Bai, Jiafei Lyu, Shengjie Sun, Yali Du, Xiu Li |
| 2025 | EMNLP | NOVER: Incentive Training for Language Models via Verifier-Free Reinforcement Learning. | Wei Liu, Siya Qi, Xinyu Wang, Chen Qian, Yali Du, Yulan He |
| 2025 | EMNLP | CODI: Compressing Chain-of-Thought into Continuous Space via Self-Distillation. | Zhenyi Shen, Hanqi Yan, Linhai Zhang, Zhanghao Hu, Yali Du, Yulan He |
| 2025 | EMNLP | Spiral of Silence in Large Language Model Agents. | Mingze Zhong, Meng Fang, Zijing Shi, Yuxuan Huang, Shunfeng Zheng, Yali Du, Ling Chen, Jun Wang |
| 2025 | ICLR | RuAG: Learned-rule-augmented Generation for Large Language Models. | Yudi Zhang, Pei Xiao, Lu Wang, Chaoyun Zhang, Meng Fang, Yali Du, Yevgeniy Puzyrev, Randolph Yao, Si Qin, Qingwei Lin, Mykola Pechenizkiy, Dongmei Zhang, Saravan Rajmohan, Qi Zhang |
| 2025 | ICLR | On the Optimization Landscape of Low Rank Adaptation Methods for Large Language Models. | Xu-Hui Liu, Yali Du, Jun Wang, Yang Yu |
| 2025 | ICML | GRU: Mitigating the Trade-off between Unlearning and Retention for LLMs. | Yue Wang, Qizhou Wang, Feng Liu, Wei Huang, Yali Du, Xiaojiang Du, Bo Han |
| 2025 | ICML | M³HF: Multi-agent Reinforcement Learning from Multi-phase Human Feedback of Mixed Quality. | Ziyan Wang, Zhicheng Zhang, Fei Fang, Yali Du |
| 2025 | IJCAI | Quantifying the Self-Interest Level of Markov Social Dilemmas. | Richard Willis, Yali Du, Joel Z. Leibo, Michael Luck |
| 2024 | AAAI | STAS: Spatial-Temporal Return Decomposition for Solving Sparse Rewards Problems in Multi-agent Reinforcement Learning. | Sirui Chen, Zhaowei Zhang, Yaodong Yang, Yali Du |
| 2024 | AAAI | TAPE: Leveraging Agent Topology for Cooperative Multi-Agent Policy Gradient. | Xingzhou Lou, Junge Zhang, Timothy J. Norman, Kaiqi Huang, Yali Du |
| 2024 | AAAI | Human-Guided Moral Decision Making in Text-Based Games. | Zijing Shi, Meng Fang, Ling Chen, Yali Du, Jun Wang |
| 2024 | ECAI | Explaining an Agent's Future Beliefs Through Temporally Decomposing Future Reward Estimators. | Mark Towers, Yali Du, Christopher T. Freeman, Timothy J. Norman |
| 2024 | ICML | PEARL: Zero-shot Cross-task Preference Alignment and Robust Reward Learning for Robotic Manipulation. | Runze Liu, Yali Du, Fengshuo Bai, Jiafei Lyu, Xiu Li |
| 2024 | IJCAI | Dual Contrastive Graph-Level Clustering with Multiple Cluster Perspectives Alignment. | Jinyu Cai, Yunhe Zhang, Jicong Fan, Yali Du, Wenzhong Guo |
| 2024 | IJCAI | Off-Agent Trust Region Policy Optimization. | Ruiqing Chen, Xiaoyuan Zhang, Yali Du, Yifan Zhong, Zheng Tian, Fanglei Sun, Yaodong Yang |
| 2024 | ICRA | Characterizing Physical Adversarial Attacks on Robot Motion Planners. | Wenxi Wu, Fabio Pierazzi, Yali Du, Martim Brando |
| 2023 | AAAI | Cooperative Multi-Agent Learning in a Complex World: Challenges and Solutions. | Yali Du |
| 2023 | CIKM | Replace Scoring with Arrangement: A Contextual Set-to-Arrangement Framework for Learning-to-Rank. | Jiarui Jin, Xianyu Chen, Weinan Zhang, Mengyue Yang, Yang Wang, Yali Du, Yong Yu, Jun Wang |
| 2023 | DASFAA | TieComm: Learning a Hierarchical Communication Topology Based on Tie Theory. | Ming Yang, Renzhi Dong, Yiming Wang, Furui Liu, Yali Du, Mingliang Zhou, Leong Hou U |
| 2023 | ICDM | Beyond Lexical Consistency: Preserving Semantic Consistency for Program Translation. | Yali Du, Yi-Fan Ma, Zheng Xie, Ming Li |
| 2023 | ICLR | Stay Moral and Explore: Learn to Behave Morally in Text-based Games. | Zijing Shi, Meng Fang, Yunqiu Xu, Ling Chen, Yali Du |
| 2023 | ICML | Cooperative Open-ended Learning Framework for Zero-Shot Coordination. | Yang Li, Shao Zhang, Jichen Sun, Yali Du, Ying Wen, Xinbing Wang, Wei Pan |
| 2023 | IJCAI | Capturing the Long-Distance Dependency in the Control Flow Graph via Structural-Guided Attention for Bug Localization. | Yi-Fan Ma, Yali Du, Ming Li |
| 2023 | IJCNN | A Multi-Agent Framework for Recommendation with Heterogeneous Sources. | Yabin Zhang, Weiqi Shao, Xu Chen, Yali Du, Xiaoxiao Xu, Dong Zheng, Changhua Pei, Shuai Zhang, Peng Jiang, Kun Gai |
| 2023 | WSDM | Multi-queue Momentum Contrast for Microvideo-Product Retrieval. | Yali Du, Yinwei Wei, Wei Ji, Fan Liu, Xin Luo, Liqiang Nie |
| 2022 | AAAI | Learning to Identify Top Elo Ratings: A Dueling Bandits Approach. | Xue Yan, Yali Du, Binxin Ru, Jun Wang, Haifeng Zhang, Xu Chen |
| 2022 | ACL | Perceiving the World: Question-guided Reinforcement Learning for Text-based Games. | Yunqiu Xu, Meng Fang, Ling Chen, Yali Du, Joey Tianyi Zhou, Chengqi Zhang |
| 2022 | ICLR | Rethinking Goal-Conditioned Supervised Learning and Its Connection to Offline RL. | Rui Yang, Yiming Lu, Wenzhe Li, Hao Sun, Meng Fang, Yali Du, Xiu Li, Lei Han, Chongjie Zhang |
| 2022 | IROS | Scalable Model-based Policy Optimization for Decentralized Networked Systems. | Yali Du, Chengdong Ma, Yuchen Liu, Runji Lin, Hao Dong, Jun Wang, Yaodong Yang |
| 2021 | EMNLP | Generalization in Text-based Games via Hierarchical Reinforcement Learning. | Yunqiu Xu, Meng Fang, Ling Chen, Yali Du, Chengqi Zhang |
| 2021 | ICML | Estimating α-Rank from A Few Entries with Low Rank Matrix Completion. | Yali Du, Xue Yan, Xu Chen, Jun Wang, Haifeng Zhang |
| 2021 | ICML | Learning in Nonzero-Sum Stochastic Games with Potentials. | David Henry Mguni, Yutong Wu, Yali Du, Yaodong Yang, Ziyi Wang, Minne Li, Ying Wen, Joel Jennings, Jun Wang |
| 2021 | IJCAI | Ordering-Based Causal Discovery with Reinforcement Learning. | Xiaoqiang Wang, Yali Du, Shengyu Zhu, Liangjun Ke, Zhitang Chen, Jianye Hao, Jun Wang |
| 2021 | WWW | Reinforcement Recommendation with User Multi-aspect Preference. | Xu Chen, Yali Du, Long Xia, Jun Wang |
| 2019 | ICML | Grid-Wise Control for Multi-Agent Reinforcement Learning in Video Game AI. | Lei Han, Peng Sun, Yali Du, Jiechao Xiong, Qing Wang, Xinghai Sun, Han Liu, Tong Zhang |
| 2018 | CCS | Towards Query Efficient Black-box Attacks: An Input-free Perspective. | Yali Du, Meng Fang, Jinfeng Yi, Jun Cheng, Dacheng Tao |
| 2017 | IJCAI | Privileged Matrix Factorization for Collaborative Filtering. | Yali Du, Chang Xu, Dacheng Tao |
| 2017 | IJCAI | Collaborative Rating Allocation. | Yali Du, Chang Xu, Dacheng Tao |