Skip to content

Yali Du

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

45

Venues

17

Active years

2017–2026

Best venue rank

A*

Where they publish

Papers

45 indexed papers, newest first.

YearVenueTitleAuthors
2026AAAICausality-Aware Efficient Exploration for Cooperative Multi-Agent Reinforcement Learning.Hongye Cao, Tianpei Yang, Fan Feng, Hammadi Rafik Ouariachi, Yali Du, Meng Fang, Jing Huo, Yang Gao
2026AAAISafe Multi-agent Reinforcement Learning with Natural Language Constraints.Ziyan Wang, Meng Fang, Tristan Tomilin, Fei Fang, Yali Du
2026ACLEntropy-Aware Reshaping of Reinforcement Signals for Multi-Answer Reasoning.Zhi Li, Huidan Xu, Zhen Hu, Yali Du, Ying Liu
2026ICAARTSafe Reward Learning from Human Preferences and Justifications.Ilias Kazantzidis, Timothy J. Norman, Yali Du, Christopher T. Freeman
2025AAAIRAT: Adversarial Attacks on Deep Reinforcement Agents for Targeted Behaviors.Fengshuo Bai, Runze Liu, Yali Du, Ying Wen, Yaodong Yang
2025ACLATLAS: Agent Tuning via Learning Critical Steps.Zhixun Chen, Ming Li, Yuxuan Huang, Yali Du, Meng Fang, Tianyi Zhou
2025EMNLPVLP: Vision-Language Preference Learning for Embodied Manipulation.Runze Liu, Chenjia Bai, Jiafei Lyu, Shengjie Sun, Yali Du, Xiu Li
2025EMNLPNOVER: Incentive Training for Language Models via Verifier-Free Reinforcement Learning.Wei Liu, Siya Qi, Xinyu Wang, Chen Qian, Yali Du, Yulan He
2025EMNLPCODI: Compressing Chain-of-Thought into Continuous Space via Self-Distillation.Zhenyi Shen, Hanqi Yan, Linhai Zhang, Zhanghao Hu, Yali Du, Yulan He
2025EMNLPSpiral of Silence in Large Language Model Agents.Mingze Zhong, Meng Fang, Zijing Shi, Yuxuan Huang, Shunfeng Zheng, Yali Du, Ling Chen, Jun Wang
2025ICLRRuAG: Learned-rule-augmented Generation for Large Language Models.Yudi Zhang, Pei Xiao, Lu Wang, Chaoyun Zhang, Meng Fang, Yali Du, Yevgeniy Puzyrev, Randolph Yao, Si Qin, Qingwei Lin, Mykola Pechenizkiy, Dongmei Zhang, Saravan Rajmohan, Qi Zhang
2025ICLROn the Optimization Landscape of Low Rank Adaptation Methods for Large Language Models.Xu-Hui Liu, Yali Du, Jun Wang, Yang Yu
2025ICMLGRU: Mitigating the Trade-off between Unlearning and Retention for LLMs.Yue Wang, Qizhou Wang, Feng Liu, Wei Huang, Yali Du, Xiaojiang Du, Bo Han
2025ICMLM³HF: Multi-agent Reinforcement Learning from Multi-phase Human Feedback of Mixed Quality.Ziyan Wang, Zhicheng Zhang, Fei Fang, Yali Du
2025IJCAIQuantifying the Self-Interest Level of Markov Social Dilemmas.Richard Willis, Yali Du, Joel Z. Leibo, Michael Luck
2024AAAISTAS: Spatial-Temporal Return Decomposition for Solving Sparse Rewards Problems in Multi-agent Reinforcement Learning.Sirui Chen, Zhaowei Zhang, Yaodong Yang, Yali Du
2024AAAITAPE: Leveraging Agent Topology for Cooperative Multi-Agent Policy Gradient.Xingzhou Lou, Junge Zhang, Timothy J. Norman, Kaiqi Huang, Yali Du
2024AAAIHuman-Guided Moral Decision Making in Text-Based Games.Zijing Shi, Meng Fang, Ling Chen, Yali Du, Jun Wang
2024ECAIExplaining an Agent's Future Beliefs Through Temporally Decomposing Future Reward Estimators.Mark Towers, Yali Du, Christopher T. Freeman, Timothy J. Norman
2024ICMLPEARL: Zero-shot Cross-task Preference Alignment and Robust Reward Learning for Robotic Manipulation.Runze Liu, Yali Du, Fengshuo Bai, Jiafei Lyu, Xiu Li
2024IJCAIDual Contrastive Graph-Level Clustering with Multiple Cluster Perspectives Alignment.Jinyu Cai, Yunhe Zhang, Jicong Fan, Yali Du, Wenzhong Guo
2024IJCAIOff-Agent Trust Region Policy Optimization.Ruiqing Chen, Xiaoyuan Zhang, Yali Du, Yifan Zhong, Zheng Tian, Fanglei Sun, Yaodong Yang
2024ICRACharacterizing Physical Adversarial Attacks on Robot Motion Planners.Wenxi Wu, Fabio Pierazzi, Yali Du, Martim Brando
2023AAAICooperative Multi-Agent Learning in a Complex World: Challenges and Solutions.Yali Du
2023CIKMReplace Scoring with Arrangement: A Contextual Set-to-Arrangement Framework for Learning-to-Rank.Jiarui Jin, Xianyu Chen, Weinan Zhang, Mengyue Yang, Yang Wang, Yali Du, Yong Yu, Jun Wang
2023DASFAATieComm: Learning a Hierarchical Communication Topology Based on Tie Theory.Ming Yang, Renzhi Dong, Yiming Wang, Furui Liu, Yali Du, Mingliang Zhou, Leong Hou U
2023ICDMBeyond Lexical Consistency: Preserving Semantic Consistency for Program Translation.Yali Du, Yi-Fan Ma, Zheng Xie, Ming Li
2023ICLRStay Moral and Explore: Learn to Behave Morally in Text-based Games.Zijing Shi, Meng Fang, Yunqiu Xu, Ling Chen, Yali Du
2023ICMLCooperative Open-ended Learning Framework for Zero-Shot Coordination.Yang Li, Shao Zhang, Jichen Sun, Yali Du, Ying Wen, Xinbing Wang, Wei Pan
2023IJCAICapturing the Long-Distance Dependency in the Control Flow Graph via Structural-Guided Attention for Bug Localization.Yi-Fan Ma, Yali Du, Ming Li
2023IJCNNA Multi-Agent Framework for Recommendation with Heterogeneous Sources.Yabin Zhang, Weiqi Shao, Xu Chen, Yali Du, Xiaoxiao Xu, Dong Zheng, Changhua Pei, Shuai Zhang, Peng Jiang, Kun Gai
2023WSDMMulti-queue Momentum Contrast for Microvideo-Product Retrieval.Yali Du, Yinwei Wei, Wei Ji, Fan Liu, Xin Luo, Liqiang Nie
2022AAAILearning to Identify Top Elo Ratings: A Dueling Bandits Approach.Xue Yan, Yali Du, Binxin Ru, Jun Wang, Haifeng Zhang, Xu Chen
2022ACLPerceiving the World: Question-guided Reinforcement Learning for Text-based Games.Yunqiu Xu, Meng Fang, Ling Chen, Yali Du, Joey Tianyi Zhou, Chengqi Zhang
2022ICLRRethinking Goal-Conditioned Supervised Learning and Its Connection to Offline RL.Rui Yang, Yiming Lu, Wenzhe Li, Hao Sun, Meng Fang, Yali Du, Xiu Li, Lei Han, Chongjie Zhang
2022IROSScalable Model-based Policy Optimization for Decentralized Networked Systems.Yali Du, Chengdong Ma, Yuchen Liu, Runji Lin, Hao Dong, Jun Wang, Yaodong Yang
2021EMNLPGeneralization in Text-based Games via Hierarchical Reinforcement Learning.Yunqiu Xu, Meng Fang, Ling Chen, Yali Du, Chengqi Zhang
2021ICMLEstimating α-Rank from A Few Entries with Low Rank Matrix Completion.Yali Du, Xue Yan, Xu Chen, Jun Wang, Haifeng Zhang
2021ICMLLearning in Nonzero-Sum Stochastic Games with Potentials.David Henry Mguni, Yutong Wu, Yali Du, Yaodong Yang, Ziyi Wang, Minne Li, Ying Wen, Joel Jennings, Jun Wang
2021IJCAIOrdering-Based Causal Discovery with Reinforcement Learning.Xiaoqiang Wang, Yali Du, Shengyu Zhu, Liangjun Ke, Zhitang Chen, Jianye Hao, Jun Wang
2021WWWReinforcement Recommendation with User Multi-aspect Preference.Xu Chen, Yali Du, Long Xia, Jun Wang
2019ICMLGrid-Wise Control for Multi-Agent Reinforcement Learning in Video Game AI.Lei Han, Peng Sun, Yali Du, Jiechao Xiong, Qing Wang, Xinghai Sun, Han Liu, Tong Zhang
2018CCSTowards Query Efficient Black-box Attacks: An Input-free Perspective.Yali Du, Meng Fang, Jinfeng Yi, Jun Cheng, Dacheng Tao
2017IJCAIPrivileged Matrix Factorization for Collaborative Filtering.Yali Du, Chang Xu, Dacheng Tao
2017IJCAICollaborative Rating Allocation.Yali Du, Chang Xu, Dacheng Tao