Skip to content

Yaodong Yang

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

88

Venues

25

Active years

2015–2026

Best venue rank

A*

Where they publish

Papers

88 indexed papers, newest first.

YearVenueTitleAuthors
2026AAAIDexGraspVLA: A Vision-Language-Action Framework Towards General Dexterous Grasping.Yifan Zhong, Xuchuan Huang, Ruochong Li, Ceyao Zhang, Zhang Chen, Tianrui Guan, Fanlian Zeng, Ka Nam Lui, Yuyao Ye, Yitao Liang, Yaodong Yang, Yuanpei Chen
2026ACLWhen Slower Isn't Truer: Inverse Scaling Law of Truthfulness in Multimodal Reasoning.Sitong Fang, Wenjing Cao, Jiahao Li, Xuyao Wang, Chi-Min Chan, Sirui Han, Juntao Dai, Yike Guo, Yaodong Yang, Jiaming Ji
2026ACLSIV-Bench: A Video Benchmark for Social Interaction Understanding and Reasoning.Fanqi Kong, Weiqin Zu, Xinyu Chen, Yaodong Yang, Song-Chun Zhu, Xue Feng
2026ACLCommunication-Efficient Desire Alignment for Proactive Embodied Human-Agent Interaction.Yuanfei Wang, Xinju Huang, Fangwei Zhong, Yaodong Yang, Yizhou Wang, Yuanpei Chen, Hao Dong
2026ACLSafeMCP: Proactive Power Regulation for LLM Agent Defense via Environment-Grounded Look-Ahead Reasoning.Lichao Wang, ZhaoXing Ren, Tianzhuo Yang, Jiaming Ji, Chi Harold Liu, Yaodong Yang, Juntao Dai
2026ACLA Game-Theoretica Negotiation Framework for Cross-Cultural Consensus.Guoxi Zhang, Jiawei Chen, Tianzhuo Yang, Jiaming Ji, Yaodong Yang, Juntao Dai
2026ACLUncovering Strategic Egoism Behaviors in Large Language Models.Yaoyuan Zhang, Zonghao Ying, Aishan Liu, Jian Yang, Tianlin Li, Yaodong Yang, Xianglong Liu
2026ACLSafeMT: Multi-turn Safety for Multimodal Language Models.Han Zhu, Juntao Dai, Jiaming Ji, Haoran Li, Chengkun Cai, Pengcheng Wen, Chi-Min Chan, Boyuan Chen, Yaodong Yang, Sirui Han, Yike Guo
2026ICPRSportsGPT: An LLM-Driven Framework for Interpretable Sports Motion Assessment and Training Guidance.Wenbo Tian, Ruting Lin, Hongxian Zheng, Yaodong Yang, Geng Wu, Zihao Zhang, Zhang Zhang
2025AAAIRAT: Adversarial Attacks on Deep Reinforcement Agents for Targeted Behaviors.Fengshuo Bai, Runze Liu, Yali Du, Ying Wen, Yaodong Yang
2025AAAITowards Efficient Collaboration via Graph Modeling in Reinforcement Learning.Wenzhe Fan, Zishun Yu, Chengdong Ma, Changye Li, Yaodong Yang, Xinhua Zhang
2025AAAIStream Aligner: Efficient Sentence-Level Alignment via Distribution Induction.Hantao Lou, Jiaming Ji, Kaile Wang, Yaodong Yang
2025AAAIDifferentiable Information Enhanced Model-Based Reinforcement Learning.Xiaoyuan Zhang, Xinyan Cai, Bo Liu, Weidong Huang, Song-Chun Zhu, Siyuan Qi, Yaodong Yang
2025AAAISequence to Sequence Reward Modeling: Improving RLHF by Language Feedback.Jiayi Zhou, Jiaming Ji, Josef Dai, Yaodong Yang
2025ACLSafeLawBench: Towards Safe Alignment of Large Language Models.Chuxue Cao, Han Zhu, Jiaming Ji, Qichao Sun, Zhenghao Zhu, Yinyu Wu, Josef Dai, Yaodong Yang, Sirui Han, Yike Guo
2025ACLBoosting Policy and Process Reward Models with Monte Carlo Tree Search in Open-Domain QA.Chi-Min Chan, Chunpu Xu, Junqi Zhu, Jiaming Ji, Donghai Hong, Pengcheng Wen, Chunyang Jiang, Zhen Ye, Yaodong Yang, Wei Xue, Sirui Han, Yike Guo
2025ACLPKU-SafeRLHF: Towards Multi-Level Safety Alignment for LLMs with Human Preference.Jiaming Ji, Donghai Hong, Borong Zhang, Boyuan Chen, Josef Dai, Boren Zheng, Tianyi Alex Qiu, Jiayi Zhou, Kaile Wang, Boxun Li, Sirui Han, Yike Guo, Yaodong Yang
2025ACLLanguage Models Resist Alignment: Evidence From Data Compression.Jiaming Ji, Kaile Wang, Tianyi Alex Qiu, Boyuan Chen, Jiayi Zhou, Changye Li, Hantao Lou, Josef Dai, Yunhuai Liu, Yaodong Yang
2025ACLBenchmarking Multi-National Value Alignment for Large Language Models.Chengyi Ju, Weijie Shi, Chengzhong Liu, Jiaming Ji, Jipeng Zhang, Ruiyuan Zhang, Jiajie Xu, Yaodong Yang, Sirui Han, Yike Guo
2025ACLReward Generalization in RLHF: A Topological Perspective.Tianyi Alex Qiu, Fanzhi Zeng, Jiaming Ji, Dong Yan, Kaile Wang, Jiayi Zhou, Yang Han, Josef Dai, Xuehai Pan, Yaodong Yang
2025CGIHi-Reco: High-Fidelity Real-Time Conversational Digital Humans.Hongbin Huang, Junwei Li, Tianxin Xie, Zhuang Li, Cekai Weng, Yaodong Yang, Yue Luo, Li Liu, Jing Tang, Zhijing Shao, Zeyu Wang
2025EMNLPEnhancing LLM-Based Social Bot via an Adversarial Learning Framework.Fanqi Kong, Xiaoyuan Zhang, Xinyu Chen, Yaodong Yang, Song-Chun Zhu, Xue Feng
2025ICLRMitigating Reward Over-Optimization in RLHF via Behavior-Supported Regularization.Juntao Dai, Taiye Chen, Yaodong Yang, Qian Zheng, Gang Pan
2025ICLRIn-Context Editing: Learning Knowledge from Self-Induced Distributions.Siyuan Qi, Bangcheng Yang, Kailin Jiang, Xiaobo Wang, Jiaqi Li, Yifan Zhong, Yaodong Yang, Zilong Zheng
2025ICLRMagnetic Preference Optimization: Achieving Last-iterate Convergence for Language Model Alignment.Mingzhi Wang, Chengdong Ma, Qizhi Chen, Linjian Meng, Yang Han, Jiancong Xiao, Zhaowei Zhang, Jing Huo, Weijie J. Su, Yaodong Yang
2025ICLREmerging Safety Attack and Defense in Federated Instruction Tuning of Large Language Models.Rui Ye, Jingyi Chai, Xiangrui Liu, Yaodong Yang, Yanfeng Wang, Siheng Chen
2025ICLRAmulet: ReAlignment During Test Time for Personalized Preference Adaptation of LLMs.Zhaowei Zhang, Fengshuo Bai, Qizhi Chen, Chengdong Ma, Mingzhi Wang, Haoran Sun, Zilong Zheng, Yaodong Yang
2025ICMLFalcon: Fast Visuomotor Policies via Partial Denoising.Haojun Chen, Minghao Liu, Chengdong Ma, Xiaojian Ma, Zailin Ma, Huimin Wu, Yuanpei Chen, Yifan Zhong, Mingzhi Wang, Qing Li, Yaodong Yang
2025ICMLSAE-V: Interpreting Multimodal Models for Enhanced Alignment.Hantao Lou, Changye Li, Jiaming Ji, Yaodong Yang
2025IROSAdaptive Visuo-Tactile Fusion with Predictive Force Attention for Dexterous Manipulation.Jinzhou Li, Tianhao Wu, Jiyao Zhang, Zeyuan Chen, Haotian Jin, Mingdong Wu, Yujun Shen, Yaodong Yang, Hao Dong
2025NAACLLibra-Leaderboard: Towards Responsible AI through a Balanced Leaderboard of Safety and Capability.Haonan Li, Xudong Han, Zenan Zhai, Honglin Mu, Hao Wang, Zhenxuan Zhang, Yilin Geng, Shom Lin, Renxi Wang, Artem Shelmanov, Xiangyu Qi, Yuxia Wang, Donghai Hong, Youliang Yuan, Meng Chen, Haoqin Tu, Fajri Koto, Cong Zeng, Tatsuki Kuribayashi, Rishabh Bhardwaj, Bingchen Zhao, Yawen Duan, Yi Liu, Emad A. Alghamdi, Yaodong Yang, Yinpeng Dong, Soujanya Poria, Pengfei Liu, Zhengzhong Liu, Xuguang Ren, Eduard H. Hovy, Iryna Gurevych, Preslav Nakov, Monojit Choudhury, Timothy Baldwin
2024AAAISTAS: Spatial-Temporal Return Decomposition for Solving Sparse Rewards Problems in Multi-agent Reinforcement Learning.Sirui Chen, Zhaowei Zhang, Yaodong Yang, Yali Du
2024AAAIA Perspective of Q-value Estimation on Offline-to-Online Reinforcement Learning.Yinmin Zhang, Jie Liu, Chuming Li, Yazhe Niu, Yaodong Yang, Yu Liu, Wanli Ouyang
2024AAAIProAgent: Building Proactive Cooperative Agents with Large Language Models.Ceyao Zhang, Kaijie Yang, Siyi Hu, Zihao Wang, Guanghe Li, Yihang Sun, Cheng Zhang, Zhaowei Zhang, Anji Liu, Song-Chun Zhu, Xiaojun Chang, Junge Zhang, Feng Yin, Yitao Liang, Yaodong Yang
2024APWEBGIPUT: Maximizing Photo Coverage Efficiency for UAV Trajectory.Shaoting Feng, Qinya Li, Yaodong Yang, Fan Wu, Guihai Chen
2024CoRLObject-Centric Dexterous Manipulation from Human Motion Data.Yuanpei Chen, Chen Wang, Yaodong Yang, C. Karen Liu
2024CoRLNeural Attention Field: Emerging Point Relevance in 3D Scenes for One-Shot Dexterous Grasping.Qianxu Wang, Congyue Deng, Tyler Ga Wei Lum, Yuanpei Chen, Yaodong Yang, Jeannette Bohg, Yixin Zhu, Leonidas J. Guibas
2024CVPRAnySkill: Learning Open-Vocabulary Physical Skill for Interactive Agents.Jieming Cui, Tengyu Liu, Nian Liu, Yaodong Yang, Yixin Zhu, Siyuan Huang
2024ICLRSafeDreamer: Safe Reinforcement Learning with World Models.Weidong Huang, Jiaming Ji, Chunhe Xia, Borong Zhang, Yaodong Yang
2024ICLRSafe RLHF: Safe Reinforcement Learning from Human Feedback.Josef Dai, Xuehai Pan, Ruiyang Sun, Jiaming Ji, Xinbo Xu, Mickel Liu, Yizhou Wang, Yaodong Yang
2024ICLRByzantine Robust Cooperative Multi-Agent Reinforcement Learning as a Bayesian Game.Simin Li, Jun Guo, Jingqiao Xiu, Ruixiao Xu, Xin Yu, Jiakai Wang, Aishan Liu, Yaodong Yang, Xianglong Liu
2024ICLRMaximum Entropy Heterogeneous-Agent Reinforcement Learning.Jiarong Liu, Yifan Zhong, Siyi Hu, Haobo Fu, Qiang Fu, Xiaojun Chang, Yaodong Yang
2024ICLRCivRealm: A Learning and Reasoning Odyssey in Civilization for Decision-Making Agents.Siyuan Qi, Shuo Chen, Yexin Li, Xiangyu Kong, Junqi Wang, Bangcheng Yang, Pring Wong, Yifan Zhong, Xiaoyuan Zhang, Zhaowei Zhang, Nian Liu, Yaodong Yang, Song-Chun Zhu
2024ICMLSample-Efficient Multiagent Reinforcement Learning with Reset Replay.Yaodong Yang, Guangyong Chen, Jianye Hao, Pheng-Ann Heng
2024ICMLSafe Reinforcement Learning using Finite-Horizon Gradient-based Estimation.Juntao Dai, Yaodong Yang, Qian Zheng, Gang Pan
2024ICMLEfficient Adaptation in Mixed-Motive Environments via Hierarchical Opponent Modeling and Planning.Yizhe Huang, Anji Liu, Fanqi Kong, Yaodong Yang, Song-Chun Zhu, Xue Feng
2024ICMLEnd-to-End Neuro-Symbolic Reinforcement Learning with Textual Explanations.Lirui Luo, Guoxi Zhang, Hongming Xu, Yaodong Yang, Cong Fang, Qing Li
2024IJCAIOff-Agent Trust Region Policy Optimization.Ruiqing Chen, Xiaoyuan Zhang, Yali Du, Yifan Zhong, Zheng Tian, Fanglei Sun, Yaodong Yang
2024IJCNNRemember the Past for Better Future: Memory-Augmented Offline RL.Yue Zhang, Yaodong Yang, Zhenbo Lu, Wengang Zhou, Houqiang Li
2024WACVDPPMask: Masked Image Modeling with Determinantal Point Processes.Junde Xu, Zikai Lin, Donghao Zhou, Yaodong Yang, Xiangyun Liao, Qiong Wang, Bian Wu, Guangyong Chen, Pheng-Ann Heng
2023AAAIACE: Cooperative Multi-Agent Q-learning with Bidirectional Action-Dependency.Chuming Li, Jie Liu, Yinmin Zhang, Yuhong Wei, Yazhe Niu, Yaodong Yang, Yu Liu, Wanli Ouyang
2023AAAILearning to Shape Rewards Using a Game of Two Partners.David Mguni, Taher Jafferjee, Jianhong Wang, Nicolas Perez Nieves, Wenbin Song, Feifei Tong, Matthew E. Taylor, Tianpei Yang, Zipeng Dai, Hui Chen, Jiangcheng Zhu, Kun Shao, Jun Wang, Yaodong Yang
2023AAAISubspace-Aware Exploration for Sparse-Reward Multi-Agent Tasks.Pei Xu, Junge Zhang, Qiyue Yin, Chao Yu, Yaodong Yang, Kaiqi Huang
2023CoRLDynamic Handover: Throw and Catch with Bimanual Hands.Binghao Huang, Yuanpei Chen, Tianyu Wang, Yuzhe Qin, Yaodong Yang, Nikolay Atanasov, Xiaolong Wang
2023ECAITheoretically Guaranteed Policy Improvement Distilled from Model-Based Planning.Chuming Li, Ruonan Jia, Jie Liu, Yinmin Zhang, Yazhe Niu, Yaodong Yang, Yu Liu, Wanli Ouyang
2023ICCVUniDexGrasp++: Improving Dexterous Grasping Policy Learning via Geometry-aware Curriculum and Iterative Generalist-Specialist Learning.Weikang Wan, Haoran Geng, Yun Liu, Zikang Shan, Yaodong Yang, Li Yi, He Wang
2023ICLRBoosting Multiagent Reinforcement Learning via Permutation Invariant and Permutation Equivariant Networks.Jianye Hao, Xiaotian Hao, Hangyu Mao, Weixun Wang, Yaodong Yang, Dong Li, Yan Zheng, Zhen Wang
2023ICLRQuality-Similar Diversity via Population Based Reinforcement Learning.Shuang Wu, Jian Yao, Haobo Fu, Ye Tian, Chao Qian, Yaodong Yang, Qiang Fu, Wei Yang
2023ICMLMANSA: Learning Fast and Slow in Multi-Agent Systems.David Henry Mguni, Haojun Chen, Taher Jafferjee, Jianhong Wang, Longfei Yue, Xidong Feng, Stephen Marcus McAleer, Feifei Tong, Jun Wang, Yaodong Yang
2023ICMLA Game-Theoretic Framework for Managing Risk in Multi-Agent Systems.Oliver Slumbers, David Henry Mguni, Stefano B. Blumberg, Stephen Marcus McAleer, Yaodong Yang, Jun Wang
2023ICMLRegret-Minimizing Double Oracle for Extensive-Form Games.Xiaohang Tang, Le Cong Dinh, Stephen Marcus McAleer, Yaodong Yang
2023ICMLGEAR: A GPU-Centric Experience Replay System for Large Reinforcement Learning Models.Hanjing Wang, Man-Kit Sit, Congjie He, Ying Wen, Weinan Zhang, Jun Wang, Yaodong Yang, Luo Mai
2023ICRARLAfford: End-to-End Affordance Learning for Robotic Manipulation.Yiran Geng, Boshi An, Haoran Geng, Yuanpei Chen, Yaodong Yang, Hao Dong
2023ICRAGenDexGrasp: Generalizable Dexterous Grasping.Puhao Li, Tengyu Liu, Yuyang Li, Yiran Geng, Yixin Zhu, Yaodong Yang, Siyuan Huang
2023USENIXMSRL: Distributed Reinforcement Learning with Dataflow Fragments.Huanzhou Zhu, Bo Zhao, Gang Chen, Weifeng Chen, Yijie Chen, Liang Shi, Yaodong Yang, Peter R. Pietzuch, Lei Chen
2022AAAIWhat about Inputting Policy in Value Function: Policy Representation and Policy-Extended Value Function Approximator.Hongyao Tang, Zhaopeng Meng, Jianye Hao, Chen Chen, Daniel Graves, Dong Li, Changmin Yu, Hangyu Mao, Wulong Liu, Yaodong Yang, Wenyuan Tao, Li Wang
2022ICLRTrust Region Policy Optimisation in Multi-Agent Reinforcement Learning.Jakub Grudzien Kuba, Ruiqing Chen, Muning Wen, Ying Wen, Fanglei Sun, Jun Wang, Yaodong Yang
2022ICLRLIGS: Learnable Intrinsic-Reward Generation Selection for Multi-Agent Learning.David Henry Mguni, Taher Jafferjee, Jianhong Wang, Nicolas Perez Nieves, Oliver Slumbers, Feifei Tong, Yang Li, Jiangcheng Zhu, Yaodong Yang, Jun Wang
2022IJCAIOn the Convergence of Fictitious Play: A Decomposition Approach.Yurong Chen, Xiaotie Deng, Chenchen Li, David Mguni, Jun Wang, Xiang Yan, Yaodong Yang
2022IROSScalable Model-based Policy Optimization for Decentralized Networked Systems.Yali Du, Chengdong Ma, Yuchen Liu, Runji Lin, Hao Dong, Jun Wang, Yaodong Yang
2022WISEDebias the Black-Box: A Fair Ranking Framework via Knowledge Distillation.Zhitao Zhu, Shijing Si, Jianzong Wang, Yaodong Yang, Jing Xiao
2021AAAIForesee then Evaluate: Decomposing Value Estimation with Latent Future Prediction.Hongyao Tang, Zhaopeng Meng, Guangyong Chen, Pengfei Chen, Chen Chen, Yaodong Yang, Luo Zhang, Wulong Liu, Jianye Hao
2021ICMLLearning in Nonzero-Sum Stochastic Games with Potentials.David Henry Mguni, Yutong Wu, Yali Du, Yaodong Yang, Ziyi Wang, Minne Li, Ying Wen, Joel Jennings, Jun Wang
2021ICMLModelling Behavioural Diversity for Learning in Open-Ended Games.Nicolas Perez Nieves, Yaodong Yang, Oliver Slumbers, David Henry Mguni, Ying Wen, Jun Wang
2021ICPADSMulti-Region Indoor Localization Based on WVP System.Li Zhang, Yi Xu, Jinhui Bao, Qiuyu Wang, Jingao Xu, Danyang Li, Yaodong Yang, Min Zhang
2020AAAIBi-Level Actor-Critic for Multi-Agent Coordination.Haifeng Zhang, Weizhe Chen, Zeren Huang, Minne Li, Yaodong Yang, Weinan Zhang, Jun Wang
2020CIKMLearning to Infer User Hidden States for Online Sequential Advertising.Zhaoqing Peng, Junqi Jin, Lan Luo, Yaodong Yang, Rui Luo, Jun Wang, Weinan Zhang, Haiyang Xu, Miao Xu, Chuan Yu, Tiejian Luo, Han Li, Jian Xu, Kun Gai
2020CoRLSMARTS: An Open-Source Scalable Multi-Agent RL Training School for Autonomous Driving.Ming Zhou, Jun Luo, Julian Villela, Yaodong Yang, David Rusu, Jiayu Miao, Weinan Zhang, Montgomery Alban, Iman Fadakar, Zheng Chen, Chongxi Huang, Ying Wen, Kimia Hassanzadeh, Daniel Graves, Zhengbang Zhu, Yihan Ni, Nhat M. Nguyen, Mohamed Elsayed, Haitham Ammar, Alexander I. Cowen-Rivers, Sanjeevan Ahilan, Zheng Tian, Daniel Palenicek, Kasra Rezaee, Peyman Yadmellat, Kun Shao, Dong Chen, Baokuan Zhang, Hongbo Zhang, Jianye Hao, Wulong Liu, Jun Wang
2020ICMLQ-value Path Decomposition for Deep Multiagent Reinforcement Learning.Yaodong Yang, Jianye Hao, Guangyong Chen, Hongyao Tang, Yingfeng Chen, Yujing Hu, Changjie Fan, Zhongyu Wei
2020ICMLMulti-Agent Determinantal Q-Learning.Yaodong Yang, Ying Wen, Jun Wang, Liheng Chen, Kun Shao, David Mguni, Weinan Zhang
2020IJCAIModelling Bounded Rationality in Multi-Agent Interactions by Generalized Recursive Reasoning.Ying Wen, Yaodong Yang, Jun Wang
2019ICASSPAdversarial Variational Bayes Methods for Tweedie Compound Poisson Mixed Models.Yaodong Yang, Rui Luo, Yuanyuan Liu
2019ICLRProbabilistic Recursive Reasoning for Multi-Agent Reinforcement Learning.Ying Wen, Yaodong Yang, Rui Luo, Jun Wang, Wei Pan
2019IJCAILarge-Scale Home Energy Management Using Entropy-Based Collective Multiagent Deep Reinforcement Learning Framework.Yaodong Yang, Jianye Hao, Yan Zheng, Chao Yu
2019WWWEfficient Ridesharing Order Dispatching with Mean Field Multi-Agent Reinforcement Learning.Minne Li, Zhiwei (Tony) Qin, Yan Jiao, Yaodong Yang, Jun Wang, Chenxi Wang, Guobin Wu, Jieping Ye
2018ICMLMean Field Multi-Agent Reinforcement Learning.Yaodong Yang, Rui Luo, Minne Li, Ming Zhou, Weinan Zhang, Jun Wang
2018IJCAIRecurrent Deep Multiagent Q-Learning for Autonomous Brokers in Smart Grid.Yaodong Yang, Jianye Hao, Mingyang Sun, Zan Wang, Changjie Fan, Goran Strbac
2015CloudComWAIO: Improving Virtual Machine Live Storage Migration for the Cloud by Workload-Aware IO Outsourcing.Yaodong Yang, Hong Jiang, Bo Mao, Lei Tian, Yuekun Yang, Junjie Qian