Yaodong Yang
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
88
Venues
25
Active years
2015–2026
Best venue rank
A*
Where they publish
- A*AAAI15 papers
- A*ICLR15 papers
- A*ICML15 papers
- A*ACL13 papers
- A*IJCAI5 papers
- UnrankedCoRL4 papers
- AIROS2 papers
- A*ICRA2 papers
- BICPR1 paper
- CCGI1 paper
- A*EMNLP1 paper
- ANAACL1 paper
- CAPWEB1 paper
- A*CVPR1 paper
- BIJCNN1 paper
- AWACV1 paper
- AECAI1 paper
- A*ICCV1 paper
- AUSENIX1 paper
- BWISE1 paper
- BICPADS1 paper
- ACIKM1 paper
- MulticonferenceICASSP1 paper
- A*WWW1 paper
- CCloudCom1 paper
Papers
88 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | AAAI | DexGraspVLA: A Vision-Language-Action Framework Towards General Dexterous Grasping. | Yifan Zhong, Xuchuan Huang, Ruochong Li, Ceyao Zhang, Zhang Chen, Tianrui Guan, Fanlian Zeng, Ka Nam Lui, Yuyao Ye, Yitao Liang, Yaodong Yang, Yuanpei Chen |
| 2026 | ACL | When Slower Isn't Truer: Inverse Scaling Law of Truthfulness in Multimodal Reasoning. | Sitong Fang, Wenjing Cao, Jiahao Li, Xuyao Wang, Chi-Min Chan, Sirui Han, Juntao Dai, Yike Guo, Yaodong Yang, Jiaming Ji |
| 2026 | ACL | SIV-Bench: A Video Benchmark for Social Interaction Understanding and Reasoning. | Fanqi Kong, Weiqin Zu, Xinyu Chen, Yaodong Yang, Song-Chun Zhu, Xue Feng |
| 2026 | ACL | Communication-Efficient Desire Alignment for Proactive Embodied Human-Agent Interaction. | Yuanfei Wang, Xinju Huang, Fangwei Zhong, Yaodong Yang, Yizhou Wang, Yuanpei Chen, Hao Dong |
| 2026 | ACL | SafeMCP: Proactive Power Regulation for LLM Agent Defense via Environment-Grounded Look-Ahead Reasoning. | Lichao Wang, ZhaoXing Ren, Tianzhuo Yang, Jiaming Ji, Chi Harold Liu, Yaodong Yang, Juntao Dai |
| 2026 | ACL | A Game-Theoretica Negotiation Framework for Cross-Cultural Consensus. | Guoxi Zhang, Jiawei Chen, Tianzhuo Yang, Jiaming Ji, Yaodong Yang, Juntao Dai |
| 2026 | ACL | Uncovering Strategic Egoism Behaviors in Large Language Models. | Yaoyuan Zhang, Zonghao Ying, Aishan Liu, Jian Yang, Tianlin Li, Yaodong Yang, Xianglong Liu |
| 2026 | ACL | SafeMT: Multi-turn Safety for Multimodal Language Models. | Han Zhu, Juntao Dai, Jiaming Ji, Haoran Li, Chengkun Cai, Pengcheng Wen, Chi-Min Chan, Boyuan Chen, Yaodong Yang, Sirui Han, Yike Guo |
| 2026 | ICPR | SportsGPT: An LLM-Driven Framework for Interpretable Sports Motion Assessment and Training Guidance. | Wenbo Tian, Ruting Lin, Hongxian Zheng, Yaodong Yang, Geng Wu, Zihao Zhang, Zhang Zhang |
| 2025 | AAAI | RAT: Adversarial Attacks on Deep Reinforcement Agents for Targeted Behaviors. | Fengshuo Bai, Runze Liu, Yali Du, Ying Wen, Yaodong Yang |
| 2025 | AAAI | Towards Efficient Collaboration via Graph Modeling in Reinforcement Learning. | Wenzhe Fan, Zishun Yu, Chengdong Ma, Changye Li, Yaodong Yang, Xinhua Zhang |
| 2025 | AAAI | Stream Aligner: Efficient Sentence-Level Alignment via Distribution Induction. | Hantao Lou, Jiaming Ji, Kaile Wang, Yaodong Yang |
| 2025 | AAAI | Differentiable Information Enhanced Model-Based Reinforcement Learning. | Xiaoyuan Zhang, Xinyan Cai, Bo Liu, Weidong Huang, Song-Chun Zhu, Siyuan Qi, Yaodong Yang |
| 2025 | AAAI | Sequence to Sequence Reward Modeling: Improving RLHF by Language Feedback. | Jiayi Zhou, Jiaming Ji, Josef Dai, Yaodong Yang |
| 2025 | ACL | SafeLawBench: Towards Safe Alignment of Large Language Models. | Chuxue Cao, Han Zhu, Jiaming Ji, Qichao Sun, Zhenghao Zhu, Yinyu Wu, Josef Dai, Yaodong Yang, Sirui Han, Yike Guo |
| 2025 | ACL | Boosting Policy and Process Reward Models with Monte Carlo Tree Search in Open-Domain QA. | Chi-Min Chan, Chunpu Xu, Junqi Zhu, Jiaming Ji, Donghai Hong, Pengcheng Wen, Chunyang Jiang, Zhen Ye, Yaodong Yang, Wei Xue, Sirui Han, Yike Guo |
| 2025 | ACL | PKU-SafeRLHF: Towards Multi-Level Safety Alignment for LLMs with Human Preference. | Jiaming Ji, Donghai Hong, Borong Zhang, Boyuan Chen, Josef Dai, Boren Zheng, Tianyi Alex Qiu, Jiayi Zhou, Kaile Wang, Boxun Li, Sirui Han, Yike Guo, Yaodong Yang |
| 2025 | ACL | Language Models Resist Alignment: Evidence From Data Compression. | Jiaming Ji, Kaile Wang, Tianyi Alex Qiu, Boyuan Chen, Jiayi Zhou, Changye Li, Hantao Lou, Josef Dai, Yunhuai Liu, Yaodong Yang |
| 2025 | ACL | Benchmarking Multi-National Value Alignment for Large Language Models. | Chengyi Ju, Weijie Shi, Chengzhong Liu, Jiaming Ji, Jipeng Zhang, Ruiyuan Zhang, Jiajie Xu, Yaodong Yang, Sirui Han, Yike Guo |
| 2025 | ACL | Reward Generalization in RLHF: A Topological Perspective. | Tianyi Alex Qiu, Fanzhi Zeng, Jiaming Ji, Dong Yan, Kaile Wang, Jiayi Zhou, Yang Han, Josef Dai, Xuehai Pan, Yaodong Yang |
| 2025 | CGI | Hi-Reco: High-Fidelity Real-Time Conversational Digital Humans. | Hongbin Huang, Junwei Li, Tianxin Xie, Zhuang Li, Cekai Weng, Yaodong Yang, Yue Luo, Li Liu, Jing Tang, Zhijing Shao, Zeyu Wang |
| 2025 | EMNLP | Enhancing LLM-Based Social Bot via an Adversarial Learning Framework. | Fanqi Kong, Xiaoyuan Zhang, Xinyu Chen, Yaodong Yang, Song-Chun Zhu, Xue Feng |
| 2025 | ICLR | Mitigating Reward Over-Optimization in RLHF via Behavior-Supported Regularization. | Juntao Dai, Taiye Chen, Yaodong Yang, Qian Zheng, Gang Pan |
| 2025 | ICLR | In-Context Editing: Learning Knowledge from Self-Induced Distributions. | Siyuan Qi, Bangcheng Yang, Kailin Jiang, Xiaobo Wang, Jiaqi Li, Yifan Zhong, Yaodong Yang, Zilong Zheng |
| 2025 | ICLR | Magnetic Preference Optimization: Achieving Last-iterate Convergence for Language Model Alignment. | Mingzhi Wang, Chengdong Ma, Qizhi Chen, Linjian Meng, Yang Han, Jiancong Xiao, Zhaowei Zhang, Jing Huo, Weijie J. Su, Yaodong Yang |
| 2025 | ICLR | Emerging Safety Attack and Defense in Federated Instruction Tuning of Large Language Models. | Rui Ye, Jingyi Chai, Xiangrui Liu, Yaodong Yang, Yanfeng Wang, Siheng Chen |
| 2025 | ICLR | Amulet: ReAlignment During Test Time for Personalized Preference Adaptation of LLMs. | Zhaowei Zhang, Fengshuo Bai, Qizhi Chen, Chengdong Ma, Mingzhi Wang, Haoran Sun, Zilong Zheng, Yaodong Yang |
| 2025 | ICML | Falcon: Fast Visuomotor Policies via Partial Denoising. | Haojun Chen, Minghao Liu, Chengdong Ma, Xiaojian Ma, Zailin Ma, Huimin Wu, Yuanpei Chen, Yifan Zhong, Mingzhi Wang, Qing Li, Yaodong Yang |
| 2025 | ICML | SAE-V: Interpreting Multimodal Models for Enhanced Alignment. | Hantao Lou, Changye Li, Jiaming Ji, Yaodong Yang |
| 2025 | IROS | Adaptive Visuo-Tactile Fusion with Predictive Force Attention for Dexterous Manipulation. | Jinzhou Li, Tianhao Wu, Jiyao Zhang, Zeyuan Chen, Haotian Jin, Mingdong Wu, Yujun Shen, Yaodong Yang, Hao Dong |
| 2025 | NAACL | Libra-Leaderboard: Towards Responsible AI through a Balanced Leaderboard of Safety and Capability. | Haonan Li, Xudong Han, Zenan Zhai, Honglin Mu, Hao Wang, Zhenxuan Zhang, Yilin Geng, Shom Lin, Renxi Wang, Artem Shelmanov, Xiangyu Qi, Yuxia Wang, Donghai Hong, Youliang Yuan, Meng Chen, Haoqin Tu, Fajri Koto, Cong Zeng, Tatsuki Kuribayashi, Rishabh Bhardwaj, Bingchen Zhao, Yawen Duan, Yi Liu, Emad A. Alghamdi, Yaodong Yang, Yinpeng Dong, Soujanya Poria, Pengfei Liu, Zhengzhong Liu, Xuguang Ren, Eduard H. Hovy, Iryna Gurevych, Preslav Nakov, Monojit Choudhury, Timothy Baldwin |
| 2024 | AAAI | STAS: Spatial-Temporal Return Decomposition for Solving Sparse Rewards Problems in Multi-agent Reinforcement Learning. | Sirui Chen, Zhaowei Zhang, Yaodong Yang, Yali Du |
| 2024 | AAAI | A Perspective of Q-value Estimation on Offline-to-Online Reinforcement Learning. | Yinmin Zhang, Jie Liu, Chuming Li, Yazhe Niu, Yaodong Yang, Yu Liu, Wanli Ouyang |
| 2024 | AAAI | ProAgent: Building Proactive Cooperative Agents with Large Language Models. | Ceyao Zhang, Kaijie Yang, Siyi Hu, Zihao Wang, Guanghe Li, Yihang Sun, Cheng Zhang, Zhaowei Zhang, Anji Liu, Song-Chun Zhu, Xiaojun Chang, Junge Zhang, Feng Yin, Yitao Liang, Yaodong Yang |
| 2024 | APWEB | GIPUT: Maximizing Photo Coverage Efficiency for UAV Trajectory. | Shaoting Feng, Qinya Li, Yaodong Yang, Fan Wu, Guihai Chen |
| 2024 | CoRL | Object-Centric Dexterous Manipulation from Human Motion Data. | Yuanpei Chen, Chen Wang, Yaodong Yang, C. Karen Liu |
| 2024 | CoRL | Neural Attention Field: Emerging Point Relevance in 3D Scenes for One-Shot Dexterous Grasping. | Qianxu Wang, Congyue Deng, Tyler Ga Wei Lum, Yuanpei Chen, Yaodong Yang, Jeannette Bohg, Yixin Zhu, Leonidas J. Guibas |
| 2024 | CVPR | AnySkill: Learning Open-Vocabulary Physical Skill for Interactive Agents. | Jieming Cui, Tengyu Liu, Nian Liu, Yaodong Yang, Yixin Zhu, Siyuan Huang |
| 2024 | ICLR | SafeDreamer: Safe Reinforcement Learning with World Models. | Weidong Huang, Jiaming Ji, Chunhe Xia, Borong Zhang, Yaodong Yang |
| 2024 | ICLR | Safe RLHF: Safe Reinforcement Learning from Human Feedback. | Josef Dai, Xuehai Pan, Ruiyang Sun, Jiaming Ji, Xinbo Xu, Mickel Liu, Yizhou Wang, Yaodong Yang |
| 2024 | ICLR | Byzantine Robust Cooperative Multi-Agent Reinforcement Learning as a Bayesian Game. | Simin Li, Jun Guo, Jingqiao Xiu, Ruixiao Xu, Xin Yu, Jiakai Wang, Aishan Liu, Yaodong Yang, Xianglong Liu |
| 2024 | ICLR | Maximum Entropy Heterogeneous-Agent Reinforcement Learning. | Jiarong Liu, Yifan Zhong, Siyi Hu, Haobo Fu, Qiang Fu, Xiaojun Chang, Yaodong Yang |
| 2024 | ICLR | CivRealm: A Learning and Reasoning Odyssey in Civilization for Decision-Making Agents. | Siyuan Qi, Shuo Chen, Yexin Li, Xiangyu Kong, Junqi Wang, Bangcheng Yang, Pring Wong, Yifan Zhong, Xiaoyuan Zhang, Zhaowei Zhang, Nian Liu, Yaodong Yang, Song-Chun Zhu |
| 2024 | ICML | Sample-Efficient Multiagent Reinforcement Learning with Reset Replay. | Yaodong Yang, Guangyong Chen, Jianye Hao, Pheng-Ann Heng |
| 2024 | ICML | Safe Reinforcement Learning using Finite-Horizon Gradient-based Estimation. | Juntao Dai, Yaodong Yang, Qian Zheng, Gang Pan |
| 2024 | ICML | Efficient Adaptation in Mixed-Motive Environments via Hierarchical Opponent Modeling and Planning. | Yizhe Huang, Anji Liu, Fanqi Kong, Yaodong Yang, Song-Chun Zhu, Xue Feng |
| 2024 | ICML | End-to-End Neuro-Symbolic Reinforcement Learning with Textual Explanations. | Lirui Luo, Guoxi Zhang, Hongming Xu, Yaodong Yang, Cong Fang, Qing Li |
| 2024 | IJCAI | Off-Agent Trust Region Policy Optimization. | Ruiqing Chen, Xiaoyuan Zhang, Yali Du, Yifan Zhong, Zheng Tian, Fanglei Sun, Yaodong Yang |
| 2024 | IJCNN | Remember the Past for Better Future: Memory-Augmented Offline RL. | Yue Zhang, Yaodong Yang, Zhenbo Lu, Wengang Zhou, Houqiang Li |
| 2024 | WACV | DPPMask: Masked Image Modeling with Determinantal Point Processes. | Junde Xu, Zikai Lin, Donghao Zhou, Yaodong Yang, Xiangyun Liao, Qiong Wang, Bian Wu, Guangyong Chen, Pheng-Ann Heng |
| 2023 | AAAI | ACE: Cooperative Multi-Agent Q-learning with Bidirectional Action-Dependency. | Chuming Li, Jie Liu, Yinmin Zhang, Yuhong Wei, Yazhe Niu, Yaodong Yang, Yu Liu, Wanli Ouyang |
| 2023 | AAAI | Learning to Shape Rewards Using a Game of Two Partners. | David Mguni, Taher Jafferjee, Jianhong Wang, Nicolas Perez Nieves, Wenbin Song, Feifei Tong, Matthew E. Taylor, Tianpei Yang, Zipeng Dai, Hui Chen, Jiangcheng Zhu, Kun Shao, Jun Wang, Yaodong Yang |
| 2023 | AAAI | Subspace-Aware Exploration for Sparse-Reward Multi-Agent Tasks. | Pei Xu, Junge Zhang, Qiyue Yin, Chao Yu, Yaodong Yang, Kaiqi Huang |
| 2023 | CoRL | Dynamic Handover: Throw and Catch with Bimanual Hands. | Binghao Huang, Yuanpei Chen, Tianyu Wang, Yuzhe Qin, Yaodong Yang, Nikolay Atanasov, Xiaolong Wang |
| 2023 | ECAI | Theoretically Guaranteed Policy Improvement Distilled from Model-Based Planning. | Chuming Li, Ruonan Jia, Jie Liu, Yinmin Zhang, Yazhe Niu, Yaodong Yang, Yu Liu, Wanli Ouyang |
| 2023 | ICCV | UniDexGrasp++: Improving Dexterous Grasping Policy Learning via Geometry-aware Curriculum and Iterative Generalist-Specialist Learning. | Weikang Wan, Haoran Geng, Yun Liu, Zikang Shan, Yaodong Yang, Li Yi, He Wang |
| 2023 | ICLR | Boosting Multiagent Reinforcement Learning via Permutation Invariant and Permutation Equivariant Networks. | Jianye Hao, Xiaotian Hao, Hangyu Mao, Weixun Wang, Yaodong Yang, Dong Li, Yan Zheng, Zhen Wang |
| 2023 | ICLR | Quality-Similar Diversity via Population Based Reinforcement Learning. | Shuang Wu, Jian Yao, Haobo Fu, Ye Tian, Chao Qian, Yaodong Yang, Qiang Fu, Wei Yang |
| 2023 | ICML | MANSA: Learning Fast and Slow in Multi-Agent Systems. | David Henry Mguni, Haojun Chen, Taher Jafferjee, Jianhong Wang, Longfei Yue, Xidong Feng, Stephen Marcus McAleer, Feifei Tong, Jun Wang, Yaodong Yang |
| 2023 | ICML | A Game-Theoretic Framework for Managing Risk in Multi-Agent Systems. | Oliver Slumbers, David Henry Mguni, Stefano B. Blumberg, Stephen Marcus McAleer, Yaodong Yang, Jun Wang |
| 2023 | ICML | Regret-Minimizing Double Oracle for Extensive-Form Games. | Xiaohang Tang, Le Cong Dinh, Stephen Marcus McAleer, Yaodong Yang |
| 2023 | ICML | GEAR: A GPU-Centric Experience Replay System for Large Reinforcement Learning Models. | Hanjing Wang, Man-Kit Sit, Congjie He, Ying Wen, Weinan Zhang, Jun Wang, Yaodong Yang, Luo Mai |
| 2023 | ICRA | RLAfford: End-to-End Affordance Learning for Robotic Manipulation. | Yiran Geng, Boshi An, Haoran Geng, Yuanpei Chen, Yaodong Yang, Hao Dong |
| 2023 | ICRA | GenDexGrasp: Generalizable Dexterous Grasping. | Puhao Li, Tengyu Liu, Yuyang Li, Yiran Geng, Yixin Zhu, Yaodong Yang, Siyuan Huang |
| 2023 | USENIX | MSRL: Distributed Reinforcement Learning with Dataflow Fragments. | Huanzhou Zhu, Bo Zhao, Gang Chen, Weifeng Chen, Yijie Chen, Liang Shi, Yaodong Yang, Peter R. Pietzuch, Lei Chen |
| 2022 | AAAI | What about Inputting Policy in Value Function: Policy Representation and Policy-Extended Value Function Approximator. | Hongyao Tang, Zhaopeng Meng, Jianye Hao, Chen Chen, Daniel Graves, Dong Li, Changmin Yu, Hangyu Mao, Wulong Liu, Yaodong Yang, Wenyuan Tao, Li Wang |
| 2022 | ICLR | Trust Region Policy Optimisation in Multi-Agent Reinforcement Learning. | Jakub Grudzien Kuba, Ruiqing Chen, Muning Wen, Ying Wen, Fanglei Sun, Jun Wang, Yaodong Yang |
| 2022 | ICLR | LIGS: Learnable Intrinsic-Reward Generation Selection for Multi-Agent Learning. | David Henry Mguni, Taher Jafferjee, Jianhong Wang, Nicolas Perez Nieves, Oliver Slumbers, Feifei Tong, Yang Li, Jiangcheng Zhu, Yaodong Yang, Jun Wang |
| 2022 | IJCAI | On the Convergence of Fictitious Play: A Decomposition Approach. | Yurong Chen, Xiaotie Deng, Chenchen Li, David Mguni, Jun Wang, Xiang Yan, Yaodong Yang |
| 2022 | IROS | Scalable Model-based Policy Optimization for Decentralized Networked Systems. | Yali Du, Chengdong Ma, Yuchen Liu, Runji Lin, Hao Dong, Jun Wang, Yaodong Yang |
| 2022 | WISE | Debias the Black-Box: A Fair Ranking Framework via Knowledge Distillation. | Zhitao Zhu, Shijing Si, Jianzong Wang, Yaodong Yang, Jing Xiao |
| 2021 | AAAI | Foresee then Evaluate: Decomposing Value Estimation with Latent Future Prediction. | Hongyao Tang, Zhaopeng Meng, Guangyong Chen, Pengfei Chen, Chen Chen, Yaodong Yang, Luo Zhang, Wulong Liu, Jianye Hao |
| 2021 | ICML | Learning in Nonzero-Sum Stochastic Games with Potentials. | David Henry Mguni, Yutong Wu, Yali Du, Yaodong Yang, Ziyi Wang, Minne Li, Ying Wen, Joel Jennings, Jun Wang |
| 2021 | ICML | Modelling Behavioural Diversity for Learning in Open-Ended Games. | Nicolas Perez Nieves, Yaodong Yang, Oliver Slumbers, David Henry Mguni, Ying Wen, Jun Wang |
| 2021 | ICPADS | Multi-Region Indoor Localization Based on WVP System. | Li Zhang, Yi Xu, Jinhui Bao, Qiuyu Wang, Jingao Xu, Danyang Li, Yaodong Yang, Min Zhang |
| 2020 | AAAI | Bi-Level Actor-Critic for Multi-Agent Coordination. | Haifeng Zhang, Weizhe Chen, Zeren Huang, Minne Li, Yaodong Yang, Weinan Zhang, Jun Wang |
| 2020 | CIKM | Learning to Infer User Hidden States for Online Sequential Advertising. | Zhaoqing Peng, Junqi Jin, Lan Luo, Yaodong Yang, Rui Luo, Jun Wang, Weinan Zhang, Haiyang Xu, Miao Xu, Chuan Yu, Tiejian Luo, Han Li, Jian Xu, Kun Gai |
| 2020 | CoRL | SMARTS: An Open-Source Scalable Multi-Agent RL Training School for Autonomous Driving. | Ming Zhou, Jun Luo, Julian Villela, Yaodong Yang, David Rusu, Jiayu Miao, Weinan Zhang, Montgomery Alban, Iman Fadakar, Zheng Chen, Chongxi Huang, Ying Wen, Kimia Hassanzadeh, Daniel Graves, Zhengbang Zhu, Yihan Ni, Nhat M. Nguyen, Mohamed Elsayed, Haitham Ammar, Alexander I. Cowen-Rivers, Sanjeevan Ahilan, Zheng Tian, Daniel Palenicek, Kasra Rezaee, Peyman Yadmellat, Kun Shao, Dong Chen, Baokuan Zhang, Hongbo Zhang, Jianye Hao, Wulong Liu, Jun Wang |
| 2020 | ICML | Q-value Path Decomposition for Deep Multiagent Reinforcement Learning. | Yaodong Yang, Jianye Hao, Guangyong Chen, Hongyao Tang, Yingfeng Chen, Yujing Hu, Changjie Fan, Zhongyu Wei |
| 2020 | ICML | Multi-Agent Determinantal Q-Learning. | Yaodong Yang, Ying Wen, Jun Wang, Liheng Chen, Kun Shao, David Mguni, Weinan Zhang |
| 2020 | IJCAI | Modelling Bounded Rationality in Multi-Agent Interactions by Generalized Recursive Reasoning. | Ying Wen, Yaodong Yang, Jun Wang |
| 2019 | ICASSP | Adversarial Variational Bayes Methods for Tweedie Compound Poisson Mixed Models. | Yaodong Yang, Rui Luo, Yuanyuan Liu |
| 2019 | ICLR | Probabilistic Recursive Reasoning for Multi-Agent Reinforcement Learning. | Ying Wen, Yaodong Yang, Rui Luo, Jun Wang, Wei Pan |
| 2019 | IJCAI | Large-Scale Home Energy Management Using Entropy-Based Collective Multiagent Deep Reinforcement Learning Framework. | Yaodong Yang, Jianye Hao, Yan Zheng, Chao Yu |
| 2019 | WWW | Efficient Ridesharing Order Dispatching with Mean Field Multi-Agent Reinforcement Learning. | Minne Li, Zhiwei (Tony) Qin, Yan Jiao, Yaodong Yang, Jun Wang, Chenxi Wang, Guobin Wu, Jieping Ye |
| 2018 | ICML | Mean Field Multi-Agent Reinforcement Learning. | Yaodong Yang, Rui Luo, Minne Li, Ming Zhou, Weinan Zhang, Jun Wang |
| 2018 | IJCAI | Recurrent Deep Multiagent Q-Learning for Autonomous Brokers in Smart Grid. | Yaodong Yang, Jianye Hao, Mingyang Sun, Zan Wang, Changjie Fan, Goran Strbac |
| 2015 | CloudCom | WAIO: Improving Virtual Machine Live Storage Migration for the Cloud by Workload-Aware IO Outsourcing. | Yaodong Yang, Hong Jiang, Bo Mao, Lei Tian, Yuekun Yang, Junjie Qian |