Skip to content

Baoxiang Wang

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

31

Venues

10

Active years

2015–2025

Best venue rank

A*

Where they publish

Papers

31 indexed papers, newest first.

YearVenueTitleAuthors
2025AAAILast-iterate Convergence in Regularized Graphon Mean Field Game.Jing Dong, Baoxiang Wang, Yaoliang Yu
2025AAAILogarithmic Regret for Linear Markov Decision Processes with Adversarial Corruptions.Canzhe Zhao, Xiangcheng Zhang, Baoxiang Wang, Shuai Li
2025AISTATSMulti-Agent Credit Assignment with Pretrained Language Models.Wenhao Li, Dan Qiao, Baoxiang Wang, Xiangfeng Wang, Wei Yin, Hao Shen, Bo Jin, Hongyuan Zha
2025AISTATSLearning to Negotiate via Voluntary Commitment.Shuhui Zhu, Baoxiang Wang, Sriram Ganapathi Subramanian, Pascal Poupart
2025ICLRLearning to Communicate Through Implicit Communication Channels.Han Wang, Binbin Chen, Tieying Zhang, Baoxiang Wang
2025ICLRTackling Data Corruption in Offline Reinforcement Learning via Sequence Modeling.Jiawei Xu, Rui Yang, Shuang Qiu, Feng Luo, Meng Fang, Baoxiang Wang, Lei Han
2025ICLRThe adaptive complexity of parallelized log-concave sampling.Huanjian Zhou, Baoxiang Wang, Masashi Sugiyama
2025ICLRImproved Approximation Algorithms for k-Submodular Maximization via Multilinear Extension.Huanjian Zhou, Lingxiao Huang, Baoxiang Wang
2025ICMLReward Translation via Reward Machine in Semi-Alignable MDPs.Yun Hua, Haosheng Chen, Wenhao Li, Bo Jin, Baoxiang Wang, Hongyuan Zha, Xiangfeng Wang
2025ICMLA Comprehensive Framework for Analyzing the Convergence of Adam: Bridging the Gap with SGD.Ruinan Jin, Xiao Li, Yaoliang Yu, Baoxiang Wang
2025ICMLLearning Imperfect Information Extensive-form Games with Last-iterate Convergence under Bandit Feedback.Canzhe Zhao, Yutian Cheng, Jing Dong, Baoxiang Wang, Shuai Li
2024AAAIRelative Policy-Transition Optimization for Fast Policy Transfer.Jiawei Xu, Cheng Zhou, Yizheng Zhang, Baoxiang Wang, Lei Han
2024AISTATSConvergence to Nash Equilibrium and No-regret Guarantee in (Markov) Potential Games.Jing Dong, Baoxiang Wang, Yaoliang Yu
2024ICLROn Stationary Point Convergence of PPO-Clip.Ruinan Jin, Shuai Li, Baoxiang Wang
2024IJCAICarbon Market Simulation with Adaptive Mechanism Design.Han Wang, Wenhao Li, Hongyuan Zha, Baoxiang Wang
2024UAIOnline Policy Optimization for Robust Markov Decision Process.Jing Dong, Jingwei Li, Baoxiang Wang, Jingzhao Zhang
2023AAAILearning from Good Trajectories in Offline Multi-Agent Reinforcement Learning.Qi Tian, Kun Kuang, Furui Liu, Baoxiang Wang
2023ICLRLearning Adversarial Linear Mixture Markov Decision Processes with Bandit Feedback and Unknown Transition.Canzhe Zhao, Ruofeng Yang, Baoxiang Wang, Shuai Li
2023IJCAIDPMAC: Differentially Private Communication for Cooperative Multi-Agent Reinforcement Learning.Canzhe Zhao, Yanjie Ze, Jing Dong, Baoxiang Wang, Shuai Li
2023WSDMDifferentially Private Temporal Difference Learning with Stochastic Nonconvex-Strongly-Concave Optimization.Canzhe Zhao, Yanjie Ze, Jing Dong, Baoxiang Wang, Shuai Li
2022ICASSPCascading Bandit Under Differential Privacy.Kun Wang, Jing Dong, Baoxiang Wang, Shuai Li
2022ICMLDeconfounded Value Decomposition for Multi-Agent Reinforcement Learning.Jiahui Li, Kun Kuang, Baoxiang Wang, Furui Liu, Long Chen, Changjie Fan, Fei Wu, Jun Xiao
2022WSDMCombinatorial Bandits under Strategic Manipulations.Jing Dong, Ke Li, Shuai Li, Baoxiang Wang
2021KDDShapley Counterfactual Credits for Multi-Agent Reinforcement Learning.Jiahui Li, Kun Kuang, Baoxiang Wang, Furui Liu, Long Chen, Fei Wu, Jun Xiao
2020ICLRThe Gambler's Problem and Beyond.Baoxiang Wang, Shuai Li, Jiajin Li, Siu On Chan
2019IJCAIRecurrent Existence Determination Through Policy Optimization.Baoxiang Wang
2019IJCAIMetatrace Actor-Critic: Online Step-Size Tuning by Meta-gradient Descent for Reinforcement Learning Control.Kenny Young, Baoxiang Wang, Matthew E. Taylor
2018ICLRPolicy Optimization with Second-Order Advantage Information.Jiajin Li, Baoxiang Wang
2018IJCAIPolicy Optimization with Second-Order Advantage Information.Jiajin Li, Baoxiang Wang, Shengyu Zhang
2016ICMLContextual Combinatorial Cascading Bandits.Shuai Li, Baoxiang Wang, Shengyu Zhang, Wei Chen
2015ISSREPAID: Prioritizing app issues for developers by tracking user reviews over versions.Cuiyun Gao, Baoxiang Wang, Pinjia He, Jieming Zhu, Yangfan Zhou, Michael R. Lyu