Skip to content

Xiaoteng Ma

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

19

Venues

10

Active years

2019–2026

Best venue rank

A*

Where they publish

Papers

19 indexed papers, newest first.

YearVenueTitleAuthors
2026ACLFrom Word to World: Can Large Language Models be Implicit Text-based World Models?Yixia Li, Hongru Wang, Jiahao Qiu, Zhenfei Yin, Dongdong Zhang, Cheng Qian, Zeping Li, Xiaoteng Ma, Guanhua Chen, Heng Ji
2026ACLSelf-Sum: Teaching an Agent to Decide Itself When and What to Summarize.Hongru Wang, Rui Wang, Jushi Kai, Boyang Xue, Yongqi Li, Shijue Huang, Xiaoteng Ma, Jeff Z. Pan, Amos Storkey
2025ICLREpisodic Novelty Through Temporal Distance.Yuhua Jiang, Qihan Liu, Yiqin Yang, Xiaoteng Ma, Dianyu Zhong, Hao Hu, Jun Yang, Bin Liang, Bo Xu, Chongjie Zhang, Qianchuan Zhao
2025ICLRCross-Domain Offline Policy Adaptation with Optimal Transport and Dataset Constraint.Jiafei Lyu, Mengbei Yan, Zhongjian Qiao, Runze Liu, Xiaoteng Ma, Deheng Ye, Jingwen Yang, Zongqing Lu, Xiu Li
2024AAAILearning Diverse Risk Preferences in Population-Based Self-Play.Yuhua Jiang, Qihan Liu, Xiaoteng Ma, Chenghao Li, Yiqin Yang, Jun Yang, Bin Liang, Qianchuan Zhao
2024ICLREfficient Multi-agent Reinforcement Learning by Planning.Qihan Liu, Jianing Ye, Xiaoteng Ma, Jun Yang, Bin Liang, Chongjie Zhang
2024ICLRSEABO: A Simple Search-Based Method for Offline Imitation Learning.Jiafei Lyu, Xiaoteng Ma, Le Wan, Runze Liu, Xiu Li, Zongqing Lu
2024ICMLSingle-Trajectory Distributionally Robust Reinforcement Learning.Zhipeng Liang, Xiaoteng Ma, Jos H. Blanchet, Jun Yang, Jiheng Zhang, Zhengyuan Zhou
2024INFOCOMSmart Data-Driven Proactive Push to Edge Network for User-Generated Videos.Xiaoteng Ma, Qing Li, Junkun Peng, Gareth Tyson, Ziwen Ye, Shisong Tang, Qian Ma, Shengbin Meng, Gabriel-Miro Muntean
2024USENIXKEPC-Push: A Knowledge-Enhanced Proactive Content Push Strategy for Edge-Assisted Video Feed Streaming.Ziwen Ye, Qing Li, Chunyu Qiao, Xiaoteng Ma, Yong Jiang, Qian Ma, Shengbin Meng, Zhenhui Yuan, Zili Meng
2023ECAIUncertainty-Driven Trajectory Truncation for Data Augmentation in Offline Reinforcement Learning.Junjie Zhang, Jiafei Lyu, Xiaoteng Ma, Jiangpeng Yan, Jun Yang, Le Wan, Xiu Li
2023ICMLWhat is Essential for Unseen Goal Generalization of Offline Goal-conditioned RL?Rui Yang, Lin Yong, Xiaoteng Ma, Hao Hu, Chongjie Zhang, Tong Zhang
2023IJCAIMean-Semivariance Policy Optimization via Risk-Averse Reinforcement Learning (Extended Abstract).Xiaoteng Ma, Shuai Ma, Li Xia, Qianchuan Zhao
2022AAAIEfficient Continuous Control with Double Actors and Regularized Critics.Jiafei Lyu, Xiaoteng Ma, Jiangpeng Yan, Xiu Li
2022ICLROffline Reinforcement Learning with Value-based Episodic Memory.Xiaoteng Ma, Yiqin Yang, Hao Hu, Jun Yang, Chongjie Zhang, Qianchuan Zhao, Bin Liang, Qihan Liu
2022WWWMagNet: Cooperative Edge Caching by Automatic Content Congregating.Junkun Peng, Qing Li, Xiaoteng Ma, Yong Jiang, Yutao Dong, Chuang Hu, Meng Chen
2022WWWKnowledge-based Temporal Fusion Network for Interpretable Online Video Popularity Prediction.Shisong Tang, Qing Li, Xiaoteng Ma, Ci Gao, Dingmin Wang, Yong Jiang, Qian Ma, Aoyang Zhang, Hechang Chen
2021IJCAIAverage-Reward Reinforcement Learning with Trust Region Methods.Xiaoteng Ma, Xiaohang Tang, Li Xia, Jun Yang, Qianchuan Zhao
2019NOSSDAVSteward: smart edge based joint QoE optimization for adaptive video streaming.Xiaoteng Ma, Qing Li, Jimeng Chai, Xi Xiao, Shu-Tao Xia, Yong Jiang