Xiaoteng Ma
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
19
Venues
10
Active years
2019–2026
Best venue rank
A*
Where they publish
Papers
19 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | ACL | From Word to World: Can Large Language Models be Implicit Text-based World Models? | Yixia Li, Hongru Wang, Jiahao Qiu, Zhenfei Yin, Dongdong Zhang, Cheng Qian, Zeping Li, Xiaoteng Ma, Guanhua Chen, Heng Ji |
| 2026 | ACL | Self-Sum: Teaching an Agent to Decide Itself When and What to Summarize. | Hongru Wang, Rui Wang, Jushi Kai, Boyang Xue, Yongqi Li, Shijue Huang, Xiaoteng Ma, Jeff Z. Pan, Amos Storkey |
| 2025 | ICLR | Episodic Novelty Through Temporal Distance. | Yuhua Jiang, Qihan Liu, Yiqin Yang, Xiaoteng Ma, Dianyu Zhong, Hao Hu, Jun Yang, Bin Liang, Bo Xu, Chongjie Zhang, Qianchuan Zhao |
| 2025 | ICLR | Cross-Domain Offline Policy Adaptation with Optimal Transport and Dataset Constraint. | Jiafei Lyu, Mengbei Yan, Zhongjian Qiao, Runze Liu, Xiaoteng Ma, Deheng Ye, Jingwen Yang, Zongqing Lu, Xiu Li |
| 2024 | AAAI | Learning Diverse Risk Preferences in Population-Based Self-Play. | Yuhua Jiang, Qihan Liu, Xiaoteng Ma, Chenghao Li, Yiqin Yang, Jun Yang, Bin Liang, Qianchuan Zhao |
| 2024 | ICLR | Efficient Multi-agent Reinforcement Learning by Planning. | Qihan Liu, Jianing Ye, Xiaoteng Ma, Jun Yang, Bin Liang, Chongjie Zhang |
| 2024 | ICLR | SEABO: A Simple Search-Based Method for Offline Imitation Learning. | Jiafei Lyu, Xiaoteng Ma, Le Wan, Runze Liu, Xiu Li, Zongqing Lu |
| 2024 | ICML | Single-Trajectory Distributionally Robust Reinforcement Learning. | Zhipeng Liang, Xiaoteng Ma, Jos H. Blanchet, Jun Yang, Jiheng Zhang, Zhengyuan Zhou |
| 2024 | INFOCOM | Smart Data-Driven Proactive Push to Edge Network for User-Generated Videos. | Xiaoteng Ma, Qing Li, Junkun Peng, Gareth Tyson, Ziwen Ye, Shisong Tang, Qian Ma, Shengbin Meng, Gabriel-Miro Muntean |
| 2024 | USENIX | KEPC-Push: A Knowledge-Enhanced Proactive Content Push Strategy for Edge-Assisted Video Feed Streaming. | Ziwen Ye, Qing Li, Chunyu Qiao, Xiaoteng Ma, Yong Jiang, Qian Ma, Shengbin Meng, Zhenhui Yuan, Zili Meng |
| 2023 | ECAI | Uncertainty-Driven Trajectory Truncation for Data Augmentation in Offline Reinforcement Learning. | Junjie Zhang, Jiafei Lyu, Xiaoteng Ma, Jiangpeng Yan, Jun Yang, Le Wan, Xiu Li |
| 2023 | ICML | What is Essential for Unseen Goal Generalization of Offline Goal-conditioned RL? | Rui Yang, Lin Yong, Xiaoteng Ma, Hao Hu, Chongjie Zhang, Tong Zhang |
| 2023 | IJCAI | Mean-Semivariance Policy Optimization via Risk-Averse Reinforcement Learning (Extended Abstract). | Xiaoteng Ma, Shuai Ma, Li Xia, Qianchuan Zhao |
| 2022 | AAAI | Efficient Continuous Control with Double Actors and Regularized Critics. | Jiafei Lyu, Xiaoteng Ma, Jiangpeng Yan, Xiu Li |
| 2022 | ICLR | Offline Reinforcement Learning with Value-based Episodic Memory. | Xiaoteng Ma, Yiqin Yang, Hao Hu, Jun Yang, Chongjie Zhang, Qianchuan Zhao, Bin Liang, Qihan Liu |
| 2022 | WWW | MagNet: Cooperative Edge Caching by Automatic Content Congregating. | Junkun Peng, Qing Li, Xiaoteng Ma, Yong Jiang, Yutao Dong, Chuang Hu, Meng Chen |
| 2022 | WWW | Knowledge-based Temporal Fusion Network for Interpretable Online Video Popularity Prediction. | Shisong Tang, Qing Li, Xiaoteng Ma, Ci Gao, Dingmin Wang, Yong Jiang, Qian Ma, Aoyang Zhang, Hechang Chen |
| 2021 | IJCAI | Average-Reward Reinforcement Learning with Trust Region Methods. | Xiaoteng Ma, Xiaohang Tang, Li Xia, Jun Yang, Qianchuan Zhao |
| 2019 | NOSSDAV | Steward: smart edge based joint QoE optimization for adaptive video streaming. | Xiaoteng Ma, Qing Li, Jimeng Chai, Xi Xiao, Shu-Tao Xia, Yong Jiang |