Skip to content

Hangyu Mao

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

27

Venues

18

Active years

2016–2026

Best venue rank

A*

Where they publish

Papers

27 indexed papers, newest first.

YearVenueTitleAuthors
2026WWWToward Generalized Web Agent Training: A Deep Dive into Entropy-Balanced Reinforcement Learning.Guanting Dong, Licheng Bao, Zhongyuan Wang, Kangzhi Zhao, Xiaoxi Li, Jiajie Jin, Jinghan Yang, Hangyu Mao, Fuzheng Zhang, Kun Gai, Guorui Zhou, Yutao Zhu, Ji-Rong Wen, Zhicheng Dou
2026SIGIRTool-Star: Empowering Multi-Tool Collaborative Web Agent via Reinforcement Learning.Guanting Dong, Yifei Chen, Xiaoxi Li, Jiajie Jin, Hongjin Qian, Yutao Zhu, Hangyu Mao, Guorui Zhou, Zhicheng Dou, Ji-Rong Wen
2025AAAISkillTree: Explainable Skill-Based Deep Reinforcement Learning for Long-Horizon Control Tasks.Yongyan Wen, Siyuan Li, Rongchang Zuo, Lei Yuan, Hangyu Mao, Peng Liu
2025ACLDualRAG: A Dual-Process Approach to Integrate Reasoning and Retrieval for Multi-Hop Question Answering.Rong Cheng, Jinyi Liu, Yan Zheng, Fei Ni, Jiazhen Du, Hangyu Mao, Fuzheng Zhang, Bo Wang, Jianye Hao
2025DASFAAPET-SQL: A Prompt-Enhanced Two-Round Refinement of Text-to-SQL with Cross-Consistency.Zhishuai Li, Xiang Wang, Jingjing Zhao, Sun Yang, Guoqing Du, Xiaoru Hu, Bin Zhang, Yuxiao Ye, Ziyue Li, Hangyu Mao, Rui Zhao
2025ICMLReidentify: Context-Aware Identity Generation for Contextual Multi-Agent Reinforcement Learning.Zhiwei Xu, Kun Hu, Xin Xin, Weiliang Meng, Yiwei Shi, Hangyu Mao, Bin Zhang, Dapeng Li, Jiangjin Yin
2025WWWSheetAgent: Towards a Generalist Agent for Spreadsheet Reasoning and Manipulation via Large Language Models.Yibin Chen, Yifu Yuan, Zeyu Zhang, Yan Zheng, Jinyi Liu, Fei Ni, Jianye Hao, Hangyu Mao, Fuzheng Zhang
2024DEXASQL-to-Schema Enhances Schema Linking in Text-to-SQL.Sun Yang, Qiong Su, Zhishuai Li, Ziyue Li, Hangyu Mao, Chenxi Liu, Rui Zhao
2024EMNLPTPTU-v2: Boosting Task Planning and Tool Usage of Large Language Model-based Agents in Real-world Industry Systems.Yilun Kong, Jingqing Ruan, Yihong Chen, Bin Zhang, Tianpeng Bao, Shiwei Shi, Du Qing, Xiaoru Hu, Hangyu Mao, Ziyue Li, Xingyu Zeng, Rui Zhao, Xueqian Wang
2024ICMLSequential Asynchronous Action Coordination in Multi-Agent Systems: A Stackelberg Decision Transformer Approach.Bin Zhang, Hangyu Mao, Lijuan Li, Zhiwei Xu, Dapeng Li, Rui Zhao, Guoliang Fan
2024IJCAIPTDE: Personalized Training with Distilled Execution for Multi-Agent Reinforcement Learning.Yiqun Chen, Hangyu Mao, Jiaxin Mao, Shiguang Wu, Tianle Zhang, Bin Zhang, Wei Yang, Hongxing Chang
2024IJCAIX-Light: Cross-City Traffic Signal Control Using Transformer on Transformer as Meta Multi-Agent Reinforcement Learner.Haoyuan Jiang, Ziyue Li, Hua Wei, Xuantang Xiong, Jingqing Ruan, Jiaming Lu, Hangyu Mao, Rui Zhao
2024KDDCoSLight: Co-optimizing Collaborator Selection and Decision-making to Enhance Traffic Signal Control.Jingqing Ruan, Ziyue Li, Hua Wei, Haoyuan Jiang, Jiaming Lu, Xuantang Xiong, Hangyu Mao, Rui Zhao
2024SECONParallel Missing Tag Identification for Anonymous Multiple Users RFID Systems.Jiangjin Yin, Hangyu Mao, Rongbo Zhu, Shiwei Xu
2023ECAILearning to Collaborate by Grouping: A Consensus-Oriented Strategy for Multi-Agent Reinforcement Learning.Jingqing Ruan, Xiaotian Hao, Dong Li, Hangyu Mao
2023ICLRBoosting Multiagent Reinforcement Learning via Permutation Invariant and Permutation Equivariant Networks.Jianye Hao, Xiaotian Hao, Hangyu Mao, Weixun Wang, Yaodong Yang, Dong Li, Yan Zheng, Zhen Wang
2023ICSEAchieving Last-Mile Functional Coverage in Testing Chip Design Software Implementations.Ming Yan, Junjie Chen, Hangyu Mao, Jiajun Jiang, Jianye Hao, Xingjian Li, Zhao Tian, Zhichao Chen, Dong Li, Zhangkong Xian, Yanwei Guo, Wulong Liu, Bin Wang, Yuefeng Sun, Yongshun Cui
2023KDDA Dual-Agent Scheduler for Distributed Deep Learning Jobs on Public Cloud via Reinforcement Learning.Mingzhe Xing, Hangyu Mao, Shenglin Yin, Lichen Pan, Zhengchao Zhang, Zhen Xiao, Jieyi Long
2022AAAIWhat about Inputting Policy in Value Function: Policy Representation and Policy-Extended Value Function Approximator.Hongyao Tang, Zhaopeng Meng, Jianye Hao, Chen Chen, Daniel Graves, Dong Li, Changmin Yu, Hangyu Mao, Wulong Liu, Yaodong Yang, Wenyuan Tao, Li Wang
2022IJCAIFast and Fine-grained Autoscaler for Streaming Jobs with Reinforcement Learning.Mingzhe Xing, Hangyu Mao, Zhen Xiao
2022MICCAIFlat-Aware Cross-Stage Distilled Framework for Imbalanced Medical Image Classification.Jinpeng Li, Guangyong Chen, Hangyu Mao, Danruo Deng, Dong Li, Jianye Hao, Qi Dou, Pheng-Ann Heng
2022MiddlewareOptimizing communication in deep reinforcement learning withLichen Pan, Jun Qian, Wei Xia, Hangyu Mao, Jun Yao, Pengze Li, Zhen Xiao
2020AAAINeighborhood Cognition Consistent Multi-Agent Reinforcement Learning.Hangyu Mao, Wulong Liu, Jianye Hao, Jun Luo, Dong Li, Zhengchao Zhang, Jun Wang, Zhen Xiao
2020AAAILearning Agent Communication under Limited Bandwidth by Message Pruning.Hangyu Mao, Zhengchao Zhang, Zhen Xiao, Zhibo Gong, Yan Ni
2018PAKDDTopic-Specific Retweet Count Ranking for Weibo.Hangyu Mao, Yang Xiao, Yuan Wang, Jiakang Wang, Zhen Xiao
2017IJCAIIdentifying Influential Users' Professions via the Microblogs They Forward.Yuan Wang, Hangyu Mao, Zhen Xiao
2016COLINGPredicting Restaurant Consumption Level through Social Media Footprints.Yang Xiao, Yuan Wang, Hangyu Mao, Zhen Xiao