| 2025 | ICLR | uniINF: Best-of-Both-Worlds Algorithm for Parameter-Free Heavy-Tailed MABs. | Yu Chen, Jiatai Huang, Yan Dai, Longbo Huang |
| 2025 | ICLR | Beyond Squared Error: Exploring Loss Design for Enhanced Training of Generative Flow Networks. | Rui Hu, Yifan Zhang, Zhuoran Li, Longbo Huang |
| 2025 | ICLR | Efficient Online Pruning and Abstraction for Imperfect Information Extensive-Form Games. | Boning Li, Longbo Huang |
| 2025 | ICML | Finite-Time Analysis of Discrete-Time Stochastic Interpolants. | Yuhao Liu, Yu Chen, Rui Hu, Longbo Huang |
| 2025 | MOBIHOC | Beyond Static Populations: Efficient Delay-Constrained Scheduling for Dynamic Users via Deep Reinforcement Learning. | Xun Wang, Zhuoran Li, Longbo Huang |
| 2025 | SIGMETRICS | Adversarial Network Optimization under Bandit Feedback: Maximizing Utility in Non-Stationary Multi-Hop Networks. | Yan Dai, Longbo Huang |
| 2024 | ICLR | Provably Efficient Iterated CVaR Reinforcement Learning with Function Approximation and Human Feedback. | Yu Chen, Yihan Du, Pihe Hu, Siwei Wang, Desheng Wu, Longbo Huang |
| 2024 | ICLR | A Quadratic Synchronization Rule for Distributed Deep Learning. | Xinran Gu, Kaifeng Lyu, Sanjeev Arora, Jingzhao Zhang, Longbo Huang |
| 2024 | ICML | Provable Risk-Sensitive Distributional Reinforcement Learning with General Function Approximation. | Yu Chen, Xiangcheng Zhang, Siwei Wang, Longbo Huang |
| 2024 | ICML | RL-CFR: Improving Action Abstraction for Imperfect Information Extensive-Form Games with Reinforcement Learning. | Boning Li, Zhixuan Fang, Longbo Huang |
| 2024 | ICML | Provably Efficient Partially Observable Risk-sensitive Reinforcement Learning with Hindsight Observation. | Tonghe Zhang, Yu Chen, Longbo Huang |
| 2023 | AAAI | RePreM: Representation Pre-training with Masked Model for Reinforcement Learning. | Yuanying Cai, Chuheng Zhang, Wei Shen, Xuyun Zhang, Wenjie Ruan, Longbo Huang |
| 2023 | ICLR | Collaborative Pure Exploration in Kernel Bandit. | Yihan Du, Wei Chen, Yuko Kuroki, Longbo Huang |
| 2023 | ICLR | Provably Efficient Risk-Sensitive Reinforcement Learning: Iterated CVaR and Worst Path. | Yihan Du, Siwei Wang, Longbo Huang |
| 2023 | ICLR | Why (and When) does Local SGD Generalize Better than SGD? | Xinran Gu, Kaifeng Lyu, Longbo Huang, Sanjeev Arora |
| 2023 | ICLR | Towards Minimax Optimal Reward-free Reinforcement Learning in Linear MDPs. | Pihe Hu, Yu Chen, Longbo Huang |
| 2023 | ICLR | Generative Augmented Flow Networks. | Ling Pan, Dinghuai Zhang, Aaron C. Courville, Longbo Huang, Yoshua Bengio |
| 2023 | ICLR | RLx2: Training a Sparse Deep Reinforcement Learning Model from Scratch. | Yiqin Tan, Pihe Hu, Ling Pan, Jiatai Huang, Longbo Huang |
| 2023 | ICML | Multi-task Representation Learning for Pure Exploration in Linear Bandits. | Yihan Du, Longbo Huang, Wen Sun |
| 2023 | ICML | Banker Online Mirror Descent: A Universal Approach for Delayed Online Bandit Learning. | Jiatai Huang, Yan Dai, Longbo Huang |
| 2023 | UAI | Stochastic Generative Flow Networks. | Ling Pan, Dinghuai Zhang, Moksh Jain, Longbo Huang, Yoshua Bengio |
| 2022 | CIKM | Imitation Learning to Outperform Demonstrators by Directly Extrapolating Demonstrations. | Yuanying Cai, Chuheng Zhang, Wei Shen, Xiaonan He, Xuyun Zhang, Longbo Huang |
| 2022 | ICML | Adaptive Best-of-Both-Worlds Algorithm for Heavy-Tailed Multi-Armed Bandits. | Jiatai Huang, Yan Dai, Longbo Huang |
| 2022 | ICML | Modality Competition: What Makes Joint Training of Multi-modal Network Fail in Deep Learning? (Provably). | Yu Huang, Junyang Lin, Chang Zhou, Hongxia Yang, Longbo Huang |
| 2022 | ICML | Nearly Minimax Optimal Reinforcement Learning with Linear Function Approximation. | Pihe Hu, Yu Chen, Longbo Huang |
| 2022 | ICML | Plan Better Amid Conservatism: Offline Multi-Agent Reinforcement Learning with Actor Rectification. | Ling Pan, Longbo Huang, Tengyu Ma, Huazhe Xu |
| 2022 | MOBIHOC | Effective multi-user delay-constrained scheduling with deep recurrent reinforcement learning. | Pihe Hu, Ling Pan, Yu Chen, Zhixuan Fang, Longbo Huang |
| 2021 | AAAI | A One-Size-Fits-All Solution to Conservative Bandit Problems. | Yihan Du, Siwei Wang, Longbo Huang |
| 2021 | AAAI | Adaptive Algorithms for Multi-armed Bandit with Composite and Anonymous Feedback. | Siwei Wang, Haoyun Wang, Longbo Huang |
| 2021 | AAAI | Exploration by Maximizing Renyi Entropy for Reward-Free RL Framework. | Chuheng Zhang, Yuanying Cai, Longbo Huang, Jian Li |
| 2020 | ICML | Combinatorial Pure Exploration for Dueling Bandit. | Wei Chen, Yihan Du, Longbo Huang, Haoyu Zhao |
| 2020 | IJCAI | Reinforcement Learning with Dynamic Boltzmann Softmax Updates. | Ling Pan, Qingpeng Cai, Qi Meng, Wei Chen, Longbo Huang |
| 2020 | INFOCOM | Terminator: An Efficient and Light-weight Fault Localization Framework. | Yuxing Li, Hu Zheng, Chengqiang Huang, Ke Pei, Jinghui Li, Longbo Huang |
| 2020 | Networking | RTCP - Reduce Delay Variability with an End-to-end Approach. | Longbo Huang, Yuxing Li, Jean C. Walrand |
| 2019 | AAAI | A Deep Reinforcement Learning Framework for Rebalancing Dockless Bike Sharing Systems. | Ling Pan, Qingpeng Cai, Zhixuan Fang, Pingzhong Tang, Longbo Huang |
| 2018 | IJCAI | Beyond the Click-Through Rate: Web Link Selection with Multi-level Feedback. | Kun Chen, Kechao Cai, Longbo Huang, John C. S. Lui |
| 2018 | IJCAI | A Social Interaction Activity based Time-Varying User Vectorization Method for Online Social Networks. | Tianyi Hao, Longbo Huang |
| 2018 | INFOCOM | Timely-Throughput Optimal Scheduling with Prediction. | Kun Chen, Longbo Huang |
| 2018 | MOBIHOC | Loyalty Programs in the Sharing Economy: Optimality and Competition. | Zhixuan Fang, Longbo Huang, Adam Wierman |
| 2017 | ICDM | Multi-level Feedback Web Links Selection Problem: Learning and Optimization. | Kechao Cai, Kun Chen, Longbo Huang, John C. S. Lui |
| 2017 | IJCAI | Fast Stochastic Variance Reduced ADMM for Stochastic Composition Optimization. | Yue Yu, Longbo Huang |
| 2017 | MOBIHOC | Learning-aided Stochastic Network Optimization with Imperfect State Prediction. | Longbo Huang, Minghua Chen, Yunxin Liu |
| 2017 | WWW | Prices and Subsidies in the Sharing Economy. | Zhixuan Fang, Longbo Huang, Adam Wierman |
| 2016 | EuroSys | Increasing large-scale data center capacity by statistical power control. | Guosai Wang, Shuhao Wang, Bing Luo, Weisong Shi, Yinghang Zhu, Wenjun Yang, Dianming Hu, Longbo Huang, Xin Jin, Wei Xu |
| 2016 | GLOBECOM | Two-Scale Stochastic Control for Smart-Grid Powered Coordinated Multi-Point Systems. | Xiaojing Chen, Tianyi Chen, Xin Wang, Longbo Huang, Georgios B. Giannakis |
| 2016 | ISIT | Age-of-information in the presence of error. | Kun Chen, Longbo Huang |
| 2016 | MOBIHOC | System intelligence: model, bounds and algorithms. | Longbo Huang |
| 2016 | WiOpt | Learning-aided scheduling for mobile virtual network operators with QoS constraints. | Tianxiao Zhang, Huasen Wu, Xin Liu, Longbo Huang |
| 2015 | ISIT | Optimizing age-of-information in a multi-class queueing system. | Longbo Huang, Eytan H. Modiano |
| 2015 | MOBIHOC | The Value-of-Information in Matching with Queues. | Longbo Huang |
| 2015 | SOSP | Optimizing power consumption of mobile games. | Yu Yan, Songtao He, Yunxin Liu, Longbo Huang |
| 2014 | GLOBECOM | Predictive delay-aware network selection in data offloading. | Haoran Yu, Man Hon Cheung, Longbo Huang, Jianwei Huang |
| 2014 | INFOCOM | When queueing meets coding: Optimal-latency data retrieving scheme in storage clouds. | Shengbo Chen, Yin Sun, Ulas C. Kozat, Longbo Huang, Prasun Sinha, Guanfeng Liang, Xin Liu, Ness B. Shroff |
| 2014 | INFOCOM | Delay-aware Predictive Network Selection in data offloading. | Haoran Yu, Man Hon Cheung, Longbo Huang, Jianwei Huang |
| 2014 | MOBIHOC | When backpressure meets predictive scheduling. | Longbo Huang, Shaoquan Zhang, Minghua Chen, Xin Liu |
| 2014 | SIGMETRICS | The multi-shop ski rental problem. | Lingqing Ai, Xian Wu, Lingxiao Huang, Longbo Huang, Pingzhong Tang, Jian Li |
| 2014 | SIGMETRICS | The power of online learning in stochastic network optimization. | Longbo Huang, Xin Liu, Xiaohong Hao |
| 2014 | SIGMETRICS | Effect of proactive serving on user delay reduction in service systems. | Shaoquan Zhang, Longbo Huang, Minghua Chen, Xin Liu |
| 2013 | INFOCOM | A Benes packet network. | Longbo Huang, Jean C. Walrand |
| 2013 | ISIT | Optimal distributed broadcasting with per-neighbor queues in acyclic overlay networks with arbitrary underlay capacity constraints. | Shaoquan Zhang, Minghua Chen, Zongpeng Li, Longbo Huang |
| 2013 | WiOpt | Optimal sleep-wake scheduling for energy harvesting smart mobile devices. | Longbo Huang |
| 2012 | INFOCOM | A multi-layer market for vehicle-to-grid energy trading in the smart grid. | Albert Y. S. Lam, Longbo Huang, Alonso Silva, Walid Saad |
| 2012 | INFOCOM | Data centers power reduction: A two time scale approach for delay tolerant workloads. | Yuan Yao, Longbo Huang, Abhishek B. Sharma, Leana Golubchik, Michael J. Neely |
| 2012 | ISIT | Codes can reduce queueing delay in data centers. | Longbo Huang, Sameer Pawar, Hao Zhang, Kannan Ramchandran |
| 2012 | ITA | Optimal smart grid tariffs. | Longbo Huang, Jean C. Walrand, Kannan Ramchandran |
| 2011 | MOBIHOC | Utility optimal scheduling in energy harvesting networks. | Longbo Huang, Michael J. Neely |
| 2011 | WiOpt | LIFO-Backpressure achieves near optimal utility-delay tradeoff. | Longbo Huang, Scott Moeller, Michael J. Neely, Bhaskar Krishnamachari |
| 2010 | WiOpt | Delay efficient scheduling via redundant constraints in multihop networks. | Longbo Huang, Michael J. Neely |
| 2009 | WiOpt | Delay reduction via Lagrange Multipliers in stochastic network optimization. | Longbo Huang, Michael J. Neely |