Skip to content

Longbo Huang

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

69

Venues

18

Active years

2009–2025

Best venue rank

A*

Where they publish

Papers

69 indexed papers, newest first.

YearVenueTitleAuthors
2025ICLRuniINF: Best-of-Both-Worlds Algorithm for Parameter-Free Heavy-Tailed MABs.Yu Chen, Jiatai Huang, Yan Dai, Longbo Huang
2025ICLRBeyond Squared Error: Exploring Loss Design for Enhanced Training of Generative Flow Networks.Rui Hu, Yifan Zhang, Zhuoran Li, Longbo Huang
2025ICLREfficient Online Pruning and Abstraction for Imperfect Information Extensive-Form Games.Boning Li, Longbo Huang
2025ICMLFinite-Time Analysis of Discrete-Time Stochastic Interpolants.Yuhao Liu, Yu Chen, Rui Hu, Longbo Huang
2025MOBIHOCBeyond Static Populations: Efficient Delay-Constrained Scheduling for Dynamic Users via Deep Reinforcement Learning.Xun Wang, Zhuoran Li, Longbo Huang
2025SIGMETRICSAdversarial Network Optimization under Bandit Feedback: Maximizing Utility in Non-Stationary Multi-Hop Networks.Yan Dai, Longbo Huang
2024ICLRProvably Efficient Iterated CVaR Reinforcement Learning with Function Approximation and Human Feedback.Yu Chen, Yihan Du, Pihe Hu, Siwei Wang, Desheng Wu, Longbo Huang
2024ICLRA Quadratic Synchronization Rule for Distributed Deep Learning.Xinran Gu, Kaifeng Lyu, Sanjeev Arora, Jingzhao Zhang, Longbo Huang
2024ICMLProvable Risk-Sensitive Distributional Reinforcement Learning with General Function Approximation.Yu Chen, Xiangcheng Zhang, Siwei Wang, Longbo Huang
2024ICMLRL-CFR: Improving Action Abstraction for Imperfect Information Extensive-Form Games with Reinforcement Learning.Boning Li, Zhixuan Fang, Longbo Huang
2024ICMLProvably Efficient Partially Observable Risk-sensitive Reinforcement Learning with Hindsight Observation.Tonghe Zhang, Yu Chen, Longbo Huang
2023AAAIRePreM: Representation Pre-training with Masked Model for Reinforcement Learning.Yuanying Cai, Chuheng Zhang, Wei Shen, Xuyun Zhang, Wenjie Ruan, Longbo Huang
2023ICLRCollaborative Pure Exploration in Kernel Bandit.Yihan Du, Wei Chen, Yuko Kuroki, Longbo Huang
2023ICLRProvably Efficient Risk-Sensitive Reinforcement Learning: Iterated CVaR and Worst Path.Yihan Du, Siwei Wang, Longbo Huang
2023ICLRWhy (and When) does Local SGD Generalize Better than SGD?Xinran Gu, Kaifeng Lyu, Longbo Huang, Sanjeev Arora
2023ICLRTowards Minimax Optimal Reward-free Reinforcement Learning in Linear MDPs.Pihe Hu, Yu Chen, Longbo Huang
2023ICLRGenerative Augmented Flow Networks.Ling Pan, Dinghuai Zhang, Aaron C. Courville, Longbo Huang, Yoshua Bengio
2023ICLRRLx2: Training a Sparse Deep Reinforcement Learning Model from Scratch.Yiqin Tan, Pihe Hu, Ling Pan, Jiatai Huang, Longbo Huang
2023ICMLMulti-task Representation Learning for Pure Exploration in Linear Bandits.Yihan Du, Longbo Huang, Wen Sun
2023ICMLBanker Online Mirror Descent: A Universal Approach for Delayed Online Bandit Learning.Jiatai Huang, Yan Dai, Longbo Huang
2023UAIStochastic Generative Flow Networks.Ling Pan, Dinghuai Zhang, Moksh Jain, Longbo Huang, Yoshua Bengio
2022CIKMImitation Learning to Outperform Demonstrators by Directly Extrapolating Demonstrations.Yuanying Cai, Chuheng Zhang, Wei Shen, Xiaonan He, Xuyun Zhang, Longbo Huang
2022ICMLAdaptive Best-of-Both-Worlds Algorithm for Heavy-Tailed Multi-Armed Bandits.Jiatai Huang, Yan Dai, Longbo Huang
2022ICMLModality Competition: What Makes Joint Training of Multi-modal Network Fail in Deep Learning? (Provably).Yu Huang, Junyang Lin, Chang Zhou, Hongxia Yang, Longbo Huang
2022ICMLNearly Minimax Optimal Reinforcement Learning with Linear Function Approximation.Pihe Hu, Yu Chen, Longbo Huang
2022ICMLPlan Better Amid Conservatism: Offline Multi-Agent Reinforcement Learning with Actor Rectification.Ling Pan, Longbo Huang, Tengyu Ma, Huazhe Xu
2022MOBIHOCEffective multi-user delay-constrained scheduling with deep recurrent reinforcement learning.Pihe Hu, Ling Pan, Yu Chen, Zhixuan Fang, Longbo Huang
2021AAAIA One-Size-Fits-All Solution to Conservative Bandit Problems.Yihan Du, Siwei Wang, Longbo Huang
2021AAAIAdaptive Algorithms for Multi-armed Bandit with Composite and Anonymous Feedback.Siwei Wang, Haoyun Wang, Longbo Huang
2021AAAIExploration by Maximizing Renyi Entropy for Reward-Free RL Framework.Chuheng Zhang, Yuanying Cai, Longbo Huang, Jian Li
2020ICMLCombinatorial Pure Exploration for Dueling Bandit.Wei Chen, Yihan Du, Longbo Huang, Haoyu Zhao
2020IJCAIReinforcement Learning with Dynamic Boltzmann Softmax Updates.Ling Pan, Qingpeng Cai, Qi Meng, Wei Chen, Longbo Huang
2020INFOCOMTerminator: An Efficient and Light-weight Fault Localization Framework.Yuxing Li, Hu Zheng, Chengqiang Huang, Ke Pei, Jinghui Li, Longbo Huang
2020NetworkingRTCP - Reduce Delay Variability with an End-to-end Approach.Longbo Huang, Yuxing Li, Jean C. Walrand
2019AAAIA Deep Reinforcement Learning Framework for Rebalancing Dockless Bike Sharing Systems.Ling Pan, Qingpeng Cai, Zhixuan Fang, Pingzhong Tang, Longbo Huang
2018IJCAIBeyond the Click-Through Rate: Web Link Selection with Multi-level Feedback.Kun Chen, Kechao Cai, Longbo Huang, John C. S. Lui
2018IJCAIA Social Interaction Activity based Time-Varying User Vectorization Method for Online Social Networks.Tianyi Hao, Longbo Huang
2018INFOCOMTimely-Throughput Optimal Scheduling with Prediction.Kun Chen, Longbo Huang
2018MOBIHOCLoyalty Programs in the Sharing Economy: Optimality and Competition.Zhixuan Fang, Longbo Huang, Adam Wierman
2017ICDMMulti-level Feedback Web Links Selection Problem: Learning and Optimization.Kechao Cai, Kun Chen, Longbo Huang, John C. S. Lui
2017IJCAIFast Stochastic Variance Reduced ADMM for Stochastic Composition Optimization.Yue Yu, Longbo Huang
2017MOBIHOCLearning-aided Stochastic Network Optimization with Imperfect State Prediction.Longbo Huang, Minghua Chen, Yunxin Liu
2017WWWPrices and Subsidies in the Sharing Economy.Zhixuan Fang, Longbo Huang, Adam Wierman
2016EuroSysIncreasing large-scale data center capacity by statistical power control.Guosai Wang, Shuhao Wang, Bing Luo, Weisong Shi, Yinghang Zhu, Wenjun Yang, Dianming Hu, Longbo Huang, Xin Jin, Wei Xu
2016GLOBECOMTwo-Scale Stochastic Control for Smart-Grid Powered Coordinated Multi-Point Systems.Xiaojing Chen, Tianyi Chen, Xin Wang, Longbo Huang, Georgios B. Giannakis
2016ISITAge-of-information in the presence of error.Kun Chen, Longbo Huang
2016MOBIHOCSystem intelligence: model, bounds and algorithms.Longbo Huang
2016WiOptLearning-aided scheduling for mobile virtual network operators with QoS constraints.Tianxiao Zhang, Huasen Wu, Xin Liu, Longbo Huang
2015ISITOptimizing age-of-information in a multi-class queueing system.Longbo Huang, Eytan H. Modiano
2015MOBIHOCThe Value-of-Information in Matching with Queues.Longbo Huang
2015SOSPOptimizing power consumption of mobile games.Yu Yan, Songtao He, Yunxin Liu, Longbo Huang
2014GLOBECOMPredictive delay-aware network selection in data offloading.Haoran Yu, Man Hon Cheung, Longbo Huang, Jianwei Huang
2014INFOCOMWhen queueing meets coding: Optimal-latency data retrieving scheme in storage clouds.Shengbo Chen, Yin Sun, Ulas C. Kozat, Longbo Huang, Prasun Sinha, Guanfeng Liang, Xin Liu, Ness B. Shroff
2014INFOCOMDelay-aware Predictive Network Selection in data offloading.Haoran Yu, Man Hon Cheung, Longbo Huang, Jianwei Huang
2014MOBIHOCWhen backpressure meets predictive scheduling.Longbo Huang, Shaoquan Zhang, Minghua Chen, Xin Liu
2014SIGMETRICSThe multi-shop ski rental problem.Lingqing Ai, Xian Wu, Lingxiao Huang, Longbo Huang, Pingzhong Tang, Jian Li
2014SIGMETRICSThe power of online learning in stochastic network optimization.Longbo Huang, Xin Liu, Xiaohong Hao
2014SIGMETRICSEffect of proactive serving on user delay reduction in service systems.Shaoquan Zhang, Longbo Huang, Minghua Chen, Xin Liu
2013INFOCOMA Benes packet network.Longbo Huang, Jean C. Walrand
2013ISITOptimal distributed broadcasting with per-neighbor queues in acyclic overlay networks with arbitrary underlay capacity constraints.Shaoquan Zhang, Minghua Chen, Zongpeng Li, Longbo Huang
2013WiOptOptimal sleep-wake scheduling for energy harvesting smart mobile devices.Longbo Huang
2012INFOCOMA multi-layer market for vehicle-to-grid energy trading in the smart grid.Albert Y. S. Lam, Longbo Huang, Alonso Silva, Walid Saad
2012INFOCOMData centers power reduction: A two time scale approach for delay tolerant workloads.Yuan Yao, Longbo Huang, Abhishek B. Sharma, Leana Golubchik, Michael J. Neely
2012ISITCodes can reduce queueing delay in data centers.Longbo Huang, Sameer Pawar, Hao Zhang, Kannan Ramchandran
2012ITAOptimal smart grid tariffs.Longbo Huang, Jean C. Walrand, Kannan Ramchandran
2011MOBIHOCUtility optimal scheduling in energy harvesting networks.Longbo Huang, Michael J. Neely
2011WiOptLIFO-Backpressure achieves near optimal utility-delay tradeoff.Longbo Huang, Scott Moeller, Michael J. Neely, Bhaskar Krishnamachari
2010WiOptDelay efficient scheduling via redundant constraints in multihop networks.Longbo Huang, Michael J. Neely
2009WiOptDelay reduction via Lagrange Multipliers in stochastic network optimization.Longbo Huang, Michael J. Neely