| 2026 | AAAI | OR-R1: Automating Modeling and Solving of Operations Research Optimization Problem via Test-Time Reinforcement Learning. | Zezhen Ding, Zhen Tan, Jiheng Zhang, Tianlong Chen |
| 2025 | AAAI | Efficient Graph Bandit Learning with Side-Observations and Switching Constraints. | Xueping Gong, Jiheng Zhang |
| 2025 | WWW | Unveiling Discrete Clues: Superior Healthcare Predictions for Rare Diseases. | Chuang Zhao, Hui Tang, Jiheng Zhang, Xiaomeng Li |
| 2025 | TrustCom | RESA: RLWE-Based Efficient Secure Aggregation For Federated Learning. | Ziming Wang, Liang Zhang, Hang Zhou, Haibin Kan, Jiheng Zhang |
| 2024 | AISTATS | RL in Markov Games with Independent Function Approximation: Improved Sample Complexity Bound under the Local Access Model. | Junyi Fan, Yuxuan Han, Jialin Zeng, Jian-Feng Cai, Yang Wang, Yang Xiang, Jiheng Zhang |
| 2024 | ICML | Single-Trajectory Distributionally Robust Reinforcement Learning. | Zhipeng Liang, Xiaoteng Ma, Jos H. Blanchet, Jun Yang, Jiheng Zhang, Zhengyuan Zhou |
| 2023 | AISTATS | Optimal Contextual Bandits with Knapsacks under Realizability via Regression Oracles. | Yuxuan Han, Jialin Zeng, Yang Wang, Yang Xiang, Jiheng Zhang |
| 2023 | KDD | Debiasing Recommendation by Learning Identifiable Latent Confounders. | Qing Zhang, Xiaoying Zhang, Yang Liu, Hongning Wang, Min Gao, Jiheng Zhang, Ruocheng Guo |
| 2022 | ICML | Private Streaming SCO in ℓ | Yuxuan Han, Zhicong Liang, Zhipeng Liang, Yang Wang, Yuan Yao, Jiheng Zhang |
| 2022 | ICML | A Reduction from Linear Contextual Bandit Lower Bounds to Estimation Lower Bounds. | Jiahao He, Jiheng Zhang, Rachel Q. Zhang |
| 2014 | WSC | Scaling and modeling of call center arrivals. | Xiaowei Zhang, L. Jeff Hong, Jiheng Zhang |