| 2025 | ICML | Reinforcement Learning with Segment Feedback. | Yihan Du, Anna Winnicki, Gal Dalal, Shie Mannor, R. Srikant |
| 2024 | ICLR | Provably Efficient Iterated CVaR Reinforcement Learning with Function Approximation and Human Feedback. | Yu Chen, Yihan Du, Pihe Hu, Siwei Wang, Desheng Wu, Longbo Huang |
| 2024 | ICLR | Cascading Reinforcement Learning. | Yihan Du, R. Srikant, Wei Chen |
| 2024 | ICML | Exploration-Driven Policy Optimization in RLHF: Theoretical Insights on Efficient Data Utilization. | Yihan Du, Anna Winnicki, Gal Dalal, Shie Mannor, R. Srikant |
| 2023 | ICLR | Collaborative Pure Exploration in Kernel Bandit. | Yihan Du, Wei Chen, Yuko Kuroki, Longbo Huang |
| 2023 | ICLR | Provably Efficient Risk-Sensitive Reinforcement Learning: Iterated CVaR and Worst Path. | Yihan Du, Siwei Wang, Longbo Huang |
| 2023 | ICML | Multi-task Representation Learning for Pure Exploration in Linear Bandits. | Yihan Du, Longbo Huang, Wen Sun |
| 2022 | ICML | Branching Reinforcement Learning. | Yihan Du, Wei Chen |
| 2021 | AAAI | Combinatorial Pure Exploration with Full-Bandit or Partial Linear Feedback. | Yihan Du, Yuko Kuroki, Wei Chen |
| 2021 | AAAI | A One-Size-Fits-All Solution to Conservative Bandit Problems. | Yihan Du, Siwei Wang, Longbo Huang |
| 2020 | ICML | Combinatorial Pure Exploration for Dueling Bandit. | Wei Chen, Yihan Du, Longbo Huang, Haoyu Zhao |
| 2019 | CVPR | Direct Object Recognition Without Line-Of-Sight Using Optical Coherence. | Xin Lei, Liangyu He, Yixuan Tan, Ken Xingze Wang, Xinggang Wang, Yihan Du, Shanhui Fan, Zongfu Yu |
| 2018 | ICPR | Object-Adaptive LSTM Network for Visual Tracking. | Yihan Du, Yan Yan, Si Chen, Yang Hua, Hanzi Wang |