| 2025 | ICLR | LLMs Can Plan Only If We Tell Them. | Bilgehan Sel, Ruoxi Jia, Ming Jin |
| 2025 | ICML | LLMs Can Reason Faster Only If We Let Them. | Bilgehan Sel, Lifu Huang, Naren Ramakrishnan, Ruoxi Jia, Ming Jin |
| 2024 | AAAI | Balance Reward and Safety Optimization for Safe Reinforcement Learning: A Perspective of Gradient Manipulation. | Shangding Gu, Bilgehan Sel, Yuhao Ding, Lu Wang, Qingwei Lin, Ming Jin, Alois Knoll |
| 2024 | ACL | Skin-in-the-Game: Decision Making via Multi-Stakeholder Alignment in LLMs. | Bilgehan Sel, Priya Shanmugasundaram, Mohammad Kachuee, Kun Zhou, Ruoxi Jia, Ming Jin |
| 2024 | ICML | Algorithm of Thoughts: Enhancing Exploration of Ideas in Large Language Models. | Bilgehan Sel, Ahmad Al-Tawaha, Vanshaj Khattar, Ruoxi Jia, Ming Jin |
| 2023 | AAAI | On Solution Functions of Optimization: Universal Approximation and Covering Number Bounds. | Ming Jin, Vanshaj Khattar, Harshal Kaushik, Bilgehan Sel, Ruoxi Jia |
| 2023 | ICLR | A CMDP-within-online framework for Meta-Safe Reinforcement Learning. | Vanshaj Khattar, Yuhao Ding, Bilgehan Sel, Javad Lavaei, Ming Jin |