| 2026 | ACL | Improving the Throughput of Diffusion-based Large Language Models via a Training-Free Confidence-Aware Calibration. | Jucheng Shen, Gaurav Sarkar, Yeonju Ro, Sharath Nittur Sridhar, Zhangyang Wang, Aditya Akella, Souvik Kundu |
| 2025 | HotOS | How I learned to stop worrying and love learned OS policies. | Divyanshu Saxena, Jiayi Chen, Sujay Yadalam, Yeonju Ro, Rohit Dwivedula, Eric Hayden Campbell, Aditya Akella, Christopher J. Rossbach, Michael Swift |
| 2025 | ICML | On-the-Fly Adaptive Distillation of Transformer to Dual-State Linear Attention for Long-Context LLM Serving. | Yeonju Ro, Zhenyu Zhang, Souvik Kundu, Zhangyang Wang, Aditya Akella |
| 2024 | EMNLP | FFN-SkipLLM: A Hidden Gem for Autoregressive Decoding with Adaptive Feed Forward Skipping. | Ajay Jaiswal, Bodun Hu, Lu Yin, Yeonju Ro, Tianlong Chen, Shiwei Liu, Aditya Akella |
| 2023 | CVPR | Dataset Efficient Training with Model Ensembling. | Yeonju Ro, Cong Xu, Agnieszka Ciborowska, Suparna Bhattacharya, Frankie Li, Martin Foltin |
| 2023 | ICML | Lowering the Pre-training Tax for Gradient-based Subset Training: A Lightweight Distributed Pre-Training Toolkit. | Yeonju Ro, Zhangyang Wang, Vijay Chidambaram, Aditya Akella |
| 2023 | NSDI | RingLeader: Efficiently Offloading Intra-Server Orchestration to NICs. | Jiaxin Lin, Adney Cardoza, Tarannum Khan, Yeonju Ro, Brent E. Stephens, Hassan M. G. Wassel, Aditya Akella |
| 2022 | CVPR | Mr.BiQ: Post-Training Non-Uniform Quantization based on Minimizing the Reconstruction Error. | Yongkweon Jeon, Chungman Lee, Eulrang Cho, Yeonju Ro |
| 2021 | ISCA | Ghost Routing to Enable Oblivious Computation on Memory-centric Networks. | Yeonju Ro, Seongwook Jin, Jaehyuk Huh, John Kim |
| 2018 | MICRO | Multi-dimensional Parallel Training of Winograd Layer on Memory-Centric Architecture. | Byungchul Hong, Yeonju Ro, John Kim |