| 2026 | ACL | LipoAgent: Coordinating Fine-Tuned LLM Agents for Safer Lipid Design. | Leshu Li, An Lu, Haiyu Wang, Zhibin Feng, Conghui Duan, Qing Bao, Zongmin Zhao, Sai Qian Zhang |
| 2026 | ACL | DREAM-S: Speculative Decoding with Searchable Drafting and Target-Aware Refinement for Multimodal Generation. | Zining Liu, Yunhai Hu, Tianhua Xia, B. O. Bao, Eric Sather, Vithursan Thangarasa, Sai Qian Zhang |
| 2026 | ASPLOS | Segment Only Where You Look: Leveraging Human Gaze Behavior for Efficient Computer Vision Applications in Augmented Reality. | Tianhua Xia, Haiyu Wang, Sai Qian Zhang |
| 2026 | DATE | FLAME: A Framework Exploring Execution Strategies for Multi-Cycle Operations in CGRA. | Jiajun Qin, Cheng Tan, Ruihong Yin, Tianhua Xia, Sai Qian Zhang, Bei Yu |
| 2026 | EACL | LARA: LLM-based Agile Power Distribution Network Restoration from Disastrous Events. | Jishnu Warrier, Heqing Huang, Yuzhang Lin, Sai Qian Zhang |
| 2026 | ISCA | ECHO: Efficient Head-Orientation-Guided Real-Time Sound Spatialization for Virtual Reality. | Haiyu Wang, Tianhua Xia, Sai Qian Zhang |
| 2025 | ACL | PipeSpec: Breaking Stage Dependencies in Hierarchical LLM Decoding. | Bradley McDanel, Sai Qian Zhang, Yunhai Hu, Zining Liu |
| 2025 | ASPDAC | H4H: Hybrid Convolution-Transformer Architecture Search for NPU-CIM Heterogeneous Systems for AR/VR Applications. | Yiwei Zhao, Jinhui Chen, Sai Qian Zhang, Syed Shakib Sarwar, Kleber Hugo Stangherlin, Jorge Toms Gmez, Jae-Sun Seo, Barbara De Salvo, Chiao Liu, Phillip B. Gibbons, Ziyun Li |
| 2025 | ASPLOS | PICACHU: Plug-In CGRA Handling Upcoming Nonlinear Operations in LLMs. | Jiajun Qin, Tianhua Xia, Cheng Tan, Jeff Zhang, Sai Qian Zhang |
| 2025 | CVPR | PETAH: Parameter Efficient Task Adaptation for Hybrid Transformers. | Maximilian Augustin, Syed Shakib Sarwar, Mostafa Elhoushi, Yuecheng Li, Sai Qian Zhang, Barbara De Salvo |
| 2025 | CVPR | Foveated Instance Segmentation. | Hongyi Zeng, Wenxuan Liu, Tianhua Xia, Jinhui Chen, Ziyun Li, Sai Qian Zhang |
| 2025 | DATE | HAAN: A Holistic Approach for Accelerating Normalization Operations in Large Language Models. | Tianfan Peng, Tianhua Xia, Jiajun Qin, Sai Qian Zhang |
| 2025 | EMNLP | Mitigating Sequential Dependencies: A Survey of Algorithms and Systems for Generation-Refinement Frameworks in Autoregressive Models. | Yunhai Hu, Zining Liu, Zhenyuan Dong, Tianfan Peng, Bradley McDanel, Sai Qian Zhang |
| 2025 | ICIP | DFT Gaze: Distilled and Fine-Tuned Gaze Estimation for Personalization on Tiny Devices. | He-Yen Hsieh, Ziyun Li, Sai Qian Zhang, Wei-Te Mark Ting, Kao-Den Chang, Barbara De Salvo, Chiao Liu, H. T. Kung |
| 2025 | ISCA | Process Only Where You Look: Hardware and Algorithm Co-optimization for Efficient Gaze-Tracked Foveated Rendering in Virtual Reality. | Haiyu Wang, Wenxuan Liu, Kenneth Chen, Qi Sun, Sai Qian Zhang |
| 2025 | ISCAS | FrameVoting: A Robust and Fast Method of Using Gaze Estimations to Identify Objects of Interest. | Kao-Den Chang, He-Yen Hsieh, H. T. Kung, Ziyun Li, Sai Qian Zhang |
| 2025 | ICS | A3FR: Agile 3D Gaussian Splatting with Incremental Gaze Tracked Foveated Rendering in Virtual Reality. | Shuo Xin, Haiyu Wang, Sai Qian Zhang |
| 2025 | MICRO | Kelle: Co-design KV Caching and eDRAM for Efficient LLM Serving in Edge Computing. | Tianhua Xia, Sai Qian Zhang |
| 2025 | WACV | DiTAS: Quantizing Diffusion Transformers via Enhanced Activation Smoothing. | Zhenyuan Dong, Sai Qian Zhang |
| 2024 | EMNLP | DLoRA: Distributed Parameter-Efficient Fine-Tuning Solution for Large Language Model. | Chao Gao, Sai Qian Zhang |
| 2024 | HPCA | CAMEL: Co-Designing AI Models and eDRAMs for Efficient On-Device Learning. | Sai Qian Zhang, Thierry Tambe, Nestor Cuevas, Gu-Yeon Wei, David Brooks |
| 2024 | ICPP | Murmuration: On-the-fly DNN Adaptation for SLO-Aware Distributed Inference in Dynamic Edge Environments. | Jieyu Lin, Minghao Li, Sai Qian Zhang, Alberto Leon-Garcia |
| 2024 | ISLPED | Hyft: A Reconfigurable Softmax Accelerator with Hybrid Numeric Format for both Training and Inference. | Tianhua Xia, Sai Qian Zhang |
| 2024 | ISLPED | JointNF: Enhancing DNN Performance through Adaptive N: M Pruning across both Weight and Activation. | Sai Qian Zhang, Thierry Tambe, Gu-Yeon Wei, David Brooks |
| 2024 | NAACL | T3M: Text Guided 3D Human Motion Synthesis from Speech. | Wenshuo Peng, Kaipeng Zhang, Sai Qian Zhang |
| 2022 | AAAI | A Multi-Agent Reinforcement Learning Approach for Efficient Client Selection in Federated Learning. | Sai Qian Zhang, Jieyu Lin, Qi Zhang |
| 2022 | ECCV | SphereFed: Hyperspherical Federated Learning. | Xin Dong, Sai Qian Zhang, Ang Li, H. T. Kung |
| 2022 | HPCA | FAST: DNN Training Under Variable Precision Block Floating Point with Stochastic Rounding. | Sai Qian Zhang, Bradley McDanel, H. T. Kung |
| 2021 | ASPLOS | Training for multi-resolution inference using reusable quantization terms. | Sai Qian Zhang, Bradley McDanel, H. T. Kung, Xin Dong |
| 2021 | ISCAS | Saturation RRAM Leveraging Bit-Level Sparsity Resulting from Term Quantization. | Bradley McDanel, Sai Qian Zhang, H. T. Kung |
| 2020 | AAAI | RTN: Reparameterized Ternary Network. | Yuhang Li, Xin Dong, Sai Qian Zhang, Haoli Bai, Yuanpeng Chen, Wei Wang |
| 2020 | ICPP | Adaptive Distributed Convolutional Neural Network Inference at the Network Edge with ADCNN. | Sai Qian Zhang, Jieyu Lin, Qi Zhang |
| 2020 | SC | Term quantization: furthering quantization at run time. | Hsiang-Tsung Kung, Bradley McDanel, Sai Qian Zhang |
| 2020 | SP | On the Robustness of Cooperative Multi-Agent Reinforcement Learning. | Jieyu Lin, Kristina Dzeparoska, Sai Qian Zhang, Alberto Leon-Garcia, Nicolas Papernot |
| 2019 | ASPLOS | Packing Sparse Convolutional Neural Networks for Efficient Systolic Array Implementations: Column Combining Under Joint Optimization. | H. T. Kung, Bradley McDanel, Sai Qian Zhang |
| 2019 | ISCAS | Systolic Building Block for Logic-on-Logic 3D-IC Implementations of Convolutional Neural Networks. | H. T. Kung, Bradley McDanel, Sai Qian Zhang, C. T. Wang, Jin Cai, C. Y. Chen, Victor C. Y. Chang, M. F. Chen, Jack Yuan-Chen Sun, Douglas Yu |
| 2019 | ICS | Full-stack optimization for accelerating CNNs using powers-of-two weights with FPGA validation. | Bradley McDanel, Sai Qian Zhang, H. T. Kung, Xin Dong |
| 2018 | ICPR | Adaptive Tiling: Applying Fixed-size Systolic Arrays To Sparse Convolutional Neural Networks. | H. T. Kung, Bradley McDanel, Sai Qian Zhang |
| 2016 | NOMS | Joint NFV placement and routing for multicast service on SDN. | Sai Qian Zhang, Ali Tizghadam, Byungchul Park, Hadi Bannazadeh, Alberto Leon-Garcia |
| 2015 | ICDCS | Aurora: Adaptive Block Replication in Distributed File Systems. | Qi Zhang, Sai Qian Zhang, Alberto Leon-Garcia, Raouf Boutaba |
| 2015 | ICNP | Fast Network Flow Resumption for Live Virtual Machine Migration on SDN. | Sai Qian Zhang, Pouya Yasrebi, Ali Tizghadam, Hadi Bannazadeh, Alberto Leon-Garcia |
| 2015 | IM | Kaleidoscope: Real-time content delivery in software defined infrastructures. | Qi Zhang, Sai Qian Zhang, Jieyu Lin, Hadi Bannazadeh, Alberto Leon-Garcia |