Skip to content

Sai Qian Zhang

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

42

Venues

26

Active years

2015–2026

Best venue rank

A*

Where they publish

Papers

42 indexed papers, newest first.

YearVenueTitleAuthors
2026ACLLipoAgent: Coordinating Fine-Tuned LLM Agents for Safer Lipid Design.Leshu Li, An Lu, Haiyu Wang, Zhibin Feng, Conghui Duan, Qing Bao, Zongmin Zhao, Sai Qian Zhang
2026ACLDREAM-S: Speculative Decoding with Searchable Drafting and Target-Aware Refinement for Multimodal Generation.Zining Liu, Yunhai Hu, Tianhua Xia, B. O. Bao, Eric Sather, Vithursan Thangarasa, Sai Qian Zhang
2026ASPLOSSegment Only Where You Look: Leveraging Human Gaze Behavior for Efficient Computer Vision Applications in Augmented Reality.Tianhua Xia, Haiyu Wang, Sai Qian Zhang
2026DATEFLAME: A Framework Exploring Execution Strategies for Multi-Cycle Operations in CGRA.Jiajun Qin, Cheng Tan, Ruihong Yin, Tianhua Xia, Sai Qian Zhang, Bei Yu
2026EACLLARA: LLM-based Agile Power Distribution Network Restoration from Disastrous Events.Jishnu Warrier, Heqing Huang, Yuzhang Lin, Sai Qian Zhang
2026ISCAECHO: Efficient Head-Orientation-Guided Real-Time Sound Spatialization for Virtual Reality.Haiyu Wang, Tianhua Xia, Sai Qian Zhang
2025ACLPipeSpec: Breaking Stage Dependencies in Hierarchical LLM Decoding.Bradley McDanel, Sai Qian Zhang, Yunhai Hu, Zining Liu
2025ASPDACH4H: Hybrid Convolution-Transformer Architecture Search for NPU-CIM Heterogeneous Systems for AR/VR Applications.Yiwei Zhao, Jinhui Chen, Sai Qian Zhang, Syed Shakib Sarwar, Kleber Hugo Stangherlin, Jorge Toms Gmez, Jae-Sun Seo, Barbara De Salvo, Chiao Liu, Phillip B. Gibbons, Ziyun Li
2025ASPLOSPICACHU: Plug-In CGRA Handling Upcoming Nonlinear Operations in LLMs.Jiajun Qin, Tianhua Xia, Cheng Tan, Jeff Zhang, Sai Qian Zhang
2025CVPRPETAH: Parameter Efficient Task Adaptation for Hybrid Transformers.Maximilian Augustin, Syed Shakib Sarwar, Mostafa Elhoushi, Yuecheng Li, Sai Qian Zhang, Barbara De Salvo
2025CVPRFoveated Instance Segmentation.Hongyi Zeng, Wenxuan Liu, Tianhua Xia, Jinhui Chen, Ziyun Li, Sai Qian Zhang
2025DATEHAAN: A Holistic Approach for Accelerating Normalization Operations in Large Language Models.Tianfan Peng, Tianhua Xia, Jiajun Qin, Sai Qian Zhang
2025EMNLPMitigating Sequential Dependencies: A Survey of Algorithms and Systems for Generation-Refinement Frameworks in Autoregressive Models.Yunhai Hu, Zining Liu, Zhenyuan Dong, Tianfan Peng, Bradley McDanel, Sai Qian Zhang
2025ICIPDFT Gaze: Distilled and Fine-Tuned Gaze Estimation for Personalization on Tiny Devices.He-Yen Hsieh, Ziyun Li, Sai Qian Zhang, Wei-Te Mark Ting, Kao-Den Chang, Barbara De Salvo, Chiao Liu, H. T. Kung
2025ISCAProcess Only Where You Look: Hardware and Algorithm Co-optimization for Efficient Gaze-Tracked Foveated Rendering in Virtual Reality.Haiyu Wang, Wenxuan Liu, Kenneth Chen, Qi Sun, Sai Qian Zhang
2025ISCASFrameVoting: A Robust and Fast Method of Using Gaze Estimations to Identify Objects of Interest.Kao-Den Chang, He-Yen Hsieh, H. T. Kung, Ziyun Li, Sai Qian Zhang
2025ICSA3FR: Agile 3D Gaussian Splatting with Incremental Gaze Tracked Foveated Rendering in Virtual Reality.Shuo Xin, Haiyu Wang, Sai Qian Zhang
2025MICROKelle: Co-design KV Caching and eDRAM for Efficient LLM Serving in Edge Computing.Tianhua Xia, Sai Qian Zhang
2025WACVDiTAS: Quantizing Diffusion Transformers via Enhanced Activation Smoothing.Zhenyuan Dong, Sai Qian Zhang
2024EMNLPDLoRA: Distributed Parameter-Efficient Fine-Tuning Solution for Large Language Model.Chao Gao, Sai Qian Zhang
2024HPCACAMEL: Co-Designing AI Models and eDRAMs for Efficient On-Device Learning.Sai Qian Zhang, Thierry Tambe, Nestor Cuevas, Gu-Yeon Wei, David Brooks
2024ICPPMurmuration: On-the-fly DNN Adaptation for SLO-Aware Distributed Inference in Dynamic Edge Environments.Jieyu Lin, Minghao Li, Sai Qian Zhang, Alberto Leon-Garcia
2024ISLPEDHyft: A Reconfigurable Softmax Accelerator with Hybrid Numeric Format for both Training and Inference.Tianhua Xia, Sai Qian Zhang
2024ISLPEDJointNF: Enhancing DNN Performance through Adaptive N: M Pruning across both Weight and Activation.Sai Qian Zhang, Thierry Tambe, Gu-Yeon Wei, David Brooks
2024NAACLT3M: Text Guided 3D Human Motion Synthesis from Speech.Wenshuo Peng, Kaipeng Zhang, Sai Qian Zhang
2022AAAIA Multi-Agent Reinforcement Learning Approach for Efficient Client Selection in Federated Learning.Sai Qian Zhang, Jieyu Lin, Qi Zhang
2022ECCVSphereFed: Hyperspherical Federated Learning.Xin Dong, Sai Qian Zhang, Ang Li, H. T. Kung
2022HPCAFAST: DNN Training Under Variable Precision Block Floating Point with Stochastic Rounding.Sai Qian Zhang, Bradley McDanel, H. T. Kung
2021ASPLOSTraining for multi-resolution inference using reusable quantization terms.Sai Qian Zhang, Bradley McDanel, H. T. Kung, Xin Dong
2021ISCASSaturation RRAM Leveraging Bit-Level Sparsity Resulting from Term Quantization.Bradley McDanel, Sai Qian Zhang, H. T. Kung
2020AAAIRTN: Reparameterized Ternary Network.Yuhang Li, Xin Dong, Sai Qian Zhang, Haoli Bai, Yuanpeng Chen, Wei Wang
2020ICPPAdaptive Distributed Convolutional Neural Network Inference at the Network Edge with ADCNN.Sai Qian Zhang, Jieyu Lin, Qi Zhang
2020SCTerm quantization: furthering quantization at run time.Hsiang-Tsung Kung, Bradley McDanel, Sai Qian Zhang
2020SPOn the Robustness of Cooperative Multi-Agent Reinforcement Learning.Jieyu Lin, Kristina Dzeparoska, Sai Qian Zhang, Alberto Leon-Garcia, Nicolas Papernot
2019ASPLOSPacking Sparse Convolutional Neural Networks for Efficient Systolic Array Implementations: Column Combining Under Joint Optimization.H. T. Kung, Bradley McDanel, Sai Qian Zhang
2019ISCASSystolic Building Block for Logic-on-Logic 3D-IC Implementations of Convolutional Neural Networks.H. T. Kung, Bradley McDanel, Sai Qian Zhang, C. T. Wang, Jin Cai, C. Y. Chen, Victor C. Y. Chang, M. F. Chen, Jack Yuan-Chen Sun, Douglas Yu
2019ICSFull-stack optimization for accelerating CNNs using powers-of-two weights with FPGA validation.Bradley McDanel, Sai Qian Zhang, H. T. Kung, Xin Dong
2018ICPRAdaptive Tiling: Applying Fixed-size Systolic Arrays To Sparse Convolutional Neural Networks.H. T. Kung, Bradley McDanel, Sai Qian Zhang
2016NOMSJoint NFV placement and routing for multicast service on SDN.Sai Qian Zhang, Ali Tizghadam, Byungchul Park, Hadi Bannazadeh, Alberto Leon-Garcia
2015ICDCSAurora: Adaptive Block Replication in Distributed File Systems.Qi Zhang, Sai Qian Zhang, Alberto Leon-Garcia, Raouf Boutaba
2015ICNPFast Network Flow Resumption for Live Virtual Machine Migration on SDN.Sai Qian Zhang, Pouya Yasrebi, Ali Tizghadam, Hadi Bannazadeh, Alberto Leon-Garcia
2015IMKaleidoscope: Real-time content delivery in software defined infrastructures.Qi Zhang, Sai Qian Zhang, Jieyu Lin, Hadi Bannazadeh, Alberto Leon-Garcia