| 2025 | COLING | Enhancing One-Shot Pruned Pre-trained Language Models through Sparse-Dense-Sparse Mechanism. | Guanchen Li, Xiandong Zhao, Lian Liu, Zeping Li, Yixing Xu, Dong Li, Lu Tian, Jie He, Ashish Sirasao, Emad Barsoum |
| 2025 | ICML | BaWA: Automatic Optimizing Pruning Metric for Large Language Models with Balanced Weight and Activation. | Lian Liu, Xiandong Zhao, Guanchen Li, Dong Li, Mengdi Wang, Yinhe Han, Xiaowei Li, Ying Wang |
| 2020 | DAC | Towards State-Aware Computation in ReRAM Neural Networks. | Yintao He, Ying Wang, Xiandong Zhao, Huawei Li, Xiaowei Li |
| 2020 | DAC | RaQu: An automatic high-utilization CNN quantization and mapping framework for general-purpose RRAM Accelerator. | Songyun Qu, Bing Li, Ying Wang, Dawen Xu, Xiandong Zhao, Lei Zhang |
| 2020 | DAC | BitPruner: Network Pruning for Bit-serial Accelerators. | Xiandong Zhao, Ying Wang, Cheng Liu, Cong Shi, Kaijie Tu, Lei Zhang |
| 2020 | ICLR | Linear Symmetric Quantization of Neural Networks for Low-precision Integer Hardware. | Xiandong Zhao, Ying Wang, Xuyi Cai, Cheng Liu, Lei Zhang |