| 2026 | ACL | AutoL2S: Auto Long-Short Reasoning for Efficient Large Language Models. | Feng Luo, Yu-Neng Chuang, Guanchu Wang, Hoang Anh Duy Le, Shaochen Zhong, Hongyi Liu, Jiayi Yuan, Yang Sui, Vladimir Braverman, Vipin Chaudhary, Xia Ben Hu |
| 2025 | ASPDAC | iTAP: An Incremental Task Graph Partitioner for Task-parallel Static Timing Analysis. | Boyang Zhang, Che Chang, Cheng-Hsiang Chiu, Dian-Lun Lin, Yang Sui, Chih-Chun Chang, Yi-Hua Chung, Wan-Luan Lee, Zizheng Guo, Yibo Lin, Tsung-Wei Huang |
| 2025 | CVPR | DyCoke: Dynamic Compression of Tokens for Fast Video Large Language Models. | Keda Tao, Can Qin, Haoxuan You, Yang Sui, Huan Wang |
| 2025 | CVPR | SnapGen-V: Generating a Five-Second Video within Five Seconds on a Mobile Device. | Yushu Wu, Zhixing Zhang, Yanyu Li, Yanwu Xu, Anil Kag, Yang Sui, Huseyin Coskun, Ke Ma, Aleksei Lebedev, Ju Hu, Dimitris N. Metaxas, Yanzhi Wang, Sergey Tulyakov, Jian Ren |
| 2025 | CVPR | TopV: Compatible Token Pruning with Inference Time Optimization for Fast and Low-Memory Multimodal Vision Language Model. | Cheng Yang, Yang Sui, Jinqi Xiao, Lingyi Huang, Yu Gong, Chendi Li, Jinghua Yan, Yu Bai, Ponnuswamy Sadayappan, Xia Hu, Bo Yuan |
| 2024 | BMVC | Transferable Learned Image Compression-Resistant Adversarial Perturbations. | Yang Sui, Zhuohang Li, Ding Ding, Xiang Pan, Xiaozhong Xu, Shan Liu, Zhenzhong Chen |
| 2024 | DAC | Invited: Algorithm and Hardware Co-Design for Energy-Efficient Neural SLAM. | Lingyi Huang, Cheng Yang, Yu Gong, Yang Sui, Xiao Zang, Anthony Goeckner, Qi Zhu, Bo Yuan |
| 2024 | DCC | Transferable Learned Image Compression-Resistant Adversarial Perturbations. | Yang Sui, Zhuohang Li, Ding Ding, Xiang Pan, Xiaozhong Xu, Shan Liu, Zhenzhong Chen |
| 2024 | DCC | Reconstruction Distortion of Learned Image Compression with Imperceptible Perturbations. | Yang Sui, Zhuohang Li, Ding Ding, Xiang Pan, Xiaozhong Xu, Shan Liu, Zhenzhong Chen |
| 2024 | ECCV | Clean and Compact: Efficient Data-Free Backdoor Defense with Model Compactness. | Huy Phan, Jinqi Xiao, Yang Sui, Tianfang Zhang, Zijie Tang, Cong Shi, Yan Wang, Yingying Chen, Bo Yuan |
| 2024 | EMNLP | MoE-I²: Compressing Mixture of Experts Models through Inter-Expert Pruning and Intra-Expert Low-Rank Decomposition. | Cheng Yang, Yang Sui, Jinqi Xiao, Lingyi Huang, Yu Gong, Yuanlin Duan, Wenqi Jia, Miao Yin, Yu Cheng, Bo Yuan |
| 2024 | HPCA | MOPED: Efficient Motion Planning Engine with Flexible Dimension Support. | Lingyi Huang, Yu Gong, Yang Sui, Xiao Zang, Bo Yuan |
| 2024 | ICML | Combining Experimental and Historical Data for Policy Evaluation. | Ting Li, Chengchun Shi, Qianglin Wen, Yang Sui, Yongli Qin, Chunbo Lai, Hongtu Zhu |
| 2023 | AAAI | CSTAR: Towards Compact and Structured Deep Neural Networks with Adversarial Robustness. | Huy Phan, Miao Yin, Yang Sui, Bo Yuan, Saman A. Zonouz |
| 2023 | AAAI | HALOC: Hardware-Aware Automatic Low-Rank Compression for Compact Neural Networks. | Jinqi Xiao, Chengming Zhang, Yu Gong, Miao Yin, Yang Sui, Lizhi Xiang, Dingwen Tao, Bo Yuan |
| 2023 | DAC | DSPIMM: A Fully Digital SParse In-Memory Matrix Vector Multiplier for Communication Applications. | Amitesh Sridharan, Fan Zhang, Yang Sui, Bo Yuan, Deliang Fan |
| 2023 | ICCAD | Invited Paper: In-Sensor Radio Frequency Computing for Energy-Efficient Intelligent Radar. | Yang Sui, Minning Zhu, Lingyi Huang, Chung-Tse Michael Wu, Bo Yuan |
| 2023 | ICML | Adversarial Learning of Distributional Reinforcement Learning. | Yang Sui, Yukun Huang, Hongtu Zhu, Fan Zhou |
| 2023 | IROS | DynGMP: Graph Neural Network-Based Motion Planning in Unpredictable Dynamic Environments. | Wenjin Zhang, Xiao Zang, Lingyi Huang, Yang Sui, Jingjin Yu, Yingying Chen, Bo Yuan |
| 2023 | ISCA | ETTE: Efficient Tensor-Train-based Computing Engine for Deep Neural Networks. | Yu Gong, Miao Yin, Lingyi Huang, Jinqi Xiao, Yang Sui, Chunhua Deng, Bo Yuan |
| 2023 | SIGCOMM | Learning-based Homography Matrix Optimization for Dual-fisheye Video Stitching. | Mufeng Zhu, Yang Sui, Bo Yuan, Yao Liu |
| 2022 | CVPR | HODEC: Towards Efficient High-Order DEcomposed Convolutional Neural Networks. | Miao Yin, Yang Sui, Wanzhao Yang, Xiao Zang, Yu Gong, Bo Yuan |
| 2021 | CVPR | Towards Efficient Tensor Decomposition-Based DNN Model Compression With Optimization Framework. | Miao Yin, Yang Sui, Siyu Liao, Bo Yuan |
| 2021 | ICCAD | Algorithm and Hardware Co-design for Deep Learning-powered Channel Decoder: A Case Study. | Boyang Zhang, Yang Sui, Lingyi Huang, Siyu Liao, Chunhua Deng, Bo Yuan |
| 2021 | ISCA | GoSPA: An Energy-efficient High-performance Globally Optimized SParse Convolutional Neural Network Accelerator. | Chunhua Deng, Yang Sui, Siyu Liao, Xuehai Qian, Bo Yuan |