| 2025 | AAAI | Pruning Large Language Models with Semi-Structural Adaptive Sparse Training. | Weiyu Huang, Yuezhou Hu, Guohao Jian, Jun Zhu, Jianfei Chen |
| 2025 | ICCV | Task-Specific Zero-Shot Quantization-Aware Training for Object Detection. | Changhao Li, Xinrui Chen, Ji Wang, Kang Zhao, Jianfei Chen |
| 2025 | ICLR | On the Optimization and Generalization of Two-layer Transformers with Sign Gradient Descent. | Bingrui Li, Wei Huang, Andi Han, Zhanpeng Zhou, Taiji Suzuki, Jun Zhu, Jianfei Chen |
| 2025 | ICLR | ReMoE: Fully Differentiable Mixture-of-Experts with ReLU Routing. | Ziteng Wang, Jun Zhu, Jianfei Chen |
| 2025 | ICLR | COAT: Compressing Optimizer states and Activations for Memory-Efficient FP8 Training. | Haocheng Xi, Han Cai, Ligeng Zhu, Yao Lu, Kurt Keutzer, Jianfei Chen, Song Han |
| 2025 | ICLR | SageAttention: Accurate 8-Bit Attention for Plug-and-play Inference Acceleration. | Jintao Zhang, Jia Wei, Pengle Zhang, Jun Zhu, Jianfei Chen |
| 2025 | ICLR | Elucidating the Preconditioning in Consistency Distillation. | Kaiwen Zheng, Guande He, Jianfei Chen, Fan Bao, Jun Zhu |
| 2025 | ICLR | Diffusion Bridge Implicit Models. | Kaiwen Zheng, Guande He, Jianfei Chen, Fan Bao, Jun Zhu |
| 2025 | ICML | Visual Generation Without Guidance. | Huayu Chen, Kai Jiang, Kaiwen Zheng, Jianfei Chen, Hang Su, Jun Zhu |
| 2025 | ICML | Oscillation-Reduced MXFP4 Training for Vision Transformers. | Yuxiang Chen, Haocheng Xi, Jun Zhu, Jianfei Chen |
| 2025 | ICML | FrameBridge: Improving Image-to-Video Generation with Bridge Models. | Yuji Wang, Zehua Chen, Xiaoyu Chen, Yixiang Wei, Jun Zhu, Jianfei Chen |
| 2025 | ICML | Sparse Video-Gen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity. | Haocheng Xi, Shuo Yang, Yilong Zhao, Chenfeng Xu, Muyang Li, Xiuyu Li, Yujun Lin, Han Cai, Jintao Zhang, Dacheng Li, Jianfei Chen, Ion Stoica, Kurt Keutzer, Song Han |
| 2025 | ICML | SageAttention2: Efficient Attention with Thorough Outlier Smoothing and Per-thread INT4 Quantization. | Jintao Zhang, Haofeng Huang, Pengle Zhang, Jia Wei, Jun Zhu, Jianfei Chen |
| 2025 | ICML | SpargeAttention: Accurate and Training-free Sparse Attention Accelerating Any Model Inference. | Jintao Zhang, Chendong Xiang, Haofeng Huang, Jia Wei, Haocheng Xi, Jun Zhu, Jianfei Chen |
| 2024 | ICLR | Efficient Backpropagation with Variance Controlled Adaptive Sampling. | Ziteng Wang, Jianfei Chen, Jun Zhu |
| 2024 | ICML | Accelerating Transformer Pre-training with 2: 4 Sparsity. | Yuezhou Hu, Kang Zhao, Weiyu Huang, Jianfei Chen, Jun Zhu |
| 2024 | ICML | Jetfire: Efficient and Accurate Transformer Pretraining with INT8 Data Flow and Per-Block Quantization. | Haocheng Xi, Yuxiang Chen, Kang Zhao, Kai Jun Teh, Jianfei Chen, Jun Zhu |
| 2023 | ICLR | Preserving Pre-trained Features Helps Calibrate Fine-tuned Language Models. | Guande He, Jianfei Chen, Jun Zhu |
| 2023 | ICML | Contrastive Energy Prediction for Exact Energy-Guided Diffusion Sampling in Offline Reinforcement Learning. | Cheng Lu, Huayu Chen, Jianfei Chen, Hang Su, Chongxuan Li, Jun Zhu |
| 2023 | ICML | Stabilizing GANs' Training with Brownian Motion Controller. | Tianjiao Luo, Ziyu Zhu, Jianfei Chen, Jun Zhu |
| 2023 | ICML | Improved Techniques for Maximum Likelihood Estimation for Diffusion ODEs. | Kaiwen Zheng, Cheng Lu, Jianfei Chen, Jun Zhu |
| 2022 | ICML | GACT: Activation Compressed Training for Generic Network Architectures. | Xiaoxuan Liu, Lianmin Zheng, Dequan Wang, Yukuo Cen, Weize Chen, Xu Han, Jianfei Chen, Zhiyuan Liu, Jie Tang, Joey Gonzalez, Michael W. Mahoney, Alvin Cheung |
| 2022 | ICML | Maximum Likelihood Training for Score-based Diffusion ODEs by High Order Denoising Score Matching. | Cheng Lu, Kaiwen Zheng, Fan Bao, Jianfei Chen, Chongxuan Li, Jun Zhu |
| 2022 | ICML | Fast Lossless Neural Compression with Integer-Only Discrete Flows. | Siyu Wang, Jianfei Chen, Chongxuan Li, Jun Zhu, Bo Zhang |
| 2021 | ICLR | Implicit Normalizing Flows. | Cheng Lu, Jianfei Chen, Chongxuan Li, Qiuhao Wang, Jun Zhu |
| 2021 | ICML | ActNN: Reducing Training Memory Footprint via 2-Bit Activation Compressed Training. | Jianfei Chen, Lianmin Zheng, Zhewei Yao, Dequan Wang, Ion Stoica, Michael W. Mahoney, Joseph Gonzalez |
| 2021 | IECON | Experimental Comparison of High-Power Soft-Switching Boost Converters with Auxiliary Switches. | Minh-Khai Nguyen, Nima Abdolmaleki, Jianfei Chen, Caisheng Wang, Zhigang Yao, Shilei Zhou, Jiaoke Zheng |
| 2020 | ICML | VFlow: More Expressive Generative Flows with Variational Data Augmentation. | Jianfei Chen, Cheng Lu, Biqi Chenli, Jun Zhu, Tian Tian |
| 2019 | ISI | Role-based Static Desensitization Protection Method. | Tan Hu State, Jianfei Chen, Wenting Wang, Hao Zhang |
| 2018 | AAAI | Towards Training Probabilistic Topic Models on Neuromorphic Multi-Chip Systems. | Zihao Xiao, Jianfei Chen, Jun Zhu |
| 2018 | ICML | Stochastic Training of Graph Convolutional Networks with Variance Reduction. | Jianfei Chen, Jun Zhu, Le Song |
| 2018 | IECON | Detroit Rectifier. | Jianfei Chen, Caisheng Wang |
| 2018 | IECON | Nine-Switch Detroit Rectifier. | Jianfei Chen, Caisheng Wang, Chen Duan, Chenguang Jiang |
| 2018 | IECON | Hybrid Detroit Rectifier. | Jianfei Chen, Caisheng Wang, Jian Li |
| 2017 | ASPLOS | SaberLDA: Sparsity-Aware Learning of Topic Models on GPUs. | Kaiwei Li, Jianfei Chen, Wenguang Chen, Jun Zhu |
| 2016 | ICPADS | Game Theoretic Energy Allocation for Renewable Powered In-Situ Server Systems. | Junlong Zhou, Jianfei Chen, Kun Cao, Tongquan Wei, Mingsong Chen |
| 2016 | KDD | Distributing the Stochastic Gradient Sampler for Large-Scale LDA. | Yuan Yang, Jianfei Chen, Jun Zhu |
| 2016 | WWW | Scaling up Dynamic Topic Models. | Arnab Bhadury, Jianfei Chen, Jun Zhu, Shixia Liu |
| 2014 | AAAI | Dropout Training for Support Vector Machines. | Ning Chen, Jun Zhu, Jianfei Chen, Bo Zhang |
| 2014 | ICML | Bayesian Max-margin Multi-Task Learning with Data Augmentation. | Chengtao Li, Jun Zhu, Jianfei Chen |