| 2026 | NSDI | Di-PS: System-Algorithm Co-Design for Asynchronous and Heterogeneous Cross-cluster LLM Training at Scale. | Shengwei Li, Qiaoling Chen, Zhiquan Lai, Penglong Jiao, Wenwen Qu, Kun Cai, Jiaxing Li, Peng Sun, Xingcheng Zhang, Xiaoge Deng, Dongsheng Li, Kai Lu, Tianwei Zhang |
| 2025 | ICASSP | Sharpness-Aware Minimization with Adaptive Regularization for Training Deep Neural Networks. | Jinping Zou, Xiaoge Deng, Tao Sun |
| 2024 | IJCAI | Exploring the Inefficiency of Heavy Ball as Momentum Parameter Approaches 1. | Xiaoge Deng, Tao Sun, Dongsheng Li, Xicheng Lu |
| 2023 | AAAI | Stability-Based Generalization Analysis of the Asynchronous Decentralized SGD. | Xiaoge Deng, Tao Sun, Shengwei Li, Dongsheng Li |
| 2023 | ECAI | Normalized Stochastic Heavy Ball with Adaptive Momentum. | Ziqing Wen, Xiaoge Deng, Tao Sun, Dongsheng Li |
| 2022 | ICASSP | S2 Reducer: High-Performance Sparse Communication to Accelerate Distributed Deep Learning. | Keshi Ge, Yongquan Fu, Yiming Zhang, Zhiquan Lai, Xiaoge Deng, Dongsheng Li |
| 2021 | CLUSTER | CASQ: Accelerate Distributed Deep Learning with Sketch-Based Gradient Quantization. | Keshi Ge, Yiming Zhang, Yongquan Fu, Zhiquan Lai, Xiaoge Deng, Dongsheng Li |
| 2020 | ICA3PP | PRIAG: Proximal Reweighted Incremental Aggregated Gradient Algorithm for Distributed Optimizations. | Xiaoge Deng, Tao Sun, Feng Liu, Feng Huang |