| 2026 | AAAI | FusedRec: Fused Embedding Communication for Distributed Recommendation Training on GPUs. | Xuanteng Huang, Fan Li, Riyang Hu, Jianchang Zhang, Yuan Peng, Yang Zhou, Fangying Chen, Xianwei Zhang |
| 2026 | DATE | FedCM: Fine-grained Kernel Scheduling and Management to Improve GPU Sharing. | Xianwei Zhang, Xuanteng Huang, Nong Xiao |
| 2025 | ASPDAC | Mpache: Interaction Aware Multi-level Cache Bypassing on GPUs. | Mengyue Xi, Tianyu Guo, Xuanteng Huang, Zejia Lin, Xianwei Zhang |
| 2025 | DAC | PASK: Cold Start Mitigation for Inference with Proactive and Selective Kernel Loading on GPUs. | Xuanteng Huang, Jiangsu Du, Nong Xiao, XianWei Zhang |
| 2024 | DAC | SMILE: LLC-based Shared Memory Expansion to Improve GPU Thread Level Parallelism. | Tianyu Guo, Xuanteng Huang, Kan Wu, Xianwei Zhang, Nong Xiao |
| 2024 | IJCNN | openLG: A Tunable and Efficient Open-source LSTM on GPUs. | Zhaowen Shan, Xuanteng Huang, Zheng Zhou, Xianwei Zhang |
| 2023 | ICCD | KeSCo: Compiler-based Kernel Scheduling for Multi-task GPU Applications. | Zejia Lin, Zewei Mo, Xuanteng Huang, Xianwei Zhang, Yutong Lu |
| 2020 | ECCV | MINI-Net: Multiple Instance Ranking Network for Video Highlight Detection. | Fa-Ting Hong, Xuanteng Huang, Wei-Hong Li, Wei-Shi Zheng |