| 2025 | ICLR | Accelerating neural network training: An analysis of the AlgoPerf competition. | Priya Kasimbeg, Frank Schneider, Runa Eschenhagen, Juhan Bae, Chandramouli Shama Sastry, Mark Saroufim, Boyuan Feng, Less Wright, Edward Z. Yang, Zachary Nado, Sourabh Medapati, Philipp Hennig, Michael Rabbat, George E. Dahl |
| 2025 | USENIX | GMI-DRL: Empowering Multi-GPU DRL with Adaptive-Grained Parallelism. | Yuke Wang, Boyuan Feng, Zheng Wang, Guyue Huang, Tony Tong Geng, Ang Li, Yufei Ding |
| 2024 | ASPLOS | ZENO: A Type-based Optimization Framework for Zero Knowledge Neural Network Inference. | Boyuan Feng, Zheng Wang, Yuke Wang, Shu Yang, Yufei Ding |
| 2024 | USENIX | OPER: Optimality-Guided Embedding Table Parallelization for Large-scale Recommendation Model. | Zheng Wang, Yuke Wang, Boyuan Feng, Guyue Huang, Dheevatsa Mudigere, Bharath Muthiah, Ang Li, Yufei Ding |
| 2023 | DSN | On Adversarial Robustness of Point Cloud Semantic Segmentation. | Jiacen Xu, Zhe Zhou, Boyuan Feng, Yufei Ding, Zhou Li |
| 2023 | OSDI | MGG: Accelerating Graph Neural Networks with Fine-Grained Intra-Kernel Communication-Computation Pipelining on Multi-GPU Platforms. | Yuke Wang, Boyuan Feng, Zheng Wang, Tong Geng, Kevin J. Barker, Ang Li, Yufei Ding |
| 2023 | USENIX | TC-GNN: Bridging Sparse GNN Computation and Dense Tensor Cores on GPUs. | Yuke Wang, Boyuan Feng, Zheng Wang, Guyue Huang, Yufei Ding |
| 2022 | PPoPP | QGTC: accelerating quantized graph neural networks via GPU tensor core. | Yuke Wang, Boyuan Feng, Yufei Ding |
| 2022 | SC | EL-Rec: Efficient Large-Scale Recommendation Model Training via Tensor-Train Embedding Table. | Zheng Wang, Yuke Wang, Boyuan Feng, Dheevatsa Mudigere, Bharath Muthiah, Yufei Ding |
| 2022 | USENIX | Faith: An Efficient Framework for Transformer Verification on GPUs. | Boyuan Feng, Tianqi Tang, Yuke Wang, Zhaodong Chen, Zheng Wang, Shu Yang, Yuan Xie, Yufei Ding |
| 2021 | AAAI | UAG: Uncertainty-aware Attention Graph Neural Network for Defending Adversarial Attacks. | Boyuan Feng, Yuke Wang, Yufei Ding |
| 2021 | CCGRID | TiAcc: Triangle-inequality based Hardware Accelerator for K-means on FPGAs. | Yuke Wang, Boyuan Feng, Gushu Li, Georgios Tzimpragos, Lei Deng, Yuan Xie, Yufei Ding |
| 2021 | CIKM | An Efficient Quantitative Approach for Optimizing Convolutional Neural Networks. | Yuke Wang, Boyuan Feng, Xueqiao Peng, Yufei Ding |
| 2021 | ICASSP | Saga: Sparse Adversarial Attack on EEG-Based Brain Computer Interface. | Boyuan Feng, Yuke Wang, Yufei Ding |
| 2021 | OSDI | GNNAdvisor: An Adaptive and Efficient Runtime System for GNN Acceleration on GPUs. | Yuke Wang, Boyuan Feng, Gushu Li, Shuangchen Li, Lei Deng, Yuan Xie, Yufei Ding |
| 2021 | PPoPP | EGEMM-TC: accelerating scientific computing on tensor cores with extended precision. | Boyuan Feng, Yuke Wang, Guoyang Chen, Weifeng Zhang, Yuan Xie, Yufei Ding |
| 2021 | SC | APNN-TC: accelerating arbitrary precision neural networks on ampere GPU tensor cores. | Boyuan Feng, Yuke Wang, Tong Geng, Ang Li, Yufei Ding |
| 2021 | USENIX | Palleon: A Runtime System for Efficient Video Processing toward Dynamic Class Skew. | Boyuan Feng, Yuke Wang, Gushu Li, Yuan Xie, Yufei Ding |
| 2020 | ICTAI | SGQuant: Squeezing the Last Bit on Graph Neural Networks with Specialized Quantization. | Boyuan Feng, Yuke Wang, Xu Li, Shu Yang, Xueqiao Peng, Yufei Ding |
| 2020 | NPC | A Close Look at Multi-tenant Parallel CNN Inference for Autonomous Driving. | Yitong Huang, Yu Zhang, Boyuan Feng, Xing Guo, Yanyong Zhang, Yufei Ding |
| 2019 | FCCM | KPynq: A Work-Efficient Triangle-Inequality Based K-Means on FPGA. | Yuke Wang, Zhaorui Zeng, Boyuan Feng, Lei Deng, Yufei Ding |
| 2019 | ICTAI | Reconciling Feature-Reuse and Overfitting in DenseNet with Specialized Dropout. | Kun Wan, Shu Yang, Boyuan Feng, Yufei Ding, Lingwei Xie |