| 2026 | ASPLOS | iSwitch: QEC on Demand via In-Situ Encoding of Bare Qubits for Ion Trap Architectures. | Keyi Yin, Xiang Fang, Zhuo Chen, David Hayes, Eneet Kaur, Reza Nejabati, Hartmut Haeffner, Wes Campbell, Eric R. Hudson, Jens Palsberg, Travis S. Humble, Yufei Ding |
| 2026 | CGO | Proton: Towards Multi-level, Adaptive Profiling for Triton. | Keren Zhou, Tianle Zhong, Hao Wu, Jihyeong Lee, Yue Guan, Yufei Ding, Corbin Robeck, Yuanwei Fang, Jeff Niu, Philippe Tillet |
| 2026 | HPCA | SFD: Towards Segment Fusion Dataflow for Spatial Accelerators. | Fuyu Wang, Minghua Shen, Yufei Ding, Nong Xiao, Yutong Lu |
| 2026 | ISCA | Reducing Page Faults via Invalidation-Based Mapping Propagation in Multi-GPU Systems. | Junsung Kim, Dongho Ha, Sungwoo Kim, Wonho Cho, Sungbin Kim, Yufei Ding, Won Woo Ro |
| 2026 | ISCA | Transpiler-Architecture Co-Design to Curb Clifford Costs in Fault-Tolerant Quantum Computing. | Meng Wang, Chenxu Liu, Samuel A. Stein, Yufei Ding, Poulami Das, Prashant J. Nair, Ang Li |
| 2026 | ISCA | Patterns Behind Chaos: Forecasting Data Movement for Efficient Large-Scale Moe LLM Inference. | Zhongkai Yu, Yue Guan, Zihao Yu, Chenyang Zhou, Zhengding Hu, Shuyi Pei, Yangwook Kang, Yufei Ding, Po-An Tsai |
| 2025 | ASPLOS | PowerMove: Optimizing Compilation for Neutral Atom Quantum Computers with Zoned Architecture. | Jixuan Ruan, Xiang Fang, Hezi Zhang, Ang Li, Travis S. Humble, Yufei Ding |
| 2025 | ASPLOS | HetEC: Architectures for Heterogeneous Quantum Error Correction Codes. | Samuel A. Stein, Shifan Xu, Andrew W. Cross, Theodore J. Yoder, Ali Javadi-Abhari, Chenxu Liu, Kun Liu, Zeyuan Zhou, Charlie Guinn, Yufei Ding, Yongshan Ding, Ang Li |
| 2025 | ASPLOS | QECC-Synth: A Layout Synthesizer for Quantum Error Correction Codes on Sparse Architectures. | Keyi Yin, Hezi Zhang, Xiang Fang, Yunong Shi, Travis S. Humble, Ang Li, Yufei Ding |
| 2025 | HPCA | Push Multicast: A Speculative and Coherent Interconnect for Mitigating Manycore CPU Communication Bottleneck. | Jiayi Huang, Yanhua Chen, Zhe Wang, Christopher J. Hughes, Yufei Ding, Yuan Xie |
| 2025 | ICLR | Mutual Effort for Efficiency: A Similarity-based Token Pruning for Vision Transformers in Self-Supervised Learning. | Sheng Li, Qitao Tan, Yue Dai, Zhenglun Kong, Tianyu Wang, Jun Liu, Ao Li, Ninghao Liu, Yufei Ding, Xulong Tang, Geng Yuan |
| 2025 | ISCA | CaliQEC: In-situ Qubit Calibration for Surface Code Quantum Error Correction. | Xiang Fang, Keyi Yin, Yuchen Zhu, Jixuan Ruan, Dean Tullsen, Zhiding Liang, Andrew Sornborger, Ang Li, Travis S. Humble, Yufei Ding, Yunong Shi |
| 2025 | ISCA | TRACI: Network Acceleration of Input-Dynamic Communication for Large-Scale Deep Learning Recommendation Model. | Guyue Huang, Hao Li, Le Qin, Jiayi Huang, Yangwook Kang, Yufei Ding, Yuan Xie |
| 2025 | ISCA | SwitchQNet: Optimizing Distributed Quantum Computing for Quantum Data Centers with Switch Networks. | Hezi Zhang, Yiran Xu, Haotian Hu, Keyi Yin, Hassan Shapourian, Jiapeng Zhao, Ramana Rao Kompella, Reza Nejabati, Yufei Ding |
| 2025 | ISCA | Hardware-aware Calibration Protocol for Quantum Computers. | Yuchen Zhu, Jinglei Cheng, Boxi Li, Kecheng Liu, Yidong Zhou, Hanrui Wang, Yufei Ding, Zhiding Liang |
| 2025 | MICRO | OneAdapt: Resource-Adaptive Compilation of Measurement-Based Quantum Computing for Photonic Hardware. | Hezi Zhang, Jixuan Ruan, Dean Tullsen, Yufei Ding, Ang Li, Travis S. Humble |
| 2025 | OSDI | WLB-LLM: Workload-Balanced 4D Parallelism for Large Language Model Training. | Zheng Wang, Anna Cai, Xinfeng Xie, Zaifeng Pan, Yue Guan, Weiwei Chu, Jie Wang, Shikai Li, Jianyu Huang, Chris Cai, Yuchen Hao, Yufei Ding |
| 2025 | OSDI | KPerfIR: Towards a Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads. | Yue Guan, Yuanwei Fang, Keren Zhou, Corbin Robeck, Manman Ren, Zhongkai Yu, Yufei Ding, Adnan Aziz |
| 2025 | USENIX | GMI-DRL: Empowering Multi-GPU DRL with Adaptive-Grained Parallelism. | Yuke Wang, Boyuan Feng, Zheng Wang, Guyue Huang, Tony Tong Geng, Ang Li, Yufei Ding |
| 2025 | SOSP | Mercury: Unlocking Multi-GPU Operator Optimization for LLMs via Remote Memory Scheduling. | Yue Guan, Xinwei Qiang, Zaifeng Pan, Daniels Johnson, Yuanwei Fang, Keren Zhou, Yuke Wang, Wanlu Li, Yufei Ding, Adnan Aziz |
| 2025 | SOSP | HedraRAG: Co-Optimizing Generation and Retrieval for Heterogeneous RAG Workflows. | Zhengding Hu, Vibha Murthy, Zaifeng Pan, Wanlu Li, Xiaoyi Fang, Yufei Ding, Yuke Wang |
| 2024 | ASPLOS | EVT: Accelerating Deep Learning Training with Epilogue Visitor Tree. | Zhaodong Chen, Andrew Kerr, Richard Cai, Jack Kosaian, Haicheng Wu, Yufei Ding, Yuan Xie |
| 2024 | ASPLOS | ZENO: A Type-based Optimization Framework for Zero Knowledge Neural Network Inference. | Boyuan Feng, Zheng Wang, Yuke Wang, Shu Yang, Yufei Ding |
| 2024 | ASPLOS | RAP: Resource-aware Automated GPU Sharing for Multi-GPU Recommendation Model Training and Input Preprocessing. | Zheng Wang, Yuke Wang, Jiaqi Deng, Da Zheng, Ang Li, Yufei Ding |
| 2024 | ASPLOS | OnePerc: A Randomness-aware Compiler for Photonic Quantum Computing. | Hezi Zhang, Jixuan Ruan, Hassan Shapourian, Ramana Rao Kompella, Yufei Ding |
| 2024 | ASPLOS | MECH: Multi-Entry Communication Highway for Superconducting Quantum Chiplets. | Hezi Zhang, Keyi Yin, Anbang Wu, Hassan Shapourian, Alireza Shabani, Yufei Ding |
| 2024 | CoRL | DexGraspNet 2.0: Learning Generative Dexterous Grasping in Large-scale Synthetic Cluttered Scenes. | Jialiang Zhang, Haoran Liu, Danshi Li, Xinqiang Yu, Haoran Geng, Yufei Ding, Jiayi Chen, He Wang |
| 2024 | IROS | Open6DOR: Benchmarking Open-instruction 6-DoF Object Rearrangement and A VLM-based Approach. | Yufei Ding, Haoran Geng, Chaoyi Xu, Xiaomeng Fang, Jiazhao Zhang, Songlin Wei, Qiyu Dai, Zhizheng Zhang, He Wang |
| 2024 | ISCA | Soter: Analytical Tensor-Architecture Modeling and Automatic Tensor Program Tuning for Spatial Accelerators. | Fuyu Wang, Minghua Shen, Yufei Ding, Nong Xiao |
| 2024 | MICRO | Surf-Deformer: Mitigating Dynamic Defects on Surface Code via Adaptive Deformation. | Keyi Yin, Xiang Fang, Travis S. Humble, Ang Li, Yunong Shi, Yufei Ding |
| 2024 | SC | RecFlex: Enabling Feature Heterogeneity-Aware Optimization for Deep Recommendation Models with Flexible Schedules. | Zaifeng Pan, Zhen Zheng, Feng Zhang, Bing Xie, Ruofan Wu, Shaden Smith, Chuanjie Liu, Olatunji Ruwase, Xiaoyong Du, Yufei Ding |
| 2024 | USENIX | OPER: Optimality-Guided Embedding Table Parallelization for Large-scale Recommendation Model. | Zheng Wang, Yuke Wang, Boyuan Feng, Guyue Huang, Dheevatsa Mudigere, Bharath Muthiah, Ang Li, Yufei Ding |
| 2023 | DSN | On Adversarial Robustness of Point Cloud Semantic Segmentation. | Jiacen Xu, Zhe Zhou, Boyuan Feng, Yufei Ding, Zhou Li |
| 2023 | ISCA | ECSSD: Hardware/Data Layout Co-Designed In-Storage-Computing Architecture for Extreme Classification. | Siqi Li, Fengbin Tu, Liu Liu, Jilan Lin, Zheng Wang, Yangwook Kang, Yufei Ding, Yuan Xie |
| 2023 | ISCA | Q-BEEP: Quantum Bayesian Error Mitigation Employing Poisson Modeling over the Hamming Spectrum. | Samuel A. Stein, Nathan Wiebe, Yufei Ding, James Ang, Ang Li |
| 2023 | ISCA | OneQ: A Compilation Framework for Photonic One-Way Quantum Computation. | Hezi Zhang, Anbang Wu, Yuke Wang, Gushu Li, Hassan Shapourian, Alireza Shabani, Yufei Ding |
| 2023 | MICRO | RM-STC: Row-Merge Dataflow Inspired GPU Sparse Tensor Core for Energy-Efficient Sparse Acceleration. | Guyue Huang, Zhengyang Wang, Po-An Tsai, Chen Zhang, Yufei Ding, Yuan Xie |
| 2023 | MICRO | QuComm: Optimizing Collective Communication for Distributed Quantum Computing. | Anbang Wu, Yufei Ding, Ang Li |
| 2023 | OSDI | MGG: Accelerating Graph Neural Networks with Fine-Grained Intra-Kernel Communication-Computation Pipelining on Multi-GPU Platforms. | Yuke Wang, Boyuan Feng, Zheng Wang, Tong Geng, Kevin J. Barker, Ang Li, Yufei Ding |
| 2023 | PPoPP | Dynamic N: M Fine-Grained Structured Sparse Attention Mechanism. | Zhaodong Chen, Zheng Qu, Yuying Quan, Liu Liu, Yufei Ding, Yuan Xie |
| 2023 | SC | QASMTrans: A QASM Quantum Transpiler Framework for NISQ Devices. | Fei Hua, Meng Wang, Gushu Li, Bo Peng, Chenxu Liu, Muqing Zheng, Samuel A. Stein, Yufei Ding, Eddy Z. Zhang, Travis S. Humble, Ang Li |
| 2023 | USENIX | TC-GNN: Bridging Sparse GNN Computation and Dense Tensor Cores on GPUs. | Yuke Wang, Boyuan Feng, Zheng Wang, Guyue Huang, Yufei Ding |
| 2022 | ASPLOS | Paulihedral: a generalized block-wise compiler optimization framework for Quantum simulation kernels. | Gushu Li, Anbang Wu, Yunong Shi, Ali Javadi-Abhari, Yufei Ding, Yuan Xie |
| 2022 | ASPLOS | DOTA: detect and omit weak attentions for scalable transformer acceleration. | Zheng Qu, Liu Liu, Fengbin Tu, Zhaodong Chen, Yufei Ding, Yuan Xie |
| 2022 | DAC | Heuristic adaptability to input dynamics for SpMM on CPUs. | Guohao Dai, Guyue Huang, Shang Yang, Zhongming Yu, Hengrui Zhang, Yufei Ding, Yuan Xie, Huazhong Yang, Yu Wang |
| 2022 | DAC | Shfl-BW: accelerating deep neural network inference with tensor-core aware weight pruning. | Guyue Huang, Haoran Li, Minghai Qin, Fei Sun, Yufei Ding, Yuan Xie |
| 2022 | ISCA | INSPIRE: in-storage private information retrieval via protocol and architecture co-design. | Jilan Lin, Ling Liang, Zheng Qu, Ishtiyaque Ahmad, Liu Liu, Fengbin Tu, Trinabh Gupta, Yufei Ding, Yuan Xie |
| 2022 | ISCA | EQC: ensembled quantum computing for variational quantum algorithms. | Samuel A. Stein, Nathan Wiebe, Yufei Ding, Bo Peng, Karol Kowalski, Nathan A. Baker, James Ang, Ang Li |
| 2022 | ISCA | A synthesis framework for stitching surface code with superconducting quantum devices. | Anbang Wu, Gushu Li, Hezi Zhang, Gian Giacomo Guerreschi, Yufei Ding, Yuan Xie |
| 2022 | MICRO | AutoComm: A Framework for Enabling Efficient Communication in Distributed Quantum Programs. | Anbang Wu, Hezi Zhang, Gushu Li, Alireza Shabani, Yuan Xie, Yufei Ding |
| 2022 | PPoPP | QGTC: accelerating quantized graph neural networks via GPU tensor core. | Yuke Wang, Boyuan Feng, Yufei Ding |
| 2022 | SC | EL-Rec: Efficient Large-Scale Recommendation Model Training via Tensor-Train Embedding Table. | Zheng Wang, Yuke Wang, Boyuan Feng, Dheevatsa Mudigere, Bharath Muthiah, Yufei Ding |
| 2022 | SC | LightSeq2: Accelerated Training for Transformer-Based Models on GPUs. | Xiaohui Wang, Yang Wei, Ying Xiong, Guyue Huang, Xian Qian, Yufei Ding, Mingxuan Wang, Lei Li |
| 2022 | USENIX | Faith: An Efficient Framework for Transformer Verification on GPUs. | Boyuan Feng, Tianqi Tang, Yuke Wang, Zhaodong Chen, Zheng Wang, Shu Yang, Yuan Xie, Yufei Ding |
| 2021 | AAAI | UAG: Uncertainty-aware Attention Graph Neural Network for Defending Adversarial Attacks. | Boyuan Feng, Yuke Wang, Yufei Ding |
| 2021 | CCGRID | TiAcc: Triangle-inequality based Hardware Accelerator for K-means on FPGAs. | Yuke Wang, Boyuan Feng, Gushu Li, Georgios Tzimpragos, Lei Deng, Yuan Xie, Yufei Ding |
| 2021 | CIKM | An Efficient Quantitative Approach for Optimizing Convolutional Neural Networks. | Yuke Wang, Boyuan Feng, Xueqiao Peng, Yufei Ding |
| 2021 | ICASSP | Saga: Sparse Adversarial Attack on EEG-Based Brain Computer Interface. | Boyuan Feng, Yuke Wang, Yufei Ding |
| 2021 | ICCAD | Overcoming the Memory Hierarchy Inefficiencies in Graph Processing Applications. | Jilan Lin, Shuangchen Li, Yufei Ding, Yuan Xie |
| 2021 | MICRO | Improving Streaming Graph Processing Performance using Input Knowledge. | Abanti Basak, Zheng Qu, Jilan Lin, Alaa R. Alameldeen, Zeshan Chishti, Yufei Ding, Yuan Xie |
| 2021 | MICRO | ENMC: Extreme Near-Memory Classification via Approximate Screening. | Liu Liu, Jilan Lin, Zheng Qu, Yufei Ding, Yuan Xie |
| 2021 | OSDI | GNNAdvisor: An Adaptive and Efficient Runtime System for GNN Acceleration on GPUs. | Yuke Wang, Boyuan Feng, Gushu Li, Shuangchen Li, Lei Deng, Yuan Xie, Yufei Ding |
| 2021 | PPoPP | EGEMM-TC: accelerating scientific computing on tensor cores with extended precision. | Boyuan Feng, Yuke Wang, Guoyang Chen, Weifeng Zhang, Yuan Xie, Yufei Ding |
| 2021 | SC | Efficient tensor core-based GPU kernels for structured sparsity under reduced precision. | Zhaodong Chen, Zheng Qu, Liu Liu, Yufei Ding, Yuan Xie |
| 2021 | SC | APNN-TC: accelerating arbitrary precision neural networks on ampere GPU tensor cores. | Boyuan Feng, Yuke Wang, Tong Geng, Ang Li, Yufei Ding |
| 2021 | USENIX | Palleon: A Runtime System for Efficient Video Processing toward Dynamic Class Skew. | Boyuan Feng, Yuke Wang, Gushu Li, Yuan Xie, Yufei Ding |
| 2020 | AAAI | Weighted-Sampling Audio Adversarial Example Attack. | Xiaolei Liu, Kun Wan, Yufei Ding, Xiaosong Zhang, Qingxin Zhu |
| 2020 | ASPLOS | DeepSniffer: A DNN Model Extraction Framework Based on Learning Architectural Hints. | Xing Hu, Ling Liang, Shuangchen Li, Lei Deng, Pengfei Zuo, Yu Ji, Xinfeng Xie, Yufei Ding, Chang Liu, Timothy Sherwood, Yuan Xie |
| 2020 | ASPLOS | Towards Efficient Superconducting Quantum Processor Architecture Design. | Gushu Li, Yufei Ding, Yuan Xie |
| 2020 | DAC | Eliminating Redundant Computation in Noisy Quantum Computing Simulation. | Gushu Li, Yufei Ding, Yuan Xie |
| 2020 | ICML | Boosting Deep Neural Network Efficiency with Dual-Module Inference. | Liu Liu, Lei Deng, Zhaodong Chen, Yuke Wang, Shuangchen Li, Jingwei Zhang, Yihua Yang, Zhenyu Gu, Yufei Ding, Yuan Xie |
| 2020 | ISCA | iPIM: Programmable In-Memory Image Processing Accelerator Using Near-Bank Architecture. | Peng Gu, Xinfeng Xie, Yufei Ding, Guoyang Chen, Weifeng Zhang, Dimin Niu, Yuan Xie |
| 2020 | ICTAI | SGQuant: Squeezing the Last Bit on Graph Neural Networks with Specialized Quantization. | Boyuan Feng, Yuke Wang, Xu Li, Shu Yang, Xueqiao Peng, Yufei Ding |
| 2020 | MICRO | DUET: Boosting Deep Neural Network Efficiency on Dual-Module Architecture. | Liu Liu, Zheng Qu, Lei Deng, Fengbin Tu, Shuangchen Li, Xing Hu, Zhenyu Gu, Yufei Ding, Yuan Xie |
| 2020 | NPC | A Close Look at Multi-tenant Parallel CNN Inference for Autonomous Driving. | Yitong Huang, Yu Zhang, Boyuan Feng, Xing Guo, Yanyong Zhang, Yufei Ding |
| 2019 | ASPLOS | Tackling the Qubit Mapping Problem for NISQ-Era Quantum Devices. | Gushu Li, Yufei Ding, Yuan Xie |
| 2019 | FCCM | KPynq: A Work-Efficient Triangle-Inequality Based K-Means on FPGA. | Yuke Wang, Zhaorui Zeng, Boyuan Feng, Lei Deng, Yufei Ding |
| 2019 | ICLR | Dynamic Sparse Graph for Efficient Deep Learning. | Liu Liu, Lei Deng, Xing Hu, Maohua Zhu, Guoqi Li, Yufei Ding, Yuan Xie |
| 2019 | ICTAI | Reconciling Feature-Reuse and Overfitting in DenseNet with Specialized Dropout. | Kun Wan, Shu Yang, Boyuan Feng, Yufei Ding, Lingwei Xie |
| 2018 | ICDE | Reuse-Centric K-Means Configuration. | Hui Guan, Yufei Ding, Xipeng Shen, Hamid Krim |
| 2017 | ICDE | Sweet KNN: An Efficient KNN on GPU through Reconciliation between Redundancy Removal and Regularity. | Guoyang Chen, Yufei Ding, Xipeng Shen |
| 2017 | PLDI | Generalizations of the theory and deployment of triangular inequality for compiler-based strength reduction. | Yufei Ding, Lin Ning, Hui Guan, Xipeng Shen |
| 2015 | ICML | Yinyang K-Means: A Drop-In Replacement of the Classic K-Means with Consistent Speedup. | Yufei Ding, Yue Zhao, Xipeng Shen, Madanlal Musuvathi, Todd Mytkowicz |
| 2015 | PLDI | Autotuning algorithmic choice for input sensitivity. | Yufei Ding, Jason Ansel, Kalyan Veeramachaneni, Xipeng Shen, Una-May O'Reilly, Saman P. Amarasinghe |
| 2014 | ASPLOS | Finding the limit: examining the potential and complexity of compilation scheduling for JIT-based runtime systems. | Yufei Ding, Mingzhou Zhou, Zhijia Zhao, Sarah Eisenstat, Xipeng Shen |
| 2014 | OOPSLA | Call sequence prediction through probabilistic calling automata. | Zhijia Zhao, Bo Wu, Mingzhou Zhou, Yufei Ding, Jianhua Sun, Xipeng Shen, Youfeng Wu |
| 2013 | CGO | Profmig: A framework for flexible migration of program profiles across software versions. | Mingzhou Zhou, Bo Wu, Yufei Ding, Xipeng Shen |