| 2025 | HPCA | Mithril: A Scalable System for Deep GNN Training. | Jingji Chen, Zhuoming Chen, Xuehai Qian |
| 2025 | USENIX | Swift: Fast Performance Tuning with GAN-Generated Configurations. | Chao Chen, Shixin Huang, Xuehai Qian, Zhibin Yu |
| 2024 | HPCA | Guser: A GPGPU Power Stressmark Generator. | Yalong Shan, Yongkui Yang, Xuehai Qian, Zhibin Yu |
| 2023 | ASPLOS | DecoMine: A Compilation-Based Graph Pattern Mining System with Pattern Decomposition. | Jingji Chen, Xuehai Qian |
| 2023 | ASPLOS | Khuzdul: Efficient and Scalable Distributed Graph Pattern Mining Engine. | Jingji Chen, Xuehai Qian |
| 2023 | ASPLOS | Achieving Sub-second Pairwise Query over Evolving Graphs. | Hongtao Chen, Mingxing Zhang, Ke Yang, Kang Chen, Albert Y. Zomaya, Yongwei Wu, Xuehai Qian |
| 2023 | DAC | Hybrid Gate-Pulse Model for Variational Quantum Algorithms. | Zhiding Liang, Zhixin Song, Jinglei Cheng, Zichang He, Ji Liu, Hanrui Wang, Ruiyang Qin, Yiru Wang, Song Han, Xuehai Qian, Yiyu Shi |
| 2022 | ASPLOS | SparseCore: stream ISA and processor specialization for sparse computation. | Gengyu Rao, Jingji Chen, Jason Yik, Xuehai Qian |
| 2022 | HPCA | HyBP: Hybrid Isolation-Randomization Secure Branch Predictor. | Lutan Zhao, Peinan Li, Rui Hou, Michael C. Huang, Xuehai Qian, Lixin Zhang, Dan Meng |
| 2022 | QCE | Variational Quantum Pulse Learning. | Zhiding Liang, Hanrui Wang, Jinglei Cheng, Yongshan Ding, Hang Ren, Zhengqi Gao, Zhirui Hu, Duane S. Boning, Xuehai Qian, Song Han, Weiwen Jiang, Yiyu Shi |
| 2021 | DAC | A Lightweight Isolation Mechanism for Secure Branch Predictors. | Lutan Zhao, Peinan Li, Rui Hou, Michael C. Huang, Jiazhen Li, Lixin Zhang, Xuehai Qian, Dan Meng |
| 2021 | HPCA | Mix and Match: A Novel FPGA-Centric Deep Neural Network Quantization Framework. | Sung-En Chang, Yanyu Li, Mengshu Sun, Runbin Shi, Hayden K. H. So, Xuehai Qian, Yanzhi Wang, Xue Lin |
| 2021 | ISCA | GoSPA: An Energy-efficient High-performance Globally Optimized SParse Convolutional Neural Network Accelerator. | Chunhua Deng, Yang Sui, Siyu Liao, Xuehai Qian, Bo Yuan |
| 2021 | ISCA | HASCO: Towards Agile HArdware and Software CO-design for Tensor Computation. | Qingcheng Xiao, Size Zheng, Bingzhe Wu, Pengcheng Xu, Xuehai Qian, Yun Liang |
| 2021 | ISCA | FORMS: Fine-grained Polarized ReRAM-based In-situ Computation for Mixed-signal DNN Accelerator. | Geng Yuan, Payman Behnam, Zhengang Li, Ali Shafiee, Sheng Lin, Xiaolong Ma, Hang Liu, Xuehai Qian, Mahdi Nazm Bojnordi, Yanzhi Wang, Caiwen Ding |
| 2021 | MICRO | ESCALATE: Boosting the Efficiency of Sparse CNN Accelerator with Kernel Decomposition. | Shiyu Li, Edward Hanson, Xuehai Qian, Hai (Helen) Li, Yiran Chen |
| 2020 | ASPLOS | Prague: High-Performance Heterogeneity-Aware Asynchronous Decentralized Training. | Qinyi Luo, Jiaao He, Youwei Zhuo, Xuehai Qian |
| 2020 | ASPLOS | AsymNVM: An Efficient Framework for Implementing Persistent Data Structures on Asymmetric NVM Architecture. | Teng Ma, Mingxing Zhang, Kang Chen, Zhuo Song, Yongwei Wu, Xuehai Qian |
| 2020 | ASPLOS | PatDNN: Achieving Real-Time DNN Execution on Mobile Devices with Pattern-based Weight Pruning. | Wei Niu, Xiaolong Ma, Sheng Lin, Shihao Wang, Xuehai Qian, Xue Lin, Yanzhi Wang, Bin Ren |
| 2020 | ASPLOS | Capuchin: Tensor-based GPU Memory Management for Deep Learning. | Xuan Peng, Xuanhua Shi, Hulin Dai, Hai Jin, Weiliang Ma, Qian Xiong, Fan Yang, Xuehai Qian |
| 2020 | ASPLOS | DNNGuard: An Elastic Heterogeneous DNN Accelerator Architecture against Adversarial Attacks. | Xingbin Wang, Rui Hou, Boyan Zhao, Fengkai Yuan, Jun Zhang, Dan Meng, Xuehai Qian |
| 2020 | HPCA | AccPar: Tensor Partitioning for Heterogeneous Deep Learning Accelerators. | Linghao Song, Fan Chen, Youwei Zhuo, Xuehai Qian, Hai Li, Yiran Chen |
| 2020 | ISCA | AccQOC: Accelerating Quantum Optimal Control Based Pulse Generation. | Jinglei Cheng, Haoqing Deng, Xuehai Qian |
| 2020 | PLDI | SympleGraph: distributed graph processing with precise loop-carried dependency guarantee. | Youwei Zhuo, Jingji Chen, Qinyi Luo, Yanzhi Wang, Hailong Yang, Depei Qian, Xuehai Qian |
| 2019 | ASPLOS | Hop: Heterogeneity-aware Decentralized Training. | Qinyi Luo, Jinkun Lin, Youwei Zhuo, Xuehai Qian |
| 2019 | ASPLOS | ADMM-NN: An Algorithm-Hardware Co-Design Framework of DNNs Using Alternating Direction Methods of Multipliers. | Ao Ren, Tianyun Zhang, Shaokai Ye, Jiayu Li, Wenyao Xu, Xuehai Qian, Xue Lin, Yanzhi Wang |
| 2019 | ASPLOS | pLock: A Fast Lock for Architectures with Explicit Inter-core Message Passing. | Xiongchao Tang, Jidong Zhai, Xuehai Qian, Wenguang Chen |
| 2019 | HPCA | E-RNN: Design Optimization for Efficient Recurrent Neural Networks in FPGAs. | Zhe Li, Caiwen Ding, Siyue Wang, Wujie Wen, Youwei Zhuo, Chang Liu, Qinru Qiu, Wenyao Xu, Xue Lin, Xuehai Qian, Yanzhi Wang |
| 2019 | HPCA | HyPar: Towards Hybrid Parallelism for Deep Learning Accelerator Array. | Linghao Song, Jiachen Mao, Youwei Zhuo, Xuehai Qian, Hai Li, Yiran Chen |
| 2019 | HPCA | A Hybrid Framework for Fast and Accurate GPU Performance Estimation through Source-Level Analysis and Trace-Based Simulation. | Xiebing Wang, Kai Huang, Alois C. Knoll, Xuehai Qian |
| 2019 | ICDCS | SpeedyBox: Low-Latency NFV Service Chains with Cross-NF Runtime Consolidation. | Yimin Jiang, Yong Cui, Wenfei Wu, Zhe Xu, Jiahan Gu, K. K. Ramakrishnan, Yongchao He, Xuehai Qian |
| 2019 | ISCA | A stochastic-computing based deep learning framework using adiabatic quantum-flux-parametron superconducting technology. | Ruizhe Cai, Ao Ren, Olivia Chen, Ning Liu, Caiwen Ding, Xuehai Qian, Jie Han, Wenhui Luo, Nobuyuki Yoshikawa, Yanzhi Wang |
| 2019 | ISCA | TIE: energy-efficient tensor train-based inference engine for deep neural network. | Chunhua Deng, Fangxuan Sun, Xuehai Qian, Jun Lin, Zhongfeng Wang, Bo Yuan |
| 2019 | MICRO | GraphQ: Scalable PIM-Based Graph Processing. | Youwei Zhuo, Chao Wang, Mingxing Zhang, Rui Wang, Dimin Niu, Yanzhi Wang, Xuehai Qian |
| 2018 | AAAI | Towards Ultra-High Performance and Energy Efficiency of Deep Learning Systems: An Algorithm-Hardware Co-Optimization Framework. | Yanzhi Wang, Caiwen Ding, Zhe Li, Geng Yuan, Siyu Liao, Xiaolong Ma, Bo Yuan, Xuehai Qian, Jian Tang, Qinru Qiu, Xue Lin |
| 2018 | ASPDAC | Neu-NoC: A high-efficient interconnection network for accelerated neuromorphic systems. | Xiaoxiao Liu, Wei Wen, Xuehai Qian, Hai Li, Yiran Chen |
| 2018 | ASPLOS | VIBNN: Hardware Acceleration of Bayesian Neural Networks. | Ruizhe Cai, Ao Ren, Ning Liu, Caiwen Ding, Luhao Wang, Xuehai Qian, Massoud Pedram, Yanzhi Wang |
| 2018 | ASPLOS | Datasize-Aware High Dimensional Configurations Auto-Tuning of In-Memory Cluster Computing. | Zhibin Yu, Zhendong Bei, Xuehai Qian |
| 2018 | ASPLOS | Wonderland: A Novel Abstraction-Based Out-Of-Core Graph Processing System. | Mingxing Zhang, Yongwei Wu, Youwei Zhuo, Xuehai Qian, Chengying Huan, Kang Chen |
| 2018 | DATE | ReRAM-based accelerator for deep learning. | Bing Li, Linghao Song, Fan Chen, Xuehai Qian, Yiran Chen, Hai Helen Li |
| 2018 | HPCA | GraphR: Accelerating Graph Processing Using ReRAM. | Linghao Song, Youwei Zhuo, Xuehai Qian, Hai Helen Li, Yiran Chen |
| 2018 | HPCA | G-TSC: Timestamp Based Coherence for GPUs. | Abdulaziz Tabbakh, Xuehai Qian, Murali Annavaram |
| 2018 | HPCA | GraphP: Reducing Communication for PIM-Based Graph Processing with Efficient Data Partition. | Mingxing Zhang, Youwei Zhuo, Chao Wang, Mingyu Gao, Yongwei Wu, Kang Chen, Christos Kozyrakis, Xuehai Qian |
| 2018 | MICRO | PermDNN: Efficient Compressed DNN Architecture with Permuted Diagonal Matrices. | Chunhua Deng, Siyu Liao, Yi Xie, Keshab K. Parhi, Xuehai Qian, Bo Yuan |
| 2018 | MICRO | CounterMiner: Mining Big Performance Data from Hardware Counters. | Yirong Lv, Bin Sun, Qingyi Luo, Jing Wang, Zhibin Yu, Xuehai Qian |
| 2018 | MICRO | CSE: Parallel Finite State Machines with Convergence Set Enumeration. | Youwei Zhuo, Jinglei Cheng, Qinyi Luo, Jidong Zhai, Yanzhi Wang, Zhongzhi Luan, Xuehai Qian |
| 2018 | PPoPP | vSensor: leveraging fixed-workload snippets of programs for performance variance detection. | Xiongchao Tang, Jidong Zhai, Xuehai Qian, Bingsheng He, Wei Xue, Wenguang Chen |
| 2017 | ASPLOS | DudeTM: Building Durable Transactions with Decoupling for Persistent Memory. | Mengxing Liu, Mingxing Zhang, Kang Chen, Xuehai Qian, Yongwei Wu, Weimin Zheng, Jinglei Ren |
| 2017 | ASPLOS | SC-DCNN: Highly-Scalable Deep Convolutional Neural Network using Stochastic Computing. | Ao Ren, Zhe Li, Caiwen Ding, Qinru Qiu, Yanzhi Wang, Ji Li, Xuehai Qian, Bo Yuan |
| 2017 | HPCA | PipeLayer: A Pipelined ReRAM-Based Accelerator for Deep Learning. | Linghao Song, Xuehai Qian, Hai Li, Yiran Chen |
| 2017 | MICRO | CirCNN: accelerating and compressing deep neural networks using block-circulant weight matrices. | Caiwen Ding, Siyu Liao, Yanzhi Wang, Zhe Li, Ning Liu, Youwei Zhuo, Chao Wang, Xuehai Qian, Yu Bai, Geng Yuan, Xiaolong Ma, Yipeng Zhang, Jian Tang, Qinru Qiu, Xue Lin, Bo Yuan |
| 2017 | USENIX | Squeezing out All the Value of Loaded Data: An Out-of-core Graph Processing System with Reduced Disk I/O. | Zhiyuan Ai, Mingxing Zhang, Yongwei Wu, Xuehai Qian, Kang Chen, Weimin Zheng |
| 2016 | ICS | SReplay: Deterministic Sub-Group Replay for One-Sided Communication. | Xuehai Qian, Koushik Sen, Paul Hargrove, Costin Iancu |
| 2016 | OSDI | Exploring the Hidden Dimension in Graph Processing. | Mingxing Zhang, Yongwei Wu, Kang Chen, Xuehai Qian, Xue Li, Weimin Zheng |
| 2016 | PPoPP | OPR: deterministic group replay for one-sided communication. | Xuehai Qian, Koushik Sen, Paul Hargrove, Costin Iancu |
| 2014 | ISCA | Pacifier: Record and replay for relaxed-consistency multiprocessors with distributed directory protocol. | Xuehai Qian, Benjamn Sahelices, Depei Qian |
| 2014 | ISCA | OmniOrder: Directory-based conflict serialization of transactions. | Xuehai Qian, Benjamn Sahelices, Josep Torrellas |
| 2013 | ASPLOS | Volition: scalable and precise sequential consistency violation detection. | Xuehai Qian, Josep Torrellas, Benjamn Sahelices, Depei Qian |
| 2013 | HPCA | Rainbow: Efficient memory dependence recording with high replay parallelism for relaxed memory model. | Xuehai Qian, He Huang, Benjamn Sahelices, Depei Qian |
| 2013 | MICRO | BulkCommit: scalable and fast commit of atomic blocks in a lazy multiprocessor environment. | Xuehai Qian, Josep Torrellas, Benjamn Sahelices, Depei Qian |
| 2012 | HPCA | BulkSMT: Designing SMT processors for atomic-block execution. | Xuehai Qian, Benjamn Sahelices, Josep Torrellas |
| 2010 | MICRO | ScalableBulk: Scalable Cache Coherence for Atomic Blocks in a Lazy Environment. | Xuehai Qian, Wonsun Ahn, Josep Torrellas |
| 2007 | ISCAS | Circuit implementation of floating point range reduction for trigonometric functions. | Xuehai Qian, Hao Zhang, Jingang Yang, He Huang, Junchao Zhang, Dongrui Fan |
| 2007 | PDP | Design and Implementation of Floating Point Stack on General RISC Architecture. | Xuehai Qian, He Huang, Hao Zhang, Guoping Long, Junchao Zhang, Dongrui Fan |