Skip to content

Xuehai Qian

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

64

Venues

17

Active years

2007–2025

Best venue rank

A*

Where they publish

Papers

64 indexed papers, newest first.

YearVenueTitleAuthors
2025HPCAMithril: A Scalable System for Deep GNN Training.Jingji Chen, Zhuoming Chen, Xuehai Qian
2025USENIXSwift: Fast Performance Tuning with GAN-Generated Configurations.Chao Chen, Shixin Huang, Xuehai Qian, Zhibin Yu
2024HPCAGuser: A GPGPU Power Stressmark Generator.Yalong Shan, Yongkui Yang, Xuehai Qian, Zhibin Yu
2023ASPLOSDecoMine: A Compilation-Based Graph Pattern Mining System with Pattern Decomposition.Jingji Chen, Xuehai Qian
2023ASPLOSKhuzdul: Efficient and Scalable Distributed Graph Pattern Mining Engine.Jingji Chen, Xuehai Qian
2023ASPLOSAchieving Sub-second Pairwise Query over Evolving Graphs.Hongtao Chen, Mingxing Zhang, Ke Yang, Kang Chen, Albert Y. Zomaya, Yongwei Wu, Xuehai Qian
2023DACHybrid Gate-Pulse Model for Variational Quantum Algorithms.Zhiding Liang, Zhixin Song, Jinglei Cheng, Zichang He, Ji Liu, Hanrui Wang, Ruiyang Qin, Yiru Wang, Song Han, Xuehai Qian, Yiyu Shi
2022ASPLOSSparseCore: stream ISA and processor specialization for sparse computation.Gengyu Rao, Jingji Chen, Jason Yik, Xuehai Qian
2022HPCAHyBP: Hybrid Isolation-Randomization Secure Branch Predictor.Lutan Zhao, Peinan Li, Rui Hou, Michael C. Huang, Xuehai Qian, Lixin Zhang, Dan Meng
2022QCEVariational Quantum Pulse Learning.Zhiding Liang, Hanrui Wang, Jinglei Cheng, Yongshan Ding, Hang Ren, Zhengqi Gao, Zhirui Hu, Duane S. Boning, Xuehai Qian, Song Han, Weiwen Jiang, Yiyu Shi
2021DACA Lightweight Isolation Mechanism for Secure Branch Predictors.Lutan Zhao, Peinan Li, Rui Hou, Michael C. Huang, Jiazhen Li, Lixin Zhang, Xuehai Qian, Dan Meng
2021HPCAMix and Match: A Novel FPGA-Centric Deep Neural Network Quantization Framework.Sung-En Chang, Yanyu Li, Mengshu Sun, Runbin Shi, Hayden K. H. So, Xuehai Qian, Yanzhi Wang, Xue Lin
2021ISCAGoSPA: An Energy-efficient High-performance Globally Optimized SParse Convolutional Neural Network Accelerator.Chunhua Deng, Yang Sui, Siyu Liao, Xuehai Qian, Bo Yuan
2021ISCAHASCO: Towards Agile HArdware and Software CO-design for Tensor Computation.Qingcheng Xiao, Size Zheng, Bingzhe Wu, Pengcheng Xu, Xuehai Qian, Yun Liang
2021ISCAFORMS: Fine-grained Polarized ReRAM-based In-situ Computation for Mixed-signal DNN Accelerator.Geng Yuan, Payman Behnam, Zhengang Li, Ali Shafiee, Sheng Lin, Xiaolong Ma, Hang Liu, Xuehai Qian, Mahdi Nazm Bojnordi, Yanzhi Wang, Caiwen Ding
2021MICROESCALATE: Boosting the Efficiency of Sparse CNN Accelerator with Kernel Decomposition.Shiyu Li, Edward Hanson, Xuehai Qian, Hai (Helen) Li, Yiran Chen
2020ASPLOSPrague: High-Performance Heterogeneity-Aware Asynchronous Decentralized Training.Qinyi Luo, Jiaao He, Youwei Zhuo, Xuehai Qian
2020ASPLOSAsymNVM: An Efficient Framework for Implementing Persistent Data Structures on Asymmetric NVM Architecture.Teng Ma, Mingxing Zhang, Kang Chen, Zhuo Song, Yongwei Wu, Xuehai Qian
2020ASPLOSPatDNN: Achieving Real-Time DNN Execution on Mobile Devices with Pattern-based Weight Pruning.Wei Niu, Xiaolong Ma, Sheng Lin, Shihao Wang, Xuehai Qian, Xue Lin, Yanzhi Wang, Bin Ren
2020ASPLOSCapuchin: Tensor-based GPU Memory Management for Deep Learning.Xuan Peng, Xuanhua Shi, Hulin Dai, Hai Jin, Weiliang Ma, Qian Xiong, Fan Yang, Xuehai Qian
2020ASPLOSDNNGuard: An Elastic Heterogeneous DNN Accelerator Architecture against Adversarial Attacks.Xingbin Wang, Rui Hou, Boyan Zhao, Fengkai Yuan, Jun Zhang, Dan Meng, Xuehai Qian
2020HPCAAccPar: Tensor Partitioning for Heterogeneous Deep Learning Accelerators.Linghao Song, Fan Chen, Youwei Zhuo, Xuehai Qian, Hai Li, Yiran Chen
2020ISCAAccQOC: Accelerating Quantum Optimal Control Based Pulse Generation.Jinglei Cheng, Haoqing Deng, Xuehai Qian
2020PLDISympleGraph: distributed graph processing with precise loop-carried dependency guarantee.Youwei Zhuo, Jingji Chen, Qinyi Luo, Yanzhi Wang, Hailong Yang, Depei Qian, Xuehai Qian
2019ASPLOSHop: Heterogeneity-aware Decentralized Training.Qinyi Luo, Jinkun Lin, Youwei Zhuo, Xuehai Qian
2019ASPLOSADMM-NN: An Algorithm-Hardware Co-Design Framework of DNNs Using Alternating Direction Methods of Multipliers.Ao Ren, Tianyun Zhang, Shaokai Ye, Jiayu Li, Wenyao Xu, Xuehai Qian, Xue Lin, Yanzhi Wang
2019ASPLOSpLock: A Fast Lock for Architectures with Explicit Inter-core Message Passing.Xiongchao Tang, Jidong Zhai, Xuehai Qian, Wenguang Chen
2019HPCAE-RNN: Design Optimization for Efficient Recurrent Neural Networks in FPGAs.Zhe Li, Caiwen Ding, Siyue Wang, Wujie Wen, Youwei Zhuo, Chang Liu, Qinru Qiu, Wenyao Xu, Xue Lin, Xuehai Qian, Yanzhi Wang
2019HPCAHyPar: Towards Hybrid Parallelism for Deep Learning Accelerator Array.Linghao Song, Jiachen Mao, Youwei Zhuo, Xuehai Qian, Hai Li, Yiran Chen
2019HPCAA Hybrid Framework for Fast and Accurate GPU Performance Estimation through Source-Level Analysis and Trace-Based Simulation.Xiebing Wang, Kai Huang, Alois C. Knoll, Xuehai Qian
2019ICDCSSpeedyBox: Low-Latency NFV Service Chains with Cross-NF Runtime Consolidation.Yimin Jiang, Yong Cui, Wenfei Wu, Zhe Xu, Jiahan Gu, K. K. Ramakrishnan, Yongchao He, Xuehai Qian
2019ISCAA stochastic-computing based deep learning framework using adiabatic quantum-flux-parametron superconducting technology.Ruizhe Cai, Ao Ren, Olivia Chen, Ning Liu, Caiwen Ding, Xuehai Qian, Jie Han, Wenhui Luo, Nobuyuki Yoshikawa, Yanzhi Wang
2019ISCATIE: energy-efficient tensor train-based inference engine for deep neural network.Chunhua Deng, Fangxuan Sun, Xuehai Qian, Jun Lin, Zhongfeng Wang, Bo Yuan
2019MICROGraphQ: Scalable PIM-Based Graph Processing.Youwei Zhuo, Chao Wang, Mingxing Zhang, Rui Wang, Dimin Niu, Yanzhi Wang, Xuehai Qian
2018AAAITowards Ultra-High Performance and Energy Efficiency of Deep Learning Systems: An Algorithm-Hardware Co-Optimization Framework.Yanzhi Wang, Caiwen Ding, Zhe Li, Geng Yuan, Siyu Liao, Xiaolong Ma, Bo Yuan, Xuehai Qian, Jian Tang, Qinru Qiu, Xue Lin
2018ASPDACNeu-NoC: A high-efficient interconnection network for accelerated neuromorphic systems.Xiaoxiao Liu, Wei Wen, Xuehai Qian, Hai Li, Yiran Chen
2018ASPLOSVIBNN: Hardware Acceleration of Bayesian Neural Networks.Ruizhe Cai, Ao Ren, Ning Liu, Caiwen Ding, Luhao Wang, Xuehai Qian, Massoud Pedram, Yanzhi Wang
2018ASPLOSDatasize-Aware High Dimensional Configurations Auto-Tuning of In-Memory Cluster Computing.Zhibin Yu, Zhendong Bei, Xuehai Qian
2018ASPLOSWonderland: A Novel Abstraction-Based Out-Of-Core Graph Processing System.Mingxing Zhang, Yongwei Wu, Youwei Zhuo, Xuehai Qian, Chengying Huan, Kang Chen
2018DATEReRAM-based accelerator for deep learning.Bing Li, Linghao Song, Fan Chen, Xuehai Qian, Yiran Chen, Hai Helen Li
2018HPCAGraphR: Accelerating Graph Processing Using ReRAM.Linghao Song, Youwei Zhuo, Xuehai Qian, Hai Helen Li, Yiran Chen
2018HPCAG-TSC: Timestamp Based Coherence for GPUs.Abdulaziz Tabbakh, Xuehai Qian, Murali Annavaram
2018HPCAGraphP: Reducing Communication for PIM-Based Graph Processing with Efficient Data Partition.Mingxing Zhang, Youwei Zhuo, Chao Wang, Mingyu Gao, Yongwei Wu, Kang Chen, Christos Kozyrakis, Xuehai Qian
2018MICROPermDNN: Efficient Compressed DNN Architecture with Permuted Diagonal Matrices.Chunhua Deng, Siyu Liao, Yi Xie, Keshab K. Parhi, Xuehai Qian, Bo Yuan
2018MICROCounterMiner: Mining Big Performance Data from Hardware Counters.Yirong Lv, Bin Sun, Qingyi Luo, Jing Wang, Zhibin Yu, Xuehai Qian
2018MICROCSE: Parallel Finite State Machines with Convergence Set Enumeration.Youwei Zhuo, Jinglei Cheng, Qinyi Luo, Jidong Zhai, Yanzhi Wang, Zhongzhi Luan, Xuehai Qian
2018PPoPPvSensor: leveraging fixed-workload snippets of programs for performance variance detection.Xiongchao Tang, Jidong Zhai, Xuehai Qian, Bingsheng He, Wei Xue, Wenguang Chen
2017ASPLOSDudeTM: Building Durable Transactions with Decoupling for Persistent Memory.Mengxing Liu, Mingxing Zhang, Kang Chen, Xuehai Qian, Yongwei Wu, Weimin Zheng, Jinglei Ren
2017ASPLOSSC-DCNN: Highly-Scalable Deep Convolutional Neural Network using Stochastic Computing.Ao Ren, Zhe Li, Caiwen Ding, Qinru Qiu, Yanzhi Wang, Ji Li, Xuehai Qian, Bo Yuan
2017HPCAPipeLayer: A Pipelined ReRAM-Based Accelerator for Deep Learning.Linghao Song, Xuehai Qian, Hai Li, Yiran Chen
2017MICROCirCNN: accelerating and compressing deep neural networks using block-circulant weight matrices.Caiwen Ding, Siyu Liao, Yanzhi Wang, Zhe Li, Ning Liu, Youwei Zhuo, Chao Wang, Xuehai Qian, Yu Bai, Geng Yuan, Xiaolong Ma, Yipeng Zhang, Jian Tang, Qinru Qiu, Xue Lin, Bo Yuan
2017USENIXSqueezing out All the Value of Loaded Data: An Out-of-core Graph Processing System with Reduced Disk I/O.Zhiyuan Ai, Mingxing Zhang, Yongwei Wu, Xuehai Qian, Kang Chen, Weimin Zheng
2016ICSSReplay: Deterministic Sub-Group Replay for One-Sided Communication.Xuehai Qian, Koushik Sen, Paul Hargrove, Costin Iancu
2016OSDIExploring the Hidden Dimension in Graph Processing.Mingxing Zhang, Yongwei Wu, Kang Chen, Xuehai Qian, Xue Li, Weimin Zheng
2016PPoPPOPR: deterministic group replay for one-sided communication.Xuehai Qian, Koushik Sen, Paul Hargrove, Costin Iancu
2014ISCAPacifier: Record and replay for relaxed-consistency multiprocessors with distributed directory protocol.Xuehai Qian, Benjamn Sahelices, Depei Qian
2014ISCAOmniOrder: Directory-based conflict serialization of transactions.Xuehai Qian, Benjamn Sahelices, Josep Torrellas
2013ASPLOSVolition: scalable and precise sequential consistency violation detection.Xuehai Qian, Josep Torrellas, Benjamn Sahelices, Depei Qian
2013HPCARainbow: Efficient memory dependence recording with high replay parallelism for relaxed memory model.Xuehai Qian, He Huang, Benjamn Sahelices, Depei Qian
2013MICROBulkCommit: scalable and fast commit of atomic blocks in a lazy multiprocessor environment.Xuehai Qian, Josep Torrellas, Benjamn Sahelices, Depei Qian
2012HPCABulkSMT: Designing SMT processors for atomic-block execution.Xuehai Qian, Benjamn Sahelices, Josep Torrellas
2010MICROScalableBulk: Scalable Cache Coherence for Atomic Blocks in a Lazy Environment.Xuehai Qian, Wonsun Ahn, Josep Torrellas
2007ISCASCircuit implementation of floating point range reduction for trigonometric functions.Xuehai Qian, Hao Zhang, Jingang Yang, He Huang, Junchao Zhang, Dongrui Fan
2007PDPDesign and Implementation of Floating Point Stack on General RISC Architecture.Xuehai Qian, He Huang, Hao Zhang, Guoping Long, Junchao Zhang, Dongrui Fan