| 2026 | ASPLOS | CPU-Oblivious Offloading of Failure-Atomic Transactions for Disaggregated Memory. | Cheng Chen, Chencheng Ye, Yuanchao Xu, Xipeng Shen, Xiaofei Liao, Hai Jin, Wenbin Jiang, Yan Solihin |
| 2026 | CGO | SparseX: Synergizing GPU Libraries for Sparse Matrix Multiplication on Heterogeneous Processors. | Ruifeng Zhang, Xiangwei Wang, Ang Li, Xipeng Shen |
| 2025 | ACL | A Drop-In Solution for On-the-Fly Adaptation of Speculative Decoding in Large Language Models. | Jiesong Liu, Brian Park, Xipeng Shen |
| 2025 | ASPLOS | Generalizing Reuse Patterns for Efficient DNN on Microcontrollers. | Jiesong Liu, Bin Ren, Xipeng Shen |
| 2025 | HPDC | FluidFaaS: A Dynamic Pipelined Solution for Serverless Computing with Strong Isolation-based GPU Sharing. | Xinning Hui, Yuanchao Xu, Xipeng Shen |
| 2025 | KDD | Efficient End-to-end Language Model Fine-tuning on Graphs. | Rui Xue, Xipeng Shen, Ruozhou Yu, Xiaorui Liu |
| 2025 | PPoPP | Accelerating GNNs on GPU Sparse Tensor Cores through N: M Sparsity-Oriented Graph Reordering. | Jou-An Chen, Hsin-Hsuan Sung, Ruifeng Zhang, Ang Li, Xipeng Shen |
| 2025 | SIGMETRICS | Exploring Function Granularity for Serverless Machine Learning Application with GPU Sharing. | Xinning Hui, Yuanchao Xu, Xipeng Shen |
| 2024 | ASPLOS | SmartMem: Layout Transformation Elimination and Adaptation for Efficient DNN Execution on Mobile. | Wei Niu, Md. Musfiqur Rahman Sanim, Zhihao Shu, Jiexiong Guan, Xipeng Shen, Miao Yin, Gagan Agrawal, Bin Ren |
| 2024 | DATE | DACO: Pursuing Ultra-low Power Consumption via DNN-Adaptive CPU-GPU CO-optimization on Mobile Devices. | Yushu Wu, Chao Wu, Geng Yuan, Yanyu Li, Weichao Guo, Jing Rao, Xipeng Shen, Bin Ren, Yanzhi Wang |
| 2024 | EuroSys | WiseGraph: Optimizing GNN with Joint Workload Partition of Graph and Operations. | Kezhao Huang, Jidong Zhai, Liyan Zheng, Haojie Wang, Yuyang Jin, Qihao Zhang, Runqing Zhang, Zhen Zheng, Youngmin Yi, Xipeng Shen |
| 2024 | HPCA | Data Enclave: A Data-Centric Trusted Execution Environment. | Yuanchao Xu, James Pangia, Chencheng Ye, Yan Solihin, Xipeng Shen |
| 2024 | HPDC | ESG: Pipeline-Conscious Efficient Scheduling of DNN Workflows on Serverless Platforms with Shareable GPUs. | Xinning Hui, Yuanchao Xu, Zhishan Guo, Xipeng Shen |
| 2023 | ASPLOS | Space-Efficient TREC for Enabling Deep Learning on Microcontrollers. | Jiesong Liu, Feng Zhang, Jiawei Guan, Hsin-Hsuan Sung, Xiaoguang Guo, Xiaoyong Du, Xipeng Shen |
| 2023 | ASPLOS | SpecPMT: Speculative Logging for Resolving Crash Consistency Overhead of Persistent Memory. | Chencheng Ye, Yuanchao Xu, Xipeng Shen, Yan Sha, Xiaofei Liao, Hai Jin, Yan Solihin |
| 2023 | HPCA | Reconciling Selective Logging and Hardware Persistent Memory Transaction. | Chencheng Ye, Yuanchao Xu, Xipeng Shen, Yan Sha, Xiaofei Liao, Hai Jin, Yan Solihin |
| 2023 | ICS | BitGNN: Unleashing the Performance Potential of Binary Graph Neural Networks on GPUs. | Jou-An Chen, Hsin-Hsuan Sung, Xipeng Shen, Sutanay Choudhury, Ang Li |
| 2023 | USENIX | Decentralized Application-Level Adaptive Scheduling for Multi-Instance DNNs on Open Mobile Devices. | Hsin-Hsuan Sung, Jou-An Chen, Wei Niu, Jiexiong Guan, Bin Ren, Xipeng Shen |
| 2022 | CGO | Enabling Near Real-Time NLU-Driven Natural Language Programming through Dynamic Grammar Graph-Based Translation. | Zifan Nan, Xipeng Shen, Hui Guan |
| 2022 | ECSA | Finding Reusable Machine Learning Components to Build Programming Language Processing Pipelines. | Patrick J. Flynn, Tristan Vanderbruggen, Chunhua Liao, Pei-Hung Lin, Murali Emani, Xipeng Shen |
| 2022 | HPCA | Temporal Exposure Reduction Protection for Persistent Memory. | Yuanchao Xu, Chencheng Ye, Xipeng Shen, Yan Solihin |
| 2022 | ISCA | FFCCD: fence-free crash-consistent concurrent defragmentation for persistent memory. | Yuanchao Xu, Chencheng Ye, Yan Solihin, Xipeng Shen |
| 2022 | ICSE | IDE Augmented with Human-Learning Inspired Natural Language Programming. | Mitchell Young, Zifan Nan, Xipeng Shen |
| 2022 | MICRO | GCD | Wei Niu, Jiexiong Guan, Xipeng Shen, Yanzhi Wang, Gagan Agrawal, Bin Ren |
| 2022 | WWW | DREW: Efficient Winograd CNN Inference with Deep Reuse. | Ruofan Wu, Feng Zhang, Jiawei Guan, Zhen Zheng, Xiaoyong Du, Xipeng Shen |
| 2022 | RTAS | Brief Industry Paper: Enabling Level-4 Autonomous Driving on a Single $1k Off-the-Shelf Card. | Hsin-Hsuan Sung, Yuanchao Xu, Jiexiong Guan, Wei Niu, Bin Ren, Yanzhi Wang, Shaoshan Liu, Xipeng Shen |
| 2021 | AAAI | RT3D: Achieving Real-Time Execution of 3D Convolutional Neural Networks on Mobile Devices. | Wei Niu, Mengshu Sun, Zhengang Li, Jou-An Chen, Jiexiong Guan, Xipeng Shen, Yanzhi Wang, Sijia Liu, Xue Lin, Bin Ren |
| 2021 | CC | Deep NLP-based co-evolvement for synthesizing code analysis from natural language. | Zifan Nan, Hui Guan, Xipeng Shen, Chunhua Liao |
| 2021 | ECOOP | Best-Effort Lazy Evaluation for Python Software Built on APIs. | Guoqiang Zhang, Xipeng Shen |
| 2021 | HPCA | Hardware-Based Address-Centric Acceleration of Key-Value Store. | Chencheng Ye, Yuanchao Xu, Xipeng Shen, Xiaofei Liao, Hai Jin, Yan Solihin |
| 2021 | ICDE | G-TADOC: Enabling Efficient GPU-Based Text Analytics without Decompression. | Feng Zhang, Zaifeng Pan, Yanliang Zhou, Jidong Zhai, Xipeng Shen, Onur Mutlu, Xiaoyong Du |
| 2021 | ICDM | Recurrent Neural Networks Meet Context-Free Grammar: Two Birds with One Stone. | Hui Guan, Umana Chaudhary, Yuanchao Xu, Lin Ning, Lijun Zhang, Xipeng Shen |
| 2021 | ICLR | Simple Augmentation Goes a Long Way: ADRL for DNN Quantization. | Lin Ning, Guoyang Chen, Weifeng Zhang, Xipeng Shen |
| 2021 | IJCNN | Revisit the Scalability of Deep Auto-Regressive Models for Graph Generation. | Shuai Yang, Xipeng Shen, Seung-Hwan Lim |
| 2021 | ISCA | Supporting Legacy Libraries on Non-Volatile Memory: A User-Transparent Approach. | Chencheng Ye, Yuanchao Xu, Xipeng Shen, Xiaofei Liao, Hai Jin, Yan Solihin |
| 2021 | MICRO | PCCS: Processor-Centric Contention-aware Slowdown Model for Heterogeneous System-on-Chips. | Yuanchao Xu, Mehmet Esat Belviranli, Xipeng Shen, Jeffrey S. Vetter |
| 2021 | PPoPP | Understanding and bridging the gaps in current GNN performance optimizations. | Kezhao Huang, Jidong Zhai, Zhen Zheng, Youngmin Yi, Xipeng Shen |
| 2021 | PPoPP | Exploring deep reuse in winograd CNN inference. | Ruofan Wu, Feng Zhang, Zhen Zheng, Xiaoyong Du, Xipeng Shen |
| 2021 | RTAS | Brief Industry Paper: Towards Real-Time 3D Object Detection for Autonomous Vehicles with Pruning Search. | Pu Zhao, Wei Niu, Geng Yuan, Yuxuan Cai, Hsin-Hsuan Sung, Shaoshan Liu, Sijia Liu, Xipeng Shen, Bin Ren, Yanzhi Wang, Xue Lin |
| 2020 | ASPLOS | MERR: Improving Security of Persistent Memory Objects via Efficient Memory Exposure Reduction and Randomization. | Yuanchao Xu, Yan Solihin, Xipeng Shen |
| 2020 | ICDE | Enabling Efficient Random Access to Hierarchically-Compressed Data. | Feng Zhang, Jidong Zhai, Xipeng Shen, Onur Mutlu, Xiaoyong Du |
| 2020 | ISCA | Hardware-Based Domain Virtualization for Intra-Process Isolation of Persistent Memory Objects. | Yuanchao Xu, Chencheng Ye, Yan Solihin, Xipeng Shen |
| 2020 | ICS | MKPipe: a compiler framework for optimizing multi-kernel workloads in OpenCL for FPGA. | Ji Liu, Abdullah-Al Kafi, Xipeng Shen, Huiyang Zhou |
| 2020 | ICSE | HARP: holistic analysis for refactoring Python-based analytics programs. | Weijie Zhou, Yue Zhao, Guoqiang Zhang, Xipeng Shen |
| 2019 | ASPLOS | HiWayLib: A Software Framework for Enabling High Performance Communications for Heterogeneous Pipeline Computations. | Zhen Zheng, Chanyoung Oh, Jidong Zhai, Xipeng Shen, Youngmin Yi, Wenguang Chen |
| 2019 | CIKM | Streamline Density Peak Clustering for Practical Adoptions. | Shuai Yang, Xipeng Shen, Min Chi |
| 2019 | ICDE | Adaptive Deep Reuse: Accelerating CNN Training on the Fly. | Lin Ning, Hui Guan, Xipeng Shen |
| 2019 | ICS | Deep reuse: streamline CNN inference on the fly via coarse-grained computation reuse. | Lin Ning, Xipeng Shen |
| 2019 | PLDI | Wootz: a compiler-based framework for fast CNN pruning via composability. | Hui Guan, Xipeng Shen, Seung-Hwan Lim |
| 2019 | PPoPP | GOPipe: a granularity-oblivious programming framework for pipelined stencil executions on GPU. | Chanyoung Oh, Zhen Zheng, Xipeng Shen, Jidong Zhai, Youngmin Yi |
| 2018 | CC | Rethinking compilers in the rise of machine learning and AI (keynote). | Xipeng Shen |
| 2018 | CIKM | FALCON: A Fast Drop-In Replacement of Citation KNN for Multiple Instance Learning. | Shuai Yang, Xipeng Shen |
| 2018 | ICDE | Reuse-Centric K-Means Configuration. | Hui Guan, Yufei Ding, Xipeng Shen, Hamid Krim |
| 2018 | ICDM | LEEM: Lean Elastic EM for Gaussian Mixture Model via Bounds-Based Filtering. | Shuai Yang, Xipeng Shen |
| 2018 | ICS | Zwift: A Programming Framework for High Performance Text Analytics on Compressed Data. | Feng Zhang, Jidong Zhai, Xipeng Shen, Onur Mutlu, Wenguang Chen |
| 2018 | PPoPP | Bridging the gap between deep learning and sparse matrix format selection. | Yue Zhao, Jiajia Li, Chunhua Liao, Xipeng Shen |
| 2018 | SC | Exploring flexible communications for streamlining DNN ensemble training pipelines. | Randall Pittman, Hui Guan, Xipeng Shen, Seung-Hwan Lim, Robert M. Patton |
| 2017 | ICDE | Sweet KNN: An Efficient KNN on GPU through Reconciliation between Redundancy Removal and Regularity. | Guoyang Chen, Yufei Ding, Xipeng Shen |
| 2017 | ICDM | LCD: A Fast Contrastive Divergence Based Algorithm for Restricted Boltzmann Machine. | Lin Ning, Randall Pittman, Xipeng Shen |
| 2017 | MICRO | Efficient support of position independence on non-volatile memory. | Guoyang Chen, Lei Zhang, Richa Budhiraja, Xipeng Shen, Youfeng Wu |
| 2017 | MICRO | Versapipe: a versatile programming framework for pipelined computing on GPU. | Zhen Zheng, Chanyoung Oh, Jidong Zhai, Xipeng Shen, Youngmin Yi, Wenguang Chen |
| 2017 | PLDI | Generalizations of the theory and deployment of triangular inequality for compiler-based strength reduction. | Yufei Ding, Lin Ning, Hui Guan, Xipeng Shen |
| 2017 | PPoPP | EffiSha: A Software Framework for Enabling Effficient Preemptive Scheduling of GPU. | Guoyang Chen, Yue Zhao, Xipeng Shen, Huiyang Zhou |
| 2017 | PPoPP | POSTER: An Infrastructure for HPC Knowledge Sharing and Reuse. | Yue Zhao, Chunhua Liao, Xipeng Shen |
| 2017 | SC | Egeria: a framework for automatic synthesis of HPC advising tools through multi-layered natural language processing. | Hui Guan, Xipeng Shen, Hamid Krim |
| 2016 | ECOOP | Towards Ontology-Based Program Analysis. | Yue Zhao, Guoyang Chen, Chunhua Liao, Xipeng Shen |
| 2016 | ICS | Coherence-Free Multiview: Enabling Reference-Discerning Data Placement on GPU. | Guoyang Chen, Xipeng Shen |
| 2016 | PPoPP | Data-centric combinatorial optimization of parallel code. | Hao Luo, Guoyang Chen, Pengcheng Li, Chen Ding, Xipeng Shen |
| 2015 | ASPLOS | On-the-Fly Principled Speculation for FSM Parallelization. | Zhijia Zhao, Xipeng Shen |
| 2015 | HotOS | Software Engagement with Sleeping CPUs. | Qi Zhu, Meng Zhu, Bo Wu, Xipeng Shen, Kai Shen, Zhiying Wang |
| 2015 | ICML | Yinyang K-Means: A Drop-In Replacement of the Classic K-Means with Consistent Speedup. | Yufei Ding, Yue Zhao, Xipeng Shen, Madanlal Musuvathi, Todd Mytkowicz |
| 2015 | ICS | Enabling and Exploiting Flexible Task Assignment on GPU through SM-Centric Program Transformations. | Bo Wu, Guoyang Chen, Dong Li, Xipeng Shen, Jeffrey S. Vetter |
| 2015 | MICRO | Free launch: optimizing GPU dynamic kernel launches through thread reuse. | Guoyang Chen, Xipeng Shen |
| 2015 | PLDI | Autotuning algorithmic choice for input sensitivity. | Yufei Ding, Jason Ansel, Kalyan Veeramachaneni, Xipeng Shen, Una-May O'Reilly, Saman P. Amarasinghe |
| 2015 | SC | Enhancing domain specific language implementations through ontology. | Chunhua Liao, Pei-Hung Lin, Daniel J. Quinlan, Yue Zhao, Xipeng Shen |
| 2014 | ASPLOS | Finding the limit: examining the potential and complexity of compilation scheduling for JIT-based runtime systems. | Yufei Ding, Mingzhou Zhou, Zhijia Zhao, Sarah Eisenstat, Xipeng Shen |
| 2014 | ASPLOS | Challenging the "embarrassingly sequential": parallelizing finite state machine-based computations through principled speculation. | Zhijia Zhao, Bo Wu, Xipeng Shen |
| 2014 | MICRO | PORPLE: An Extensible Optimizer for Portable Data Placement on GPU. | Guoyang Chen, Bo Wu, Dong Li, Xipeng Shen |
| 2014 | OOPSLA | Call sequence prediction through probabilistic calling automata. | Zhijia Zhao, Bo Wu, Mingzhou Zhou, Yufei Ding, Jianhua Sun, Xipeng Shen, Youfeng Wu |
| 2014 | OOPSLA | Space-efficient multi-versioning for input-adaptive feedback-driven program optimizations. | Mingzhou Zhou, Xipeng Shen, Yaoqing Gao, Graham Yiu |
| 2013 | CGO | Profmig: A framework for flexible migration of program profiles across software versions. | Mingzhou Zhou, Bo Wu, Yufei Ding, Xipeng Shen |
| 2013 | ECOOP | Simple Profile Rectifications Go a Long Way - Statistically Exploring and Alleviating the Effects of Sampling Errors for Program Optimizations. | Bo Wu, Mingzhou Zhou, Xipeng Shen, Yaoqing Gao, Ral Silvera, Graham Yiu |
| 2013 | MASCOTS | A Versatile Performance and Energy Simulation Tool for Composite GPU Global Memory. | Bin Wang, Yizheng Jiao, Weikuan Yu, Xipeng Shen, Dong Li, Jeffrey S. Vetter |
| 2013 | OOPSLA | Do computer programs have to be as dumb as they are?: input-centric dynamic program optimizations. | Xipeng Shen |
| 2013 | PLDI | Software-level scheduling to exploit non-uniformly shared data cache on GPGPU. | Bo Wu, Weilin Wang, Xipeng Shen |
| 2013 | PPoPP | Complexity analysis and algorithm design for reorganizing data to minimize non-coalesced memory accesses on GPU. | Bo Wu, Zhijia Zhao, Eddy Zheng Zhang, Yunlian Jiang, Xipeng Shen |
| 2012 | ICS | One stone two birds: synchronization relaxation and redundancy removal in GPU-CPU translation. | Ziyu Guo, Bo Wu, Xipeng Shen |
| 2012 | JSSPP | Optimal Co-Scheduling to Minimize Makespan on Chip Multiprocessors. | Kai Tian, Yunlian Jiang, Xipeng Shen, Weizhen Mao |
| 2012 | OOPSLA | Exploiting inter-sequence correlations for program behavior prediction. | Bo Wu, Zhijia Zhao, Xipeng Shen, Yunlian Jiang, Yaoqing Gao, Ral Silvera |
| 2012 | PLDI | A study towards optimal data layout for GPU computing. | Eddy Z. Zhang, Han Li, Xipeng Shen |
| 2011 | ASPLOS | On-the-fly elimination of dynamic irregularities for GPU computing. | Eddy Z. Zhang, Yunlian Jiang, Ziyu Guo, Kai Tian, Xipeng Shen |
| 2011 | OOPSLA | A step towards transparent integration of input-consciousness into dynamic program optimizations. | Kai Tian, Eddy Z. Zhang, Xipeng Shen |
| 2010 | CC | Is Reuse Distance Applicable to Data Locality Analysis on Chip Multiprocessors? | Yunlian Jiang, Eddy Z. Zhang, Kai Tian, Xipeng Shen |
| 2010 | CGO | Exploiting statistical correlations for proactive prediction of program behaviors. | Yunlian Jiang, Eddy Z. Zhang, Kai Tian, Feng Mao, Malcom Gethers, Xipeng Shen, Yaoqing Gao |
| 2010 | ICS | Streamlining GPU applications on the fly: thread divergence elimination through runtime thread-data remapping. | Eddy Z. Zhang, Yunlian Jiang, Ziyu Guo, Xipeng Shen |
| 2010 | NPC | LU Decomposition on Cell Broadband Engine: An Empirical Study to Exploit Heterogeneous Chip Multiprocessors. | Feng Mao, Xipeng Shen |
| 2010 | OOPSLA | An input-centric paradigm for program dynamic optimizations. | Kai Tian, Yunlian Jiang, Eddy Z. Zhang, Xipeng Shen |
| 2010 | PPoPP | Does cache sharing on modern CMP matter to the performance of contemporary multithreaded programs? | Eddy Z. Zhang, Yunlian Jiang, Xipeng Shen |
| 2009 | CGO | Cross-Input Learning and Discriminative Prediction in Evolvable Virtual Machines. | Feng Mao, Xipeng Shen |
| 2009 | ICPADS | Speculation with Little Wasting: Saving Cost in Software Speculation through Transparent Learning. | Yunlian Jiang, Feng Mao, Xipeng Shen |
| 2009 | VEE | Influence of program inputs on the selection of garbage collectors. | Feng Mao, Eddy Z. Zhang, Xipeng Shen |
| 2008 | EuroPar | Exploration of the Influence of Program Inputs on CMP Co-scheduling. | Yunlian Jiang, Xipeng Shen |
| 2008 | ICPP | Adaptive Software Speculation for Enhancing the Cost-Efficiency of Behavior-Oriented Parallelization. | Yunlian Jiang, Xipeng Shen |
| 2007 | PLDI | Software behavior oriented parallelization. | Chen Ding, Xipeng Shen, Kirk Kelsey, Chris Tice, Ruke Huang, Chengliang Zhang |
| 2007 | POPL | Locality approximation using time. | Xipeng Shen, Jonathan Shaw, Brian Meeker, Chen Ding |
| 2005 | ICS | Lightweight reference affinity analysis. | Xipeng Shen, Yaoqing Gao, Chen Ding, Roch Archambault |
| 2004 | ASPLOS | Locality phase prediction. | Xipeng Shen, Yutao Zhong, Chen Ding |
| 2004 | ICPP | Adaptive Data Partition for Sorting Using Probability Distribution. | Xipeng Shen, Chen Ding |
| 2004 | PLDI | Array regrouping and structure splitting using whole-program reference affinity. | Yutao Zhong, Maksim Orlovich, Xipeng Shen, Chen Ding |
| 2001 | Interspeech | Study and auto-detection of stress based on tonal pitch range in Mandarin. | Xipeng Shen, Bo Xu |
| 2001 | Interspeech | The study of the effect of training set on statistical language modeling. | Xipeng Shen, Bo Xu |