Skip to content

Xipeng Shen

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

111

Venues

40

Active years

2001–2026

Best venue rank

A*

Where they publish

Papers

111 indexed papers, newest first.

YearVenueTitleAuthors
2026ASPLOSCPU-Oblivious Offloading of Failure-Atomic Transactions for Disaggregated Memory.Cheng Chen, Chencheng Ye, Yuanchao Xu, Xipeng Shen, Xiaofei Liao, Hai Jin, Wenbin Jiang, Yan Solihin
2026CGOSparseX: Synergizing GPU Libraries for Sparse Matrix Multiplication on Heterogeneous Processors.Ruifeng Zhang, Xiangwei Wang, Ang Li, Xipeng Shen
2025ACLA Drop-In Solution for On-the-Fly Adaptation of Speculative Decoding in Large Language Models.Jiesong Liu, Brian Park, Xipeng Shen
2025ASPLOSGeneralizing Reuse Patterns for Efficient DNN on Microcontrollers.Jiesong Liu, Bin Ren, Xipeng Shen
2025HPDCFluidFaaS: A Dynamic Pipelined Solution for Serverless Computing with Strong Isolation-based GPU Sharing.Xinning Hui, Yuanchao Xu, Xipeng Shen
2025KDDEfficient End-to-end Language Model Fine-tuning on Graphs.Rui Xue, Xipeng Shen, Ruozhou Yu, Xiaorui Liu
2025PPoPPAccelerating GNNs on GPU Sparse Tensor Cores through N: M Sparsity-Oriented Graph Reordering.Jou-An Chen, Hsin-Hsuan Sung, Ruifeng Zhang, Ang Li, Xipeng Shen
2025SIGMETRICSExploring Function Granularity for Serverless Machine Learning Application with GPU Sharing.Xinning Hui, Yuanchao Xu, Xipeng Shen
2024ASPLOSSmartMem: Layout Transformation Elimination and Adaptation for Efficient DNN Execution on Mobile.Wei Niu, Md. Musfiqur Rahman Sanim, Zhihao Shu, Jiexiong Guan, Xipeng Shen, Miao Yin, Gagan Agrawal, Bin Ren
2024DATEDACO: Pursuing Ultra-low Power Consumption via DNN-Adaptive CPU-GPU CO-optimization on Mobile Devices.Yushu Wu, Chao Wu, Geng Yuan, Yanyu Li, Weichao Guo, Jing Rao, Xipeng Shen, Bin Ren, Yanzhi Wang
2024EuroSysWiseGraph: Optimizing GNN with Joint Workload Partition of Graph and Operations.Kezhao Huang, Jidong Zhai, Liyan Zheng, Haojie Wang, Yuyang Jin, Qihao Zhang, Runqing Zhang, Zhen Zheng, Youngmin Yi, Xipeng Shen
2024HPCAData Enclave: A Data-Centric Trusted Execution Environment.Yuanchao Xu, James Pangia, Chencheng Ye, Yan Solihin, Xipeng Shen
2024HPDCESG: Pipeline-Conscious Efficient Scheduling of DNN Workflows on Serverless Platforms with Shareable GPUs.Xinning Hui, Yuanchao Xu, Zhishan Guo, Xipeng Shen
2023ASPLOSSpace-Efficient TREC for Enabling Deep Learning on Microcontrollers.Jiesong Liu, Feng Zhang, Jiawei Guan, Hsin-Hsuan Sung, Xiaoguang Guo, Xiaoyong Du, Xipeng Shen
2023ASPLOSSpecPMT: Speculative Logging for Resolving Crash Consistency Overhead of Persistent Memory.Chencheng Ye, Yuanchao Xu, Xipeng Shen, Yan Sha, Xiaofei Liao, Hai Jin, Yan Solihin
2023HPCAReconciling Selective Logging and Hardware Persistent Memory Transaction.Chencheng Ye, Yuanchao Xu, Xipeng Shen, Yan Sha, Xiaofei Liao, Hai Jin, Yan Solihin
2023ICSBitGNN: Unleashing the Performance Potential of Binary Graph Neural Networks on GPUs.Jou-An Chen, Hsin-Hsuan Sung, Xipeng Shen, Sutanay Choudhury, Ang Li
2023USENIXDecentralized Application-Level Adaptive Scheduling for Multi-Instance DNNs on Open Mobile Devices.Hsin-Hsuan Sung, Jou-An Chen, Wei Niu, Jiexiong Guan, Bin Ren, Xipeng Shen
2022CGOEnabling Near Real-Time NLU-Driven Natural Language Programming through Dynamic Grammar Graph-Based Translation.Zifan Nan, Xipeng Shen, Hui Guan
2022ECSAFinding Reusable Machine Learning Components to Build Programming Language Processing Pipelines.Patrick J. Flynn, Tristan Vanderbruggen, Chunhua Liao, Pei-Hung Lin, Murali Emani, Xipeng Shen
2022HPCATemporal Exposure Reduction Protection for Persistent Memory.Yuanchao Xu, Chencheng Ye, Xipeng Shen, Yan Solihin
2022ISCAFFCCD: fence-free crash-consistent concurrent defragmentation for persistent memory.Yuanchao Xu, Chencheng Ye, Yan Solihin, Xipeng Shen
2022ICSEIDE Augmented with Human-Learning Inspired Natural Language Programming.Mitchell Young, Zifan Nan, Xipeng Shen
2022MICROGCDWei Niu, Jiexiong Guan, Xipeng Shen, Yanzhi Wang, Gagan Agrawal, Bin Ren
2022WWWDREW: Efficient Winograd CNN Inference with Deep Reuse.Ruofan Wu, Feng Zhang, Jiawei Guan, Zhen Zheng, Xiaoyong Du, Xipeng Shen
2022RTASBrief Industry Paper: Enabling Level-4 Autonomous Driving on a Single $1k Off-the-Shelf Card.Hsin-Hsuan Sung, Yuanchao Xu, Jiexiong Guan, Wei Niu, Bin Ren, Yanzhi Wang, Shaoshan Liu, Xipeng Shen
2021AAAIRT3D: Achieving Real-Time Execution of 3D Convolutional Neural Networks on Mobile Devices.Wei Niu, Mengshu Sun, Zhengang Li, Jou-An Chen, Jiexiong Guan, Xipeng Shen, Yanzhi Wang, Sijia Liu, Xue Lin, Bin Ren
2021CCDeep NLP-based co-evolvement for synthesizing code analysis from natural language.Zifan Nan, Hui Guan, Xipeng Shen, Chunhua Liao
2021ECOOPBest-Effort Lazy Evaluation for Python Software Built on APIs.Guoqiang Zhang, Xipeng Shen
2021HPCAHardware-Based Address-Centric Acceleration of Key-Value Store.Chencheng Ye, Yuanchao Xu, Xipeng Shen, Xiaofei Liao, Hai Jin, Yan Solihin
2021ICDEG-TADOC: Enabling Efficient GPU-Based Text Analytics without Decompression.Feng Zhang, Zaifeng Pan, Yanliang Zhou, Jidong Zhai, Xipeng Shen, Onur Mutlu, Xiaoyong Du
2021ICDMRecurrent Neural Networks Meet Context-Free Grammar: Two Birds with One Stone.Hui Guan, Umana Chaudhary, Yuanchao Xu, Lin Ning, Lijun Zhang, Xipeng Shen
2021ICLRSimple Augmentation Goes a Long Way: ADRL for DNN Quantization.Lin Ning, Guoyang Chen, Weifeng Zhang, Xipeng Shen
2021IJCNNRevisit the Scalability of Deep Auto-Regressive Models for Graph Generation.Shuai Yang, Xipeng Shen, Seung-Hwan Lim
2021ISCASupporting Legacy Libraries on Non-Volatile Memory: A User-Transparent Approach.Chencheng Ye, Yuanchao Xu, Xipeng Shen, Xiaofei Liao, Hai Jin, Yan Solihin
2021MICROPCCS: Processor-Centric Contention-aware Slowdown Model for Heterogeneous System-on-Chips.Yuanchao Xu, Mehmet Esat Belviranli, Xipeng Shen, Jeffrey S. Vetter
2021PPoPPUnderstanding and bridging the gaps in current GNN performance optimizations.Kezhao Huang, Jidong Zhai, Zhen Zheng, Youngmin Yi, Xipeng Shen
2021PPoPPExploring deep reuse in winograd CNN inference.Ruofan Wu, Feng Zhang, Zhen Zheng, Xiaoyong Du, Xipeng Shen
2021RTASBrief Industry Paper: Towards Real-Time 3D Object Detection for Autonomous Vehicles with Pruning Search.Pu Zhao, Wei Niu, Geng Yuan, Yuxuan Cai, Hsin-Hsuan Sung, Shaoshan Liu, Sijia Liu, Xipeng Shen, Bin Ren, Yanzhi Wang, Xue Lin
2020ASPLOSMERR: Improving Security of Persistent Memory Objects via Efficient Memory Exposure Reduction and Randomization.Yuanchao Xu, Yan Solihin, Xipeng Shen
2020ICDEEnabling Efficient Random Access to Hierarchically-Compressed Data.Feng Zhang, Jidong Zhai, Xipeng Shen, Onur Mutlu, Xiaoyong Du
2020ISCAHardware-Based Domain Virtualization for Intra-Process Isolation of Persistent Memory Objects.Yuanchao Xu, Chencheng Ye, Yan Solihin, Xipeng Shen
2020ICSMKPipe: a compiler framework for optimizing multi-kernel workloads in OpenCL for FPGA.Ji Liu, Abdullah-Al Kafi, Xipeng Shen, Huiyang Zhou
2020ICSEHARP: holistic analysis for refactoring Python-based analytics programs.Weijie Zhou, Yue Zhao, Guoqiang Zhang, Xipeng Shen
2019ASPLOSHiWayLib: A Software Framework for Enabling High Performance Communications for Heterogeneous Pipeline Computations.Zhen Zheng, Chanyoung Oh, Jidong Zhai, Xipeng Shen, Youngmin Yi, Wenguang Chen
2019CIKMStreamline Density Peak Clustering for Practical Adoptions.Shuai Yang, Xipeng Shen, Min Chi
2019ICDEAdaptive Deep Reuse: Accelerating CNN Training on the Fly.Lin Ning, Hui Guan, Xipeng Shen
2019ICSDeep reuse: streamline CNN inference on the fly via coarse-grained computation reuse.Lin Ning, Xipeng Shen
2019PLDIWootz: a compiler-based framework for fast CNN pruning via composability.Hui Guan, Xipeng Shen, Seung-Hwan Lim
2019PPoPPGOPipe: a granularity-oblivious programming framework for pipelined stencil executions on GPU.Chanyoung Oh, Zhen Zheng, Xipeng Shen, Jidong Zhai, Youngmin Yi
2018CCRethinking compilers in the rise of machine learning and AI (keynote).Xipeng Shen
2018CIKMFALCON: A Fast Drop-In Replacement of Citation KNN for Multiple Instance Learning.Shuai Yang, Xipeng Shen
2018ICDEReuse-Centric K-Means Configuration.Hui Guan, Yufei Ding, Xipeng Shen, Hamid Krim
2018ICDMLEEM: Lean Elastic EM for Gaussian Mixture Model via Bounds-Based Filtering.Shuai Yang, Xipeng Shen
2018ICSZwift: A Programming Framework for High Performance Text Analytics on Compressed Data.Feng Zhang, Jidong Zhai, Xipeng Shen, Onur Mutlu, Wenguang Chen
2018PPoPPBridging the gap between deep learning and sparse matrix format selection.Yue Zhao, Jiajia Li, Chunhua Liao, Xipeng Shen
2018SCExploring flexible communications for streamlining DNN ensemble training pipelines.Randall Pittman, Hui Guan, Xipeng Shen, Seung-Hwan Lim, Robert M. Patton
2017ICDESweet KNN: An Efficient KNN on GPU through Reconciliation between Redundancy Removal and Regularity.Guoyang Chen, Yufei Ding, Xipeng Shen
2017ICDMLCD: A Fast Contrastive Divergence Based Algorithm for Restricted Boltzmann Machine.Lin Ning, Randall Pittman, Xipeng Shen
2017MICROEfficient support of position independence on non-volatile memory.Guoyang Chen, Lei Zhang, Richa Budhiraja, Xipeng Shen, Youfeng Wu
2017MICROVersapipe: a versatile programming framework for pipelined computing on GPU.Zhen Zheng, Chanyoung Oh, Jidong Zhai, Xipeng Shen, Youngmin Yi, Wenguang Chen
2017PLDIGeneralizations of the theory and deployment of triangular inequality for compiler-based strength reduction.Yufei Ding, Lin Ning, Hui Guan, Xipeng Shen
2017PPoPPEffiSha: A Software Framework for Enabling Effficient Preemptive Scheduling of GPU.Guoyang Chen, Yue Zhao, Xipeng Shen, Huiyang Zhou
2017PPoPPPOSTER: An Infrastructure for HPC Knowledge Sharing and Reuse.Yue Zhao, Chunhua Liao, Xipeng Shen
2017SCEgeria: a framework for automatic synthesis of HPC advising tools through multi-layered natural language processing.Hui Guan, Xipeng Shen, Hamid Krim
2016ECOOPTowards Ontology-Based Program Analysis.Yue Zhao, Guoyang Chen, Chunhua Liao, Xipeng Shen
2016ICSCoherence-Free Multiview: Enabling Reference-Discerning Data Placement on GPU.Guoyang Chen, Xipeng Shen
2016PPoPPData-centric combinatorial optimization of parallel code.Hao Luo, Guoyang Chen, Pengcheng Li, Chen Ding, Xipeng Shen
2015ASPLOSOn-the-Fly Principled Speculation for FSM Parallelization.Zhijia Zhao, Xipeng Shen
2015HotOSSoftware Engagement with Sleeping CPUs.Qi Zhu, Meng Zhu, Bo Wu, Xipeng Shen, Kai Shen, Zhiying Wang
2015ICMLYinyang K-Means: A Drop-In Replacement of the Classic K-Means with Consistent Speedup.Yufei Ding, Yue Zhao, Xipeng Shen, Madanlal Musuvathi, Todd Mytkowicz
2015ICSEnabling and Exploiting Flexible Task Assignment on GPU through SM-Centric Program Transformations.Bo Wu, Guoyang Chen, Dong Li, Xipeng Shen, Jeffrey S. Vetter
2015MICROFree launch: optimizing GPU dynamic kernel launches through thread reuse.Guoyang Chen, Xipeng Shen
2015PLDIAutotuning algorithmic choice for input sensitivity.Yufei Ding, Jason Ansel, Kalyan Veeramachaneni, Xipeng Shen, Una-May O'Reilly, Saman P. Amarasinghe
2015SCEnhancing domain specific language implementations through ontology.Chunhua Liao, Pei-Hung Lin, Daniel J. Quinlan, Yue Zhao, Xipeng Shen
2014ASPLOSFinding the limit: examining the potential and complexity of compilation scheduling for JIT-based runtime systems.Yufei Ding, Mingzhou Zhou, Zhijia Zhao, Sarah Eisenstat, Xipeng Shen
2014ASPLOSChallenging the "embarrassingly sequential": parallelizing finite state machine-based computations through principled speculation.Zhijia Zhao, Bo Wu, Xipeng Shen
2014MICROPORPLE: An Extensible Optimizer for Portable Data Placement on GPU.Guoyang Chen, Bo Wu, Dong Li, Xipeng Shen
2014OOPSLACall sequence prediction through probabilistic calling automata.Zhijia Zhao, Bo Wu, Mingzhou Zhou, Yufei Ding, Jianhua Sun, Xipeng Shen, Youfeng Wu
2014OOPSLASpace-efficient multi-versioning for input-adaptive feedback-driven program optimizations.Mingzhou Zhou, Xipeng Shen, Yaoqing Gao, Graham Yiu
2013CGOProfmig: A framework for flexible migration of program profiles across software versions.Mingzhou Zhou, Bo Wu, Yufei Ding, Xipeng Shen
2013ECOOPSimple Profile Rectifications Go a Long Way - Statistically Exploring and Alleviating the Effects of Sampling Errors for Program Optimizations.Bo Wu, Mingzhou Zhou, Xipeng Shen, Yaoqing Gao, Ral Silvera, Graham Yiu
2013MASCOTSA Versatile Performance and Energy Simulation Tool for Composite GPU Global Memory.Bin Wang, Yizheng Jiao, Weikuan Yu, Xipeng Shen, Dong Li, Jeffrey S. Vetter
2013OOPSLADo computer programs have to be as dumb as they are?: input-centric dynamic program optimizations.Xipeng Shen
2013PLDISoftware-level scheduling to exploit non-uniformly shared data cache on GPGPU.Bo Wu, Weilin Wang, Xipeng Shen
2013PPoPPComplexity analysis and algorithm design for reorganizing data to minimize non-coalesced memory accesses on GPU.Bo Wu, Zhijia Zhao, Eddy Zheng Zhang, Yunlian Jiang, Xipeng Shen
2012ICSOne stone two birds: synchronization relaxation and redundancy removal in GPU-CPU translation.Ziyu Guo, Bo Wu, Xipeng Shen
2012JSSPPOptimal Co-Scheduling to Minimize Makespan on Chip Multiprocessors.Kai Tian, Yunlian Jiang, Xipeng Shen, Weizhen Mao
2012OOPSLAExploiting inter-sequence correlations for program behavior prediction.Bo Wu, Zhijia Zhao, Xipeng Shen, Yunlian Jiang, Yaoqing Gao, Ral Silvera
2012PLDIA study towards optimal data layout for GPU computing.Eddy Z. Zhang, Han Li, Xipeng Shen
2011ASPLOSOn-the-fly elimination of dynamic irregularities for GPU computing.Eddy Z. Zhang, Yunlian Jiang, Ziyu Guo, Kai Tian, Xipeng Shen
2011OOPSLAA step towards transparent integration of input-consciousness into dynamic program optimizations.Kai Tian, Eddy Z. Zhang, Xipeng Shen
2010CCIs Reuse Distance Applicable to Data Locality Analysis on Chip Multiprocessors?Yunlian Jiang, Eddy Z. Zhang, Kai Tian, Xipeng Shen
2010CGOExploiting statistical correlations for proactive prediction of program behaviors.Yunlian Jiang, Eddy Z. Zhang, Kai Tian, Feng Mao, Malcom Gethers, Xipeng Shen, Yaoqing Gao
2010ICSStreamlining GPU applications on the fly: thread divergence elimination through runtime thread-data remapping.Eddy Z. Zhang, Yunlian Jiang, Ziyu Guo, Xipeng Shen
2010NPCLU Decomposition on Cell Broadband Engine: An Empirical Study to Exploit Heterogeneous Chip Multiprocessors.Feng Mao, Xipeng Shen
2010OOPSLAAn input-centric paradigm for program dynamic optimizations.Kai Tian, Yunlian Jiang, Eddy Z. Zhang, Xipeng Shen
2010PPoPPDoes cache sharing on modern CMP matter to the performance of contemporary multithreaded programs?Eddy Z. Zhang, Yunlian Jiang, Xipeng Shen
2009CGOCross-Input Learning and Discriminative Prediction in Evolvable Virtual Machines.Feng Mao, Xipeng Shen
2009ICPADSSpeculation with Little Wasting: Saving Cost in Software Speculation through Transparent Learning.Yunlian Jiang, Feng Mao, Xipeng Shen
2009VEEInfluence of program inputs on the selection of garbage collectors.Feng Mao, Eddy Z. Zhang, Xipeng Shen
2008EuroParExploration of the Influence of Program Inputs on CMP Co-scheduling.Yunlian Jiang, Xipeng Shen
2008ICPPAdaptive Software Speculation for Enhancing the Cost-Efficiency of Behavior-Oriented Parallelization.Yunlian Jiang, Xipeng Shen
2007PLDISoftware behavior oriented parallelization.Chen Ding, Xipeng Shen, Kirk Kelsey, Chris Tice, Ruke Huang, Chengliang Zhang
2007POPLLocality approximation using time.Xipeng Shen, Jonathan Shaw, Brian Meeker, Chen Ding
2005ICSLightweight reference affinity analysis.Xipeng Shen, Yaoqing Gao, Chen Ding, Roch Archambault
2004ASPLOSLocality phase prediction.Xipeng Shen, Yutao Zhong, Chen Ding
2004ICPPAdaptive Data Partition for Sorting Using Probability Distribution.Xipeng Shen, Chen Ding
2004PLDIArray regrouping and structure splitting using whole-program reference affinity.Yutao Zhong, Maksim Orlovich, Xipeng Shen, Chen Ding
2001InterspeechStudy and auto-detection of stress based on tonal pitch range in Mandarin.Xipeng Shen, Bo Xu
2001InterspeechThe study of the effect of training set on statistical language modeling.Xipeng Shen, Bo Xu