Xiaobing Feng
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
62
Venues
28
Active years
2008–2026
Best venue rank
A*
Where they publish
- ACGO12 papers
- BPPoPP6 papers
- BEuroPar4 papers
- A*ASPLOS4 papers
- CNPC4 papers
- ASC3 papers
- AICS3 papers
- ASANER2 papers
- CQRS2 papers
- A*OSDI2 papers
- CISPA2 papers
- CICANN2 papers
- CISCAS1 paper
- BCOLING1 paper
- BICONIP1 paper
- NationalNSDI1 paper
- AISSRE1 paper
- BICPP1 paper
- BISPASS1 paper
- MulticonferenceICASSP1 paper
- BCC1 paper
- A*PLDI1 paper
- A*SOSP1 paper
- BIJCNN1 paper
- A*ISCA1 paper
- A*ICSE1 paper
- CPDCAT1 paper
- NationalICNC1 paper
Papers
62 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | CGO | From Threads to Tiles: T2T, a Compiler for CUDA-to-NPU Translation via 2D Vectorization. | Shuaijiang Li, Jiacheng Zhao, Ying Liu, Shuoming Zhang, Lei Chen, Yijin Li, Yangyu Zhang, Zhicheng Li, Runyu Zhou, Xiyu Shi, Chunwei Xia, Yuan Wen, Xiaobing Feng, Huimin Cui |
| 2026 | CGO | Progressive Low-Precision Approximation of Tensor Operators on GPUs: Enabling Greater Trade-Offs between Performance and Accuracy. | Fan Luo, Guangli Li, Zhaoyang Hao, Xueying Wang, Xiaobing Feng, Huimin Cui, Jingling Xue |
| 2026 | EuroPar | DACOS: Dependency-Aware Cross-Kernel Overlapping for Optimizing Short-Sequence Workloads in LLM Applications. | Zhaoyang Hao, Guangli Li, Fan Luo, Hao Qian, Xueying Wang, Jiacheng Zhao, Xiaobing Feng, Huimin Cui, Jingling Xue |
| 2026 | ISCAS | Visual Geometric 6-DoF Grasping: A Multi-View Framework with Sparse RGB Observations. | Yixiang Dai, Kaiqin Yang, Haoran Zhu, Ruiyang Li, Yongjiang Zhao, Xiaobing Feng, Huimin Ma, Siang Chen, Guijin Wang |
| 2026 | SANER | A Multi-Modal Retrieval-Augmented Framework for Compiler Backend Generation with LLMs. | Ming Zhong, Fang Lv, Hongna Geng, Xin Sun, Lulin Wang, Lei Qiu, Huimin Cui, Xiaobing Feng |
| 2025 | CGO | Qiwu: Exploiting Ciphertext-Level SIMD Parallelism in Homomorphic Encryption Programs. | Zhongcheng Zhang, Ying Liu, Yuyang Zhang, Zhenchuan Chen, Jiacheng Zhao, Xiaobing Feng, Huimin Cui, Jingling Xue |
| 2025 | CGO | VEGA: Automatically Generating Compiler Backends using a Pre-trained Transformer Model. | Ming Zhong, Fang Lv, Lulin Wang, Lei Qiu, Yingying Wang, Ying Liu, Huimin Cui, Xiaobing Feng, Jingling Xue |
| 2025 | COLING | RIRAG: A Bi-Directional Retrieval-Enhanced Framework for Financial Legal QA in ObliQA Shared Task. | Xinyan Zhang, Xiaobing Feng, Xiujuan Xu, Zhiliang Zheng, Kai Wu |
| 2025 | EuroPar | TopServe: Task-Operator Co-scheduling for Efficient Multi-DNN Inference Serving on GPUs. | Ao Chen, Guangli Li, Feng Yu, Xueying Wang, Jiacheng Zhao, Huimin Cui, Xiaobing Feng, Jingling Xue |
| 2025 | ICONIP | ReLOpt: A Retriever-Augmented Framework for Optimizing Code with Long-Range Dependencies. | Lei Qiu, Fang Lyu, Ming Zhong, Lulin Wang, Xiaobing Feng |
| 2025 | NSDI | Beehive: A Scalable Disaggregated Memory Runtime Exploiting Asynchrony of Multithreaded Programs. | Quanxi Li, Hong Huang, Ying Liu, Yanwen Xia, Jie Zhang, Mosong Zhou, Xiaobing Feng, Huimin Cui, Quan Chen, Yizhou Shan, Chenxi Wang |
| 2025 | PPoPP | TensorMD: Molecular Dynamics Simulation with Ab Initio Accuracy of 50 Billion Atoms. | Yucheng Ouyang, Ying Liu, Honghui Shang, Zhenchuan Chen, Jiahao Shan, Huimin Cui, Xiaobing Feng, Xin Chen, Xingyu Gao, Lifang Wang, Haifeng Song, Xin Chen, Rongfen Lin, Fang Li |
| 2025 | QRS | RIRAG+: A Cross-Jurisdictional Financial Legal QA Framework Bridging Civil and Common Law Systems. | Xinyan Zhang, Xiaobing Feng, Xiujuan Xu, Zhiliang Zheng, Rongxuan Zhao |
| 2025 | SC | TENSORMD: Accelerating Molecular Dynamics with a High-Performance Machine Learning Interatomic Potential. | Yucheng Ouyang, Xin Chen, Ying Liu, Xin Chen, Honghui Shang, Zhenchuan Chen, Rongfen Lin, Xingyu Gao, Lifang Wang, Fang Li, Jiahao Shan, Haifeng Song, Huimin Cui, Xiaobing Feng, Jingling Xue |
| 2025 | SANER | Boosting Large Language Models for System Software Retargeting: A Preliminary Study. | Ming Zhong, Fang Lv, Lulin Wang, Lei Qiu, Hongna Geng, Huimin Cui, Xiaobing Feng |
| 2024 | ASPLOS | Optimizing Deep Learning Inference via Global Analysis and Tensor Expressions. | Chunwei Xia, Jiacheng Zhao, Qianqi Sun, Zheng Wang, Yuan Wen, Teng Yu, Xiaobing Feng, Huimin Cui |
| 2024 | ASPLOS | Optimizing Dynamic-Shape Neural Networks on Accelerators via On-the-Fly Micro-Kernel Polymerization. | Feng Yu, Guangli Li, Jiacheng Zhao, Huimin Cui, Xiaobing Feng, Jingling Xue |
| 2024 | OSDI | A Tale of Two Paths: Toward a Hybrid Data Plane for Efficient Far-Memory Applications. | Lei Chen, Shi Liu, Chenxi Wang, Haoran Ma, Yifan Qiao, Zhe Wang, Chenggang Wu, Youyou Lu, Xiaobing Feng, Huimin Cui, Shan Lu, Harry Xu |
| 2024 | QRS | Wuli-Shili-Renli-Jili System Approach and Its Application in Large Model Value Alignment. | Jiayin Qi, Kun Jia, Yuxin Zhang, Xiaobing Feng, Haiyan Yan |
| 2024 | SC | Pushing the Limit of Quantum Mechanical Simulation to the Raman Spectra of a Biological System with 100 Million Atoms. | Honghui Shang, Ying Liu, Zhikun Wu, Zhenchuan Chen, Jinfeng Liu, Meiyue Shao, Yingzhou Li, Bowen Kan, Huimin Cui, Xiaobing Feng, Yunquan Zhang, Donald G. Truhlar, Hong An, Xiao He, Jinlong Yang |
| 2023 | ASPLOS | Occamy: Elastically Sharing a SIMD Co-processor across Multiple CPU Cores. | Zhongcheng Zhang, Yan Ou, Ying Liu, Chenxi Wang, Yongbin Zhou, Xiaoyu Wang, Yuyang Zhang, Yucheng Ouyang, Jiahao Shan, Ying Wang, Jingling Xue, Huimin Cui, Xiaobing Feng |
| 2023 | ISSRE | OPTango: Multi-central Representation Learning against Innumerable Compiler Optimization for Binary Diffing. | Hongna Geng, Ming Zhong, Peihua Zhang, Fang Lv, Xiaobing Feng |
| 2023 | OSDI | Honeycomb: Secure and Efficient GPU Executions via Static Validation. | Haohui Mai, Jiacheng Zhao, Hongren Zheng, Yiyang Zhao, Zibin Liu, Mingyu Gao, Cong Wang, Huimin Cui, Xiaobing Feng, Christos Kozyrakis |
| 2023 | SC | Portable and Scalable All-Electron Quantum Perturbation Simulations on Exascale Supercomputers. | Zhikun Wu, Yangjun Wu, Ying Liu, Honghui Shang, Yingxiang Gao, Zhongcheng Zhang, Yuyang Zhang, Yingchi Long, Xiaobing Feng, Huimin Cui |
| 2021 | CGO | Unleashing the Low-Precision Computation Potential of Tensor Cores on GPUs. | Guangli Li, Jingling Xue, Lei Liu, Xueying Wang, Xiu Ma, Xiao Dong, Jiansong Li, Xiaobing Feng |
| 2021 | ICPP | LoWino: Towards Efficient Low-Precision Winograd Convolutions on Modern CPUs. | Guangli Li, Zhen Jia, Xiaobing Feng, Yida Wang |
| 2021 | ISPA | Understanding the Runtime Overheads of Deep Learning Inference on Edge Devices. | Xiu Ma, Guangli Li, Lei Liu, Huaxiao Liu, Lei Liu, Xiaobing Feng |
| 2021 | ISPASS | Pinpointing the Memory Behaviors of DNN Training. | Jiansong Li, Xiao Dong, Guangli Li, Peng Zhao, Xueying Wang, Xiaobing Chen, Xianzhi Yu, Yongxin Yang, Zihan Jiang, Wei Cao, Lei Liu, Xiaobing Feng |
| 2020 | EuroPar | Accelerating Deep Learning Inference with Cross-Layer Data Reuse on GPUs. | Xueying Wang, Guangli Li, Xiao Dong, Jiansong Li, Lei Liu, Xiaobing Feng |
| 2020 | ICASSP | Lance: efficient low-precision quantized winograd convolution for neural networks based on graphics processing units. | Guangli Li, Lei Liu, Xueying Wang, Xiu Ma, Xiaobing Feng |
| 2020 | ISPA | Characterizing the I/O Pipeline in the Deployment of CNNs on Commercial Accelerators. | Jiansong Li, Zihan Jiang, Fangxin Liu, Xiao Dong, Guangli Li, Xueying Wang, Wei Cao, Lei Liu, Yanzhi Wang, Tao Li, Xiaobing Feng |
| 2020 | NPC | Compiler-Assisted Operator Template Library for DNN Accelerators. | Jiansong Li, Wei Cao, Xiao Dong, Guangli Li, Xueying Wang, Lei Liu, Xiaobing Feng |
| 2019 | CC | PPOpenCL: a performance-portable OpenCL compiler with host and kernel thread code fusion. | Ying Liu, Lei Huang, Mingchuan Wu, Huimin Cui, Fang Lv, Xiaobing Feng, Jingling Xue |
| 2019 | CGO | Accelerating GPU Computing at Runtime with Binary Optimization. | Guangli Li, Lei Liu, Xiaobing Feng |
| 2019 | PLDI | Panthera: holistic memory management for big data processing over hybrid memories. | Chenxi Wang, Huimin Cui, Ting Cao, John N. Zigman, Haris Volos, Onur Mutlu, Fang Lv, Xiaobing Feng, Guoqing Harry Xu |
| 2019 | PPoPP | Exploiting the input sparsity to accelerate deep neural networks: poster. | Xiao Dong, Lei Liu, Guangli Li, Jiansong Li, Peng Zhao, Xueying Wang, Xiaobing Feng |
| 2019 | SOSP | CrashTuner: detecting crash-recovery bugs in cloud systems via meta-info analysis. | Jie Lu, Chen Liu, Lian Li, Xiaobing Feng, Feng Tan, Jun Yang, Liang You |
| 2018 | CGO | May-happen-in-parallel analysis with static vector clocks. | Qing Zhou, Lian Li, Lei Wang, Jingling Xue, Xiaobing Feng |
| 2018 | ICANN | Fast CNN Pruning via Redundancy-Aware Training. | Xiao Dong, Lei Liu, Guangli Li, Peng Zhao, Xiaobing Feng |
| 2018 | ICANN | Auto-tuning Neural Network Quantization Framework for Collaborative Inference Between the Cloud and Edge. | Guangli Li, Lei Liu, Xueying Wang, Xiao Dong, Peng Zhao, Xiaobing Feng |
| 2018 | IJCNN | Background Subtraction on Depth Videos with Convolutional Neural Networks. | Xueying Wang, Lei Liu, Guangli Li, Xiao Dong, Peng Zhao, Xiaobing Feng |
| 2018 | ICS | Revisiting Loop Tiling for Datacenters: Live and Let Live. | Jiacheng Zhao, Huimin Cui, Yalin Zhang, Jingling Xue, Xiaobing Feng |
| 2018 | NPC | On Retargeting the AI Programming Framework to New Hardwares. | Jiacheng Zhao, Yisong Chang, Denghui Li, Chunwei Xia, Huimin Cui, Ke Zhang, Xiaobing Feng |
| 2018 | PPoPP | Lazygraph: lazy data coherency for replicas in distributed graph-parallel computation. | Lei Wang, Liangji Zhuang, Junhang Chen, Huimin Cui, Fang Lv, Ying Liu, Xiaobing Feng |
| 2016 | NPC | Efficient Management for Hybrid Memory in Managed Language Runtime. | Chenxi Wang, Ting Cao, John N. Zigman, Fang Lv, Yunquan Zhang, Xiaobing Feng |
| 2016 | PPoPP | Articulation points guided redundancy elimination for betweenness centrality. | Lei Wang, Fan Yang, Liangji Zhuang, Huimin Cui, Fang Lv, Xiaobing Feng |
| 2015 | ASPLOS | PuDianNao: A Polyvalent Machine Learning Accelerator. | Dao-Fu Liu, Tianshi Chen, Shaoli Liu, Jinhong Zhou, Shengyuan Zhou, Olivier Temam, Xiaobing Feng, Xuehai Zhou, Yunji Chen |
| 2015 | ISCA | ShiDianNao: shifting vision processing closer to the sensor. | Zidong Du, Robert Fasthuber, Tianshi Chen, Paolo Ienne, Ling Li, Tao Luo, Xiaobing Feng, Yunji Chen, Olivier Temam |
| 2015 | ICS | Hadoop+: Modeling and Evaluating the Heterogeneity for MapReduce Applications in Heterogeneous Clusters. | Wenting He, Huimin Cui, Binbin Lu, Jiacheng Zhao, Shengmei Li, Gong Ruan, Jingling Xue, Xiaobing Feng, Wensen Yang, Youliang Yan |
| 2015 | ICSE | ReCBuLC: Reproducing Concurrency Bugs Using Local Clocks. | Xiang Yuan, Chenggang Wu, Zhenjiang Wang, Jianjun Li, Pen-Chung Yew, Jeff Huang, Xiaobing Feng, Yanyan Lan, Yunji Chen, Yong Guan |
| 2014 | PPoPP | Concurrency bug localization using shared memory access pairs. | Wenwen Wang, Chenggang Wu, Pen-Chung Yew, Xiang Yuan, Zhenjiang Wang, Jianjun Li, Xiaobing Feng |
| 2013 | CGO | Effective fault localization based on minimum debugging frontier set. | Feng Li, Wei Huo, Congming Chen, Lujie Zhong, Xiaobing Feng, Zhiyuan Li |
| 2012 | PDCAT | Can We Make It Faster? Efficient May-Happen-in-Parallel Analysis Revisited. | Congming Chen, Wei Huo, Lung Li, Xiaobing Feng, Kai Xing |
| 2011 | CGO | Extendable pattern-oriented optimization directives. | Huimin Cui, Jingling Xue, Lei Wang, Yang Yang, Xiaobing Feng, Dongrui Fan |
| 2011 | ICNC | Parallelizing a machine translation decoder for multicore computer. | Long Chen, Wei Huo, Haitao Mi, Zhaoqing Zhang, Xiaobing Feng, Zhiyuan Li |
| 2010 | CGO | An adaptive task creation strategy for work-stealing scheduling. | Lei Wang, Huimin Cui, Yuelu Duan, Fang Lu, Xiaobing Feng, Pen-Chung Yew |
| 2010 | CGO | Level by level: making flow- and context-sensitive pointer analysis scalable for millions of lines of code. | Hongtao Yu, Jingling Xue, Wei Huo, Xiaobing Feng, Zhaoqing Zhang |
| 2010 | NPC | Software-Hardware Cooperative DRAM Bank Partitioning for Chip Multiprocessors. | Wei Mi, Xiaobing Feng, Jingling Xue, Yao-Cang Jia |
| 2010 | PPoPP | Continuous speculative program parallelization in software. | Chao Zhang, Chen Ding, Xiaoming Gu, Kirk Kelsey, Tongxin Bai, Xiaobing Feng |
| 2009 | CGO | Detecting and Eliminating Potential Violations of Sequential Consistency for Concurrent C/C++ Programs. | Yuelu Duan, Xiaobing Feng, Lei Wang, Chao Zhang, Pen-Chung Yew |
| 2008 | EuroPar | Global Tiling for Communication Minimal Parallelization on Distributed Memory Systems. | Lei Liu, Li Chen, Chengyong Wu, Xiaobing Feng |
| 2008 | ICS | Exploiting idle register classes for fast spill destination. | Fang Lu, Lei Wang, Xiaobing Feng, Zhiyuan Li, Zhaoqing Zhang |