Huimin Cui
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
34
Venues
17
Active years
2010–2026
Best venue rank
A*
Where they publish
Papers
34 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | CGO | From Threads to Tiles: T2T, a Compiler for CUDA-to-NPU Translation via 2D Vectorization. | Shuaijiang Li, Jiacheng Zhao, Ying Liu, Shuoming Zhang, Lei Chen, Yijin Li, Yangyu Zhang, Zhicheng Li, Runyu Zhou, Xiyu Shi, Chunwei Xia, Yuan Wen, Xiaobing Feng, Huimin Cui |
| 2026 | CGO | Progressive Low-Precision Approximation of Tensor Operators on GPUs: Enabling Greater Trade-Offs between Performance and Accuracy. | Fan Luo, Guangli Li, Zhaoyang Hao, Xueying Wang, Xiaobing Feng, Huimin Cui, Jingling Xue |
| 2026 | EuroPar | DACOS: Dependency-Aware Cross-Kernel Overlapping for Optimizing Short-Sequence Workloads in LLM Applications. | Zhaoyang Hao, Guangli Li, Fan Luo, Hao Qian, Xueying Wang, Jiacheng Zhao, Xiaobing Feng, Huimin Cui, Jingling Xue |
| 2026 | ISCA | Symbiotic MLLM Serving: Dynamically Balancing Parallelism Across GPUs and Resources Within GPUs. | Zhicheng Li, Jiacheng Zhao, Yangyu Zhang, Zhaolin Duan, Xinyu Liu, Siqi Li, Shuoming Zhang, Shuaijiang Li, Donglin Yu, Yuan Wen, Chunwei Xia, Xiyu Shi, Huimin Cui |
| 2026 | SANER | A Multi-Modal Retrieval-Augmented Framework for Compiler Backend Generation with LLMs. | Ming Zhong, Fang Lv, Hongna Geng, Xin Sun, Lulin Wang, Lei Qiu, Huimin Cui, Xiaobing Feng |
| 2025 | CGO | Qiwu: Exploiting Ciphertext-Level SIMD Parallelism in Homomorphic Encryption Programs. | Zhongcheng Zhang, Ying Liu, Yuyang Zhang, Zhenchuan Chen, Jiacheng Zhao, Xiaobing Feng, Huimin Cui, Jingling Xue |
| 2025 | CGO | VEGA: Automatically Generating Compiler Backends using a Pre-trained Transformer Model. | Ming Zhong, Fang Lv, Lulin Wang, Lei Qiu, Yingying Wang, Ying Liu, Huimin Cui, Xiaobing Feng, Jingling Xue |
| 2025 | EuroPar | TopServe: Task-Operator Co-scheduling for Efficient Multi-DNN Inference Serving on GPUs. | Ao Chen, Guangli Li, Feng Yu, Xueying Wang, Jiacheng Zhao, Huimin Cui, Xiaobing Feng, Jingling Xue |
| 2025 | ICS | Light-FP: Analyze Floating-Point Error in a Highly Condensed Approach. | Jiazhi Mi, Li Chen, Haoyu Wang, Ruixiang Gao, Hongze Zhang, Ronghong Shen, Kai Lin, You Fu, Huimin Cui |
| 2025 | NSDI | Beehive: A Scalable Disaggregated Memory Runtime Exploiting Asynchrony of Multithreaded Programs. | Quanxi Li, Hong Huang, Ying Liu, Yanwen Xia, Jie Zhang, Mosong Zhou, Xiaobing Feng, Huimin Cui, Quan Chen, Yizhou Shan, Chenxi Wang |
| 2025 | PPoPP | TensorMD: Molecular Dynamics Simulation with Ab Initio Accuracy of 50 Billion Atoms. | Yucheng Ouyang, Ying Liu, Honghui Shang, Zhenchuan Chen, Jiahao Shan, Huimin Cui, Xiaobing Feng, Xin Chen, Xingyu Gao, Lifang Wang, Haifeng Song, Xin Chen, Rongfen Lin, Fang Li |
| 2025 | SC | TENSORMD: Accelerating Molecular Dynamics with a High-Performance Machine Learning Interatomic Potential. | Yucheng Ouyang, Xin Chen, Ying Liu, Xin Chen, Honghui Shang, Zhenchuan Chen, Rongfen Lin, Xingyu Gao, Lifang Wang, Fang Li, Jiahao Shan, Haifeng Song, Huimin Cui, Xiaobing Feng, Jingling Xue |
| 2025 | SANER | Boosting Large Language Models for System Software Retargeting: A Preliminary Study. | Ming Zhong, Fang Lv, Lulin Wang, Lei Qiu, Hongna Geng, Huimin Cui, Xiaobing Feng |
| 2025 | SOSP | Orthrus: Efficient and Timely Detection of Silent User Data Corruption in the Cloud with Resource-Adaptive Computation Validation. | Chenxiao Liu, Zhenting Zhu, Quanxi Li, Yanwen Xia, Yifan Qiao, Xiangyun Deng, Youyou Lu, Tao Xie, Huimin Cui, Zidong Du, Harry Xu, Chenxi Wang |
| 2024 | ASPLOS | Optimizing Deep Learning Inference via Global Analysis and Tensor Expressions. | Chunwei Xia, Jiacheng Zhao, Qianqi Sun, Zheng Wang, Yuan Wen, Teng Yu, Xiaobing Feng, Huimin Cui |
| 2024 | ASPLOS | Optimizing Dynamic-Shape Neural Networks on Accelerators via On-the-Fly Micro-Kernel Polymerization. | Feng Yu, Guangli Li, Jiacheng Zhao, Huimin Cui, Xiaobing Feng, Jingling Xue |
| 2024 | EMNLP | Introducing Compiler Semantics into Large Language Models as Programming Language Translators: A Case Study of C to x86 Assembly. | Shuoming Zhang, Jiacheng Zhao, Chunwei Xia, Zheng Wang, Yunji Chen, Huimin Cui |
| 2024 | OSDI | A Tale of Two Paths: Toward a Hybrid Data Plane for Efficient Far-Memory Applications. | Lei Chen, Shi Liu, Chenxi Wang, Haoran Ma, Yifan Qiao, Zhe Wang, Chenggang Wu, Youyou Lu, Xiaobing Feng, Huimin Cui, Shan Lu, Harry Xu |
| 2024 | SC | Pushing the Limit of Quantum Mechanical Simulation to the Raman Spectra of a Biological System with 100 Million Atoms. | Honghui Shang, Ying Liu, Zhikun Wu, Zhenchuan Chen, Jinfeng Liu, Meiyue Shao, Yingzhou Li, Bowen Kan, Huimin Cui, Xiaobing Feng, Yunquan Zhang, Donald G. Truhlar, Hong An, Xiao He, Jinlong Yang |
| 2023 | ASPLOS | Occamy: Elastically Sharing a SIMD Co-processor across Multiple CPU Cores. | Zhongcheng Zhang, Yan Ou, Ying Liu, Chenxi Wang, Yongbin Zhou, Xiaoyu Wang, Yuyang Zhang, Yucheng Ouyang, Jiahao Shan, Ying Wang, Jingling Xue, Huimin Cui, Xiaobing Feng |
| 2023 | OSDI | Honeycomb: Secure and Efficient GPU Executions via Static Validation. | Haohui Mai, Jiacheng Zhao, Hongren Zheng, Yiyang Zhao, Zibin Liu, Mingyu Gao, Cong Wang, Huimin Cui, Xiaobing Feng, Christos Kozyrakis |
| 2023 | SC | Portable and Scalable All-Electron Quantum Perturbation Simulations on Exascale Supercomputers. | Zhikun Wu, Yangjun Wu, Ying Liu, Honghui Shang, Yingxiang Gao, Zhongcheng Zhang, Yuyang Zhang, Yingchi Long, Xiaobing Feng, Huimin Cui |
| 2021 | ICCD | NRHI: A Concurrent Non-Rehashing Hash Index for Persistent Memory. | Xinyu Li, Huimin Cui, Lei Liu |
| 2021 | SC | Accelerating all-electron | Honghui Shang, Fang Li, Yunquan Zhang, Ying Liu, Libo Zhang, Mingchuan Wu, Yangjun Wu, Di Wei, Huimin Cui, Xin Liu, Fei Wang, Yuxi Ye, Yingxiang Gao, Shuang Ni, Xin Chen, Dexun Chen |
| 2019 | CC | PPOpenCL: a performance-portable OpenCL compiler with host and kernel thread code fusion. | Ying Liu, Lei Huang, Mingchuan Wu, Huimin Cui, Fang Lv, Xiaobing Feng, Jingling Xue |
| 2019 | PLDI | Panthera: holistic memory management for big data processing over hybrid memories. | Chenxi Wang, Huimin Cui, Ting Cao, John N. Zigman, Haris Volos, Onur Mutlu, Fang Lv, Xiaobing Feng, Guoqing Harry Xu |
| 2018 | ICS | Revisiting Loop Tiling for Datacenters: Live and Let Live. | Jiacheng Zhao, Huimin Cui, Yalin Zhang, Jingling Xue, Xiaobing Feng |
| 2018 | NPC | On Retargeting the AI Programming Framework to New Hardwares. | Jiacheng Zhao, Yisong Chang, Denghui Li, Chunwei Xia, Huimin Cui, Ke Zhang, Xiaobing Feng |
| 2018 | PPoPP | Lazygraph: lazy data coherency for replicas in distributed graph-parallel computation. | Lei Wang, Liangji Zhuang, Junhang Chen, Huimin Cui, Fang Lv, Ying Liu, Xiaobing Feng |
| 2016 | PPoPP | Articulation points guided redundancy elimination for betweenness centrality. | Lei Wang, Fan Yang, Liangji Zhuang, Huimin Cui, Fang Lv, Xiaobing Feng |
| 2015 | ICS | Hadoop+: Modeling and Evaluating the Heterogeneity for MapReduce Applications in Heterogeneous Clusters. | Wenting He, Huimin Cui, Binbin Lu, Jiacheng Zhao, Shengmei Li, Gong Ruan, Jingling Xue, Xiaobing Feng, Wensen Yang, Youliang Yan |
| 2014 | MICRO | Specializing Compiler Optimizations through Programmable Composition for Dense Matrix Computations. | Qing Yi, Qian Wang, Huimin Cui |
| 2011 | CGO | Extendable pattern-oriented optimization directives. | Huimin Cui, Jingling Xue, Lei Wang, Yang Yang, Xiaobing Feng, Dongrui Fan |
| 2010 | CGO | An adaptive task creation strategy for work-stealing scheduling. | Lei Wang, Huimin Cui, Yuelu Duan, Fang Lu, Xiaobing Feng, Pen-Chung Yew |