Skip to content

Jidong Zhai

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

90

Venues

32

Active years

2009–2026

Best venue rank

A*

Where they publish

Papers

90 indexed papers, newest first.

YearVenueTitleAuthors
2026AAAILethe: Layer- and Time-Adaptive KV Cache Pruning for Reasoning-Intensive LLM Serving.Hui Zeng, Daming Zhao, Pengfei Yang, WenXuan Hou, Tianyang Zheng, Hui Li, Weiye Ji, Jidong Zhai
2026HPCAFlashFuser: Expanding the Scale of Kernel Fusion for Compute-Intensive Operators via Inter-Core Connection.Ziyu Huang, Yangjie Zhou, Zihan Liu, Xinhao Luo, Yijia Diao, Minyi Guo, Jidong Zhai, Yu Feng, Chen Zhang, Anbang Wu, Jingwen Leng
2026HPDCDiTango: Cost-Effective Parallel Diffusion Generation with Selective Attention State Reuse.Yuyang Chen, Runxin Zhong, Zan Zong, Hengjie Li, Yuyang Jin, Jidong Zhai
2026HPDCOdin: Harnessing Rendering Visibility to Break Global Barriers in Distributed Point-Based Neural Rendering.Zhenxiang Ma, Zeyu He, Yuanzhen Zhou, Zhenyu Yang, Yuchang Zhang, Miao Tao, Rong Fu, Jidong Zhai, Hengjie Li
2026HPDCSYCL++: A Unified Programming Framework for Heterogeneous Supercomputers at Scale.Zitao Shen, Yuyang Jin, Kinman Lei, Zixuan Ma, Wenqiang Wang, Yinuo Wang, Wenhao Zhou, Zhenchuan Chen, Di Wei, Qi Zhang, Fei Wang, Ying Liu, Lin Gan, Jidong Zhai
2026HPDCUniEP: Unified Expert-Parallel MegaKernel MoE for LLM Training.Size Zheng, Xuegui Zheng, Li-Wen Chang, Jidong Zhai
2026ICSTaming Dynamic Diffusion LLM Inference through Virtual Static Execution.Jianian Zhu, Hang Wu, Yinghui Li, Haojie Wang, Ruixuan Li, Jidong Zhai
2026PPoPPParDiff: Efficiently Parallelizing Reverse-Mode Automatic Differentiation with Direct Indexing.Shuhong Huang, Shizhi Tang, Yuan Wen, Huanqi Cao, Ruibai Tang, Yidong Chen, Jiping Yu, Yang Li, Chao Jiang, Limin Xiao, Jidong Zhai
2026PPoPPChituDiffusion: A Data-Characteristic-Aware Serving System for Diffusion Models.Chengzhang Wu, Liyan Zheng, Haojie Wang, Kezhao Huang, Zixuan Ma, Dong Dong, Jidong Zhai
2026PPoPPRoMeo: Mitigating Dual-dimensional Outliers with Rotated Mixed Precision Quantization.Qihao Zhang, Mingliang Tang, Mingshu Zhai, Kinman Lei, Jidong Zhai
2025CGOIntelliGen: Instruction-Level Auto-tuning for Tensor Program with Monotonic Memory Optimization.Zixuan Ma, Haojie Wang, Jingze Xing, Shuhong Huang, Liyan Zheng, Chen Zhang, Huanqi Cao, Kezhao Huang, Mingshu Zhai, Shizhi Tang, Penghan Wang, Jidong Zhai
2025MICROX-SET: An Efficient Graph Pattern Matching Accelerator With Order-Aware Parallel Intersection Units.Chenxi Xu, Tianhui Shi, Shixuan Sun, Jidong Zhai, Xinyu Chen
2025NPCHSampler : Optimizing Multi-GPU GNN Sampling with Collision-Avoid Selection.Yuyang Jin, Jidong Zhai, Kezhao Huang, Weimin Zheng
2025PPoPPFlashTensor: Optimizing Tensor Programs by Leveraging Fine-grained Tensor Property.Runxin Zhong, Yuyang Jin, Chen Zhang, Kinman Lei, Shuangyu Li, Jidong Zhai
2025SCTraceFlow: Efficient Trace Analysis for Large-Scale Parallel Applications via Interaction Pattern-Aware Trace Distribution.Yuyang Jin, Xirui Shui, Mingshu Zhai, Zan Zong, Feng Zhang, Felix Wolf, Jidong Zhai
2025SCUltraAttn: Efficiently Parallelizing Attention through Hierarchical Context-Tiling.Haoyu Yang, Zan Zong, Yuyang Jin, Kinman Lei, Jiaao He, Qigang Yang, Jidong Zhai
2025USENIXHypeReca: Distributed Heterogeneous In-Memory Embedding Database for Training Recommender Models.Jiaao He, Shengqi Chen, Kezhao Huang, Jidong Zhai
2025USENIXmTuner: Accelerating Parameter-Efficient Fine-Tuning on Multi-GPU Servers with Elastic Tensor.Kezhao Huang, Siqi Zhu, Mingshu Zhai, Liyan Zheng, Kinman Lei, Jiaao He, Yuyang Jin, Jidong Zhai
2025USENIXPluS: Highly Efficient and Expandable ML Compiler with Pluggable Graph Schedules.Ruofan Wu, Zhen Zheng, Feng Zhang, Chuanjie Liu, Zaifeng Pan, Jidong Zhai, Xiaoyong Du
2025USENIXQFactory: Accelerating Quantized Large Language Model Serving with Qtile Graphs.Qihao Zhang, Mingshu Zhai, Rui Sun, Jidong Zhai
2025SOSPJenga: Effective Memory Management for Serving LLM with Heterogeneity.Chen Zhang, Kuntai Du, Shu Liu, Woosuk Kwon, Xiangxi Mo, Yufeng Wang, Xiaoxuan Liu, Kaichao You, Zhuohan Li, Mingsheng Long, Jidong Zhai, Joseph Gonzalez, Ion Stoica
2024ASPLOSOptimal Kernel Orchestration for Tensor Programs with Korch.Muyan Hu, Ashwin Venkatram, Shreyashri Biswas, Balamurugan Marimuthu, Bohan Hou, Gabriele Oliaro, Haojie Wang, Liyan Zheng, Xupeng Miao, Jidong Zhai, Zhihao Jia
2024EuroSysWiseGraph: Optimizing GNN with Joint Workload Partition of Graph and Operations.Kezhao Huang, Jidong Zhai, Liyan Zheng, Haojie Wang, Yuyang Jin, Qihao Zhang, Runqing Zhang, Zhen Zheng, Youngmin Yi, Xipeng Shen
2024ICDEF-TADOC: FPGA-Based Text Analytics Directly on Compression with HLS.Yanliang Zhou, Feng Zhang, Tuo Lin, Yuanjie Huang, Saiqin Long, Jidong Zhai, Xiaoyong Du
2024PPoPPPOSTER: Pattern-Aware Sparse Communication for Scalable Recommendation Model Training.Jiaao He, Shengqi Chen, Jidong Zhai
2024SCMixQ: Taming Dynamic Outliers in Mixed-Precision Quantization by Online Prediction.Yidong Chen, Chen Zhang, Rongchao Dong, Haoyuan Zhang, Yonghua Zhang, Zhonghua Lu, Jidong Zhai
2024USENIXPUZZLE: Efficiently Aligning Large Language Models through Light-Weight Context Switch.Kinman Lei, Yuyang Jin, Mingshu Zhai, Kezhao Huang, Haoxing Ye, Jidong Zhai
2024USENIXMAGPY: Compiling Eager Mode DNN Programs by Monitoring Execution States.Chen Zhang, Rongchao Dong, Haojie Wang, Runxin Zhong, Jike Chen, Jidong Zhai
2023AAAIUnveiling the Black Box of PLMs with Semantic Anchors: Towards Interpretable Neural Semantic Parsing.Lunyiu Nie, Jiuding Sun, Yanlin Wang, Lun Du, Shi Han, Dongmei Zhang, Lei Hou, Juanzi Li, Jidong Zhai
2023EMNLPJoint Geometrical and Statistical Domain Adaptation for Cross-domain Code Vulnerability Detection.Qianjin Du, Shiji Zhou, Xiaohui Kuang, Gang Zhao, Jidong Zhai
2023ICLRGLM-130B: An Open Bilingual Pre-trained Model.Aohan Zeng, Xiao Liu, Zhengxiao Du, Zihan Wang, Hanyu Lai, Ming Ding, Zhuoyi Yang, Yifan Xu, Wendi Zheng, Xiao Xia, Weng Lam Tam, Zixuan Ma, Yufei Xue, Jidong Zhai, Wenguang Chen, Zhiyuan Liu, Peng Zhang, Yuxiao Dong, Jie Tang
2023OSDICocktailer: Analyzing and Optimizing Dynamic Control Flow in Deep Learning.Chen Zhang, Lingxiao Ma, Jilong Xue, Yining Shi, Ziming Miao, Fan Yang, Jidong Zhai, Zhi Yang, Mao Yang
2023OSDIEINNET: Optimizing Tensor Programs with Derivation-Based Transformations.Liyan Zheng, Haojie Wang, Jidong Zhai, Muyan Hu, Zixuan Ma, Tuowei Wang, Shuhong Huang, Xupeng Miao, Shizhi Tang, Kezhao Huang, Zhihao Jia
2023SCGraphSet: High Performance Graph Mining through Equivalent Set Transformations.Tianhui Shi, Jidong Zhai, Haojie Wang, Qiqian Chen, Mingshu Zhai, Zixu Hao, Haoyu Yang, Wenguang Chen
2023USENIXSmartMoE: Efficiently Training Sparsely-Activated Models through Combining Offline and Online Parallelization.Mingshu Zhai, Jiaao He, Zixuan Ma, Zan Zong, Runqing Zhang, Jidong Zhai
2022ASPLOSSuppressing ZZ crosstalk of Quantum computers through pulse and scheduling co-optimization.Lei Xie, Jidong Zhai, Zhenxing Zhang, Jonathan Allcock, Shengyu Zhang, Yicong Zheng
2022ASPLOSAStitch: enabling a new multi-dimensional optimization space for memory-intensive ML training and inference on modern SIMT architectures.Zhen Zheng, Xuanda Yang, Pengzhan Zhao, Guoping Long, Kai Zhu, Feiwen Zhu, Wenyi Zhao, Xiaoyong Liu, Jun Yang, Jidong Zhai, Shuaiwen Leon Song, Wei Lin
2022EMNLPGraphQ IR: Unifying the Semantic Parsing of Graph Query Languages with One Intermediate Representation.Lunyiu Nie, Shulin Cao, Jiaxin Shi, Jiuding Sun, Qi Tian, Lei Hou, Juanzi Li, Jidong Zhai
2022HPCCMessage from the High Performance Computing and Communications 2022 Program Chairs.Yunquan Zhang, Jidong Zhai, Rajiv Ranjan
2022ICSEfficiently emulating high-bitwidth computation with low-bitwidth hardware.Zixuan Ma, Haojie Wang, Guanyu Feng, Chen Zhang, Lei Xie, Jiaao He, Shengqi Chen, Jidong Zhai
2022PLDIFreeTensor: a free-form DSL with holistic optimizations for irregular tensor programs.Shizhi Tang, Jidong Zhai, Haojie Wang, Lin Jiang, Liyan Zheng, Zhenhao Yuan, Chen Zhang
2022PPoPPFasterMoE: modeling and optimizing training of large-scale dynamic pre-trained models.Jiaao He, Jidong Zhai, Tiago Antunes, Haojie Wang, Fuwen Luo, Shangfeng Shi, Qin Li
2022PPoPPPerFlow: a domain specific framework for automatic performance analysis of parallel applications.Yuyang Jin, Haojie Wang, Runxin Zhong, Chen Zhang, Jidong Zhai
2022PPoPPBaGuaLu: targeting brain scale pretrained models with over 37 million cores.Zixuan Ma, Jiaao He, Jiezhong Qiu, Huanqi Cao, Yuanwei Wang, Zhenbo Sun, Liyan Zheng, Haojie Wang, Shizhi Tang, Tianyu Zheng, Junyang Lin, Guanyu Feng, Zeqiang Huang, Jie Gao, Aohan Zeng, Jianwei Zhang, Runxin Zhong, Tianhui Shi, Sha Liu, Weimin Zheng, Jie Tang, Hongxia Yang, Xin Liu, Jidong Zhai, Wenguang Chen
2022PPoPPVapro: performance variance detection and diagnosis for production-run parallel applications.Liyan Zheng, Jidong Zhai, Xiongchao Tang, Haojie Wang, Teng Yu, Yuyang Jin, Shuaiwen Leon Song, Wenguang Chen
2022SCUniQ: A Unified Programming Model for Efficient Quantum Circuit Simulation.Chen Zhang, Haojie Wang, Zixuan Ma, Lei Xie, Zeyu Song, Jidong Zhai
2022SIGMODCompressDB: Enabling Efficient Compressed Data Direct Processing for Various Databases.Feng Zhang, Weitao Wan, Chenyang Zhang, Jidong Zhai, Yunpeng Chai, Haixiang Li, Xiaoyong Du
2021CLUSTERAccelerating GPU Message Communication for Autonomous Navigation Systems.Hao Wu, Jiangming Jin, Jidong Zhai, Yifan Gong, Wei Liu
2021DACMitigating Crosstalk in Quantum Computers through Commutativity-Based Instruction Reordering.Lei Xie, Jidong Zhai, Weimin Zheng
2021ICDEG-TADOC: Enabling Efficient GPU-Based Text Analytics without Decompression.Feng Zhang, Zaifeng Pan, Yanliang Zhou, Jidong Zhai, Xipeng Shen, Onur Mutlu, Xiaoyong Du
2021ICSHyQuas: hybrid partitioner based quantum circuit simulation system on GPU.Chen Zhang, Zeyu Song, Haojie Wang, Kaiyuan Rong, Jidong Zhai
2021OSDIPET: Optimizing Tensor Programs with Partially Equivalent Transformations and Automated Corrections.Haojie Wang, Jidong Zhai, Mingyu Gao, Zixuan Ma, Shizhi Tang, Liyan Zheng, Yuanzhi Li, Kaiyuan Rong, Yuanyong Chen, Zhihao Jia
2021PPoPPUnderstanding and bridging the gaps in current GNN performance optimizations.Kezhao Huang, Jidong Zhai, Zhen Zheng, Youngmin Yi, Xipeng Shen
2020ICDCSElan: Towards Generic and Efficient Elastic Training for Deep Learning.Lei Xie, Jidong Zhai, Baodong Wu, Yuanbo Wang, Xingcheng Zhang, Peng Sun, Shengen Yan
2020ICDEEnabling Efficient Random Access to Hierarchically-Compressed Data.Feng Zhang, Jidong Zhai, Xipeng Shen, Onur Mutlu, Xiaoyong Du
2020ICPPParSecureML: An Efficient Parallel Secure Machine Learning Framework on GPUs.Zheng Chen, Feng Zhang, Amelie Chi Zhou, Jidong Zhai, Chenyang Zhang, Xiaoyong Du
2020ICPPMemory-Centric Communication Mechanism for Real-time Autonomous Navigation Applications.Wei Liu, Yifan Gong, Hao Wu, Jidong Zhai, Jiangming Jin
2020IJCAIPewLSTM: Periodic LSTM with Weather-Aware Gating Mechanism for Parking Behavior Prediction.Feng Zhang, Ningxuan Feng, Yani Liu, Cheng Yang, Jidong Zhai, Shuhao Zhang, Bingsheng He, Jiazao Lin, Xiaoyong Du
2020NPCPayment Behavior Prediction and Statistical Analysis for Shared Parking Lots.Qingyu Xu, Feng Zhang, Mingde Zhang, Jidong Zhai, Jiazao Lin, Haidi Liu, Xiaoyong Du
2020PPoPPIdentifying scalability bottlenecks for large-scale parallel programs with graph analysis.Yuyang Jin, Haojie Wang, Xiongchao Tang, Torsten Hoefler, Xu Liu, Jidong Zhai
2020SCScalAna: automating scaling loss detection with graph analysis.Yuyang Jin, Haojie Wang, Teng Yu, Xiongchao Tang, Torsten Hoefler, Xu Liu, Jidong Zhai
2020SCGraphPi: high performance graph pattern matching through effective redundancy elimination.Tianhui Shi, Mingshu Zhai, Yi Xu, Jidong Zhai
2019ASPLOSpLock: A Fast Lock for Architectures with Explicit Inter-core Message Passing.Xiongchao Tang, Jidong Zhai, Xuehai Qian, Wenguang Chen
2019ASPLOSHiWayLib: A Software Framework for Enabling High Performance Communications for Heterogeneous Pipeline Computations.Zhen Zheng, Chanyoung Oh, Jidong Zhai, Xipeng Shen, Youngmin Yi, Wenguang Chen
2019FASTAutomatic, Application-Aware I/O Forwarding Resource Allocation.Xu Ji, Bin Yang, Tianyu Zhang, Xiaosong Ma, Xiupeng Zhu, Xiyang Wang, Nosayba El-Sayed, Jidong Zhai, Weiguo Liu, Wei Xue
2019NPCStatistical Analysis and Prediction of Parking Behavior.Ningxuan Feng, Feng Zhang, Jiazao Lin, Jidong Zhai, Xiaoyong Du
2019NSDIEnd-to-end I/O Monitoring on a Leading Supercomputer.Bin Yang, Xu Ji, Xiaosong Ma, Xiyang Wang, Tianyu Zhang, Xiupeng Zhu, Nosayba El-Sayed, Haidong Lan, Yibo Yang, Jidong Zhai, Weiguo Liu, Wei Xue
2019PPoPPGOPipe: a granularity-oblivious programming framework for pipelined stencil executions on GPU.Chanyoung Oh, Zhen Zheng, Xipeng Shen, Jidong Zhai, Youngmin Yi
2019SCSpread-n-share: improving application performance and cluster throughput with resource-aware job placement.Xiongchao Tang, Haojie Wang, Xiaosong Ma, Nosayba El-Sayed, Jidong Zhai, Wenguang Chen, Ashraf Aboulnaga
2018ICSZwift: A Programming Framework for High Performance Text Analytics on Compressed Data.Feng Zhang, Jidong Zhai, Xipeng Shen, Onur Mutlu, Wenguang Chen
2018MICROCSE: Parallel Finite State Machines with Convergence Set Enumeration.Youwei Zhuo, Jinglei Cheng, Qinyi Luo, Jidong Zhai, Yanzhi Wang, Zhongzhi Luan, Xuehai Qian
2018PPoPPvSensor: leveraging fixed-workload snippets of programs for performance variance detection.Xiongchao Tang, Jidong Zhai, Xuehai Qian, Bingsheng He, Wei Xue, Wenguang Chen
2018USENIXSpindle: Informed Memory Access Monitoring.Haojie Wang, Jidong Zhai, Xiongchao Tang, Bowen Yu, Xiaosong Ma, Wenguang Chen
2017CGOFinePar: irregularity-aware fine-grained workload partitioning on integrated architectures.Feng Zhang, Bo Wu, Jidong Zhai, Bingsheng He, Wenguang Chen
2017CLUSTERAlgorithm-Directed Crash Consistence in Non-volatile Memory for HPC.Shuo Yang, Kai Wu, Yifan Qiao, Dong Li, Jidong Zhai
2017MICROVersapipe: a versatile programming framework for pipelined computing on GPU.Zhen Zheng, Chanyoung Oh, Jidong Zhai, Xipeng Shen, Youngmin Yi, Wenguang Chen
2017PPoPPSelf-Checkpoint: An In-Memory Checkpoint Method Using Less Space and Its Practice on Fault-Tolerant HPL.Xiongchao Tang, Jidong Zhai, Bowen Yu, Wenguang Chen, Weimin Zheng
2017SCEfficient process mapping in geo-distributed cloud data centers.Amelie Chi Zhou, Yifan Gong, Bingsheng He, Jidong Zhai
2015ICA3PPA Power-Conserving Online Scheduling Scheme for Video Streaming Services.Yunyun Jiang, Tian Xiao, Jidong Zhai, Ying Zhao, Wenguang Chen
2015MASCOTSTo Co-run, or Not to Co-run: A Performance Study on Integrated Architectures.Feng Zhang, Jidong Zhai, Wenguang Chen, Bingsheng He, Shuhao Zhang
2014ICPADSOptimizing Seam Carving on multi-GPU systems for real-time image resizing.Ikjoon Kim, Jidong Zhai, Yan Li, Wenguang Chen
2014SCCYPRESS: Combining Static and Dynamic Analysis for Top-Down Communication Trace Compression.Jidong Zhai, Jianfei Hu, Xiongchao Tang, Xiaosong Ma, Wenguang Chen
2013HPDCACIC: automatic cloud I/O configurator for parallel applications.Mingliang Liu, Ye Jin, Jidong Zhai, Yan Zhai, Qianqian Shi, Xiaosong Ma, Wenguang Chen
2013SCACIC: automatic cloud I/O configurator for HPC applications.Mingliang Liu, Ye Jin, Jidong Zhai, Yan Zhai, Qianqian Shi, Xiaosong Ma, Wenguang Chen
2013SCCost-effective cloud HPC resource provisioning by building semi-elastic virtual clusters.Shuangcheng Niu, Jidong Zhai, Xiaosong Ma, Xiongchao Tang, Wenguang Chen
2012JSSPPEmploying Checkpoint to Improve Job Scheduling in Large-Scale Systems.Shuangcheng Niu, Jidong Zhai, Xiaosong Ma, Mingliang Liu, Yan Zhai, Wenguang Chen, Weimin Zheng
2011SCCloud versus in-house cluster: evaluating Amazon cluster compute instances for running MPI applications.Yan Zhai, Mingliang Liu, Jidong Zhai, Xiaosong Ma, Wenguang Chen
2010PPoPPPHANTOM: predicting performance of parallel applications on large-scale parallel machines using a single node.Jidong Zhai, Wenguang Chen, Weimin Zheng
2009EuroParProcess Mapping for MPI Collective Communications.Jin Zhang, Jidong Zhai, Wenguang Chen, Weimin Zheng
2009SCFACT: fast communication trace collection for parallel applications through program slicing.Jidong Zhai, Tianwei Sheng, Jiangzhou He, Wenguang Chen, Weimin Zheng