Jidong Zhai
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
90
Venues
32
Active years
2009–2026
Best venue rank
A*
Where they publish
- BPPoPP15 papers
- ASC14 papers
- AUSENIX8 papers
- AHPDC5 papers
- A*ASPLOS5 papers
- AICS4 papers
- A*MICRO3 papers
- CNPC3 papers
- A*ICDE3 papers
- A*OSDI3 papers
- A*AAAI2 papers
- ACGO2 papers
- A*EMNLP2 papers
- CCLUSTER2 papers
- BICPP2 papers
- A*HPCA1 paper
- A*SOSP1 paper
- AEuroSys1 paper
- A*ICLR1 paper
- CHPCC1 paper
- A*PLDI1 paper
- A*SIGMOD1 paper
- A*DAC1 paper
- AICDCS1 paper
- A*IJCAI1 paper
- AFAST1 paper
- NationalNSDI1 paper
- CICA3PP1 paper
- BMASCOTS1 paper
- BICPADS1 paper
- CJSSPP1 paper
- BEuroPar1 paper
Papers
90 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | AAAI | Lethe: Layer- and Time-Adaptive KV Cache Pruning for Reasoning-Intensive LLM Serving. | Hui Zeng, Daming Zhao, Pengfei Yang, WenXuan Hou, Tianyang Zheng, Hui Li, Weiye Ji, Jidong Zhai |
| 2026 | HPCA | FlashFuser: Expanding the Scale of Kernel Fusion for Compute-Intensive Operators via Inter-Core Connection. | Ziyu Huang, Yangjie Zhou, Zihan Liu, Xinhao Luo, Yijia Diao, Minyi Guo, Jidong Zhai, Yu Feng, Chen Zhang, Anbang Wu, Jingwen Leng |
| 2026 | HPDC | DiTango: Cost-Effective Parallel Diffusion Generation with Selective Attention State Reuse. | Yuyang Chen, Runxin Zhong, Zan Zong, Hengjie Li, Yuyang Jin, Jidong Zhai |
| 2026 | HPDC | Odin: Harnessing Rendering Visibility to Break Global Barriers in Distributed Point-Based Neural Rendering. | Zhenxiang Ma, Zeyu He, Yuanzhen Zhou, Zhenyu Yang, Yuchang Zhang, Miao Tao, Rong Fu, Jidong Zhai, Hengjie Li |
| 2026 | HPDC | SYCL++: A Unified Programming Framework for Heterogeneous Supercomputers at Scale. | Zitao Shen, Yuyang Jin, Kinman Lei, Zixuan Ma, Wenqiang Wang, Yinuo Wang, Wenhao Zhou, Zhenchuan Chen, Di Wei, Qi Zhang, Fei Wang, Ying Liu, Lin Gan, Jidong Zhai |
| 2026 | HPDC | UniEP: Unified Expert-Parallel MegaKernel MoE for LLM Training. | Size Zheng, Xuegui Zheng, Li-Wen Chang, Jidong Zhai |
| 2026 | ICS | Taming Dynamic Diffusion LLM Inference through Virtual Static Execution. | Jianian Zhu, Hang Wu, Yinghui Li, Haojie Wang, Ruixuan Li, Jidong Zhai |
| 2026 | PPoPP | ParDiff: Efficiently Parallelizing Reverse-Mode Automatic Differentiation with Direct Indexing. | Shuhong Huang, Shizhi Tang, Yuan Wen, Huanqi Cao, Ruibai Tang, Yidong Chen, Jiping Yu, Yang Li, Chao Jiang, Limin Xiao, Jidong Zhai |
| 2026 | PPoPP | ChituDiffusion: A Data-Characteristic-Aware Serving System for Diffusion Models. | Chengzhang Wu, Liyan Zheng, Haojie Wang, Kezhao Huang, Zixuan Ma, Dong Dong, Jidong Zhai |
| 2026 | PPoPP | RoMeo: Mitigating Dual-dimensional Outliers with Rotated Mixed Precision Quantization. | Qihao Zhang, Mingliang Tang, Mingshu Zhai, Kinman Lei, Jidong Zhai |
| 2025 | CGO | IntelliGen: Instruction-Level Auto-tuning for Tensor Program with Monotonic Memory Optimization. | Zixuan Ma, Haojie Wang, Jingze Xing, Shuhong Huang, Liyan Zheng, Chen Zhang, Huanqi Cao, Kezhao Huang, Mingshu Zhai, Shizhi Tang, Penghan Wang, Jidong Zhai |
| 2025 | MICRO | X-SET: An Efficient Graph Pattern Matching Accelerator With Order-Aware Parallel Intersection Units. | Chenxi Xu, Tianhui Shi, Shixuan Sun, Jidong Zhai, Xinyu Chen |
| 2025 | NPC | HSampler : Optimizing Multi-GPU GNN Sampling with Collision-Avoid Selection. | Yuyang Jin, Jidong Zhai, Kezhao Huang, Weimin Zheng |
| 2025 | PPoPP | FlashTensor: Optimizing Tensor Programs by Leveraging Fine-grained Tensor Property. | Runxin Zhong, Yuyang Jin, Chen Zhang, Kinman Lei, Shuangyu Li, Jidong Zhai |
| 2025 | SC | TraceFlow: Efficient Trace Analysis for Large-Scale Parallel Applications via Interaction Pattern-Aware Trace Distribution. | Yuyang Jin, Xirui Shui, Mingshu Zhai, Zan Zong, Feng Zhang, Felix Wolf, Jidong Zhai |
| 2025 | SC | UltraAttn: Efficiently Parallelizing Attention through Hierarchical Context-Tiling. | Haoyu Yang, Zan Zong, Yuyang Jin, Kinman Lei, Jiaao He, Qigang Yang, Jidong Zhai |
| 2025 | USENIX | HypeReca: Distributed Heterogeneous In-Memory Embedding Database for Training Recommender Models. | Jiaao He, Shengqi Chen, Kezhao Huang, Jidong Zhai |
| 2025 | USENIX | mTuner: Accelerating Parameter-Efficient Fine-Tuning on Multi-GPU Servers with Elastic Tensor. | Kezhao Huang, Siqi Zhu, Mingshu Zhai, Liyan Zheng, Kinman Lei, Jiaao He, Yuyang Jin, Jidong Zhai |
| 2025 | USENIX | PluS: Highly Efficient and Expandable ML Compiler with Pluggable Graph Schedules. | Ruofan Wu, Zhen Zheng, Feng Zhang, Chuanjie Liu, Zaifeng Pan, Jidong Zhai, Xiaoyong Du |
| 2025 | USENIX | QFactory: Accelerating Quantized Large Language Model Serving with Qtile Graphs. | Qihao Zhang, Mingshu Zhai, Rui Sun, Jidong Zhai |
| 2025 | SOSP | Jenga: Effective Memory Management for Serving LLM with Heterogeneity. | Chen Zhang, Kuntai Du, Shu Liu, Woosuk Kwon, Xiangxi Mo, Yufeng Wang, Xiaoxuan Liu, Kaichao You, Zhuohan Li, Mingsheng Long, Jidong Zhai, Joseph Gonzalez, Ion Stoica |
| 2024 | ASPLOS | Optimal Kernel Orchestration for Tensor Programs with Korch. | Muyan Hu, Ashwin Venkatram, Shreyashri Biswas, Balamurugan Marimuthu, Bohan Hou, Gabriele Oliaro, Haojie Wang, Liyan Zheng, Xupeng Miao, Jidong Zhai, Zhihao Jia |
| 2024 | EuroSys | WiseGraph: Optimizing GNN with Joint Workload Partition of Graph and Operations. | Kezhao Huang, Jidong Zhai, Liyan Zheng, Haojie Wang, Yuyang Jin, Qihao Zhang, Runqing Zhang, Zhen Zheng, Youngmin Yi, Xipeng Shen |
| 2024 | ICDE | F-TADOC: FPGA-Based Text Analytics Directly on Compression with HLS. | Yanliang Zhou, Feng Zhang, Tuo Lin, Yuanjie Huang, Saiqin Long, Jidong Zhai, Xiaoyong Du |
| 2024 | PPoPP | POSTER: Pattern-Aware Sparse Communication for Scalable Recommendation Model Training. | Jiaao He, Shengqi Chen, Jidong Zhai |
| 2024 | SC | MixQ: Taming Dynamic Outliers in Mixed-Precision Quantization by Online Prediction. | Yidong Chen, Chen Zhang, Rongchao Dong, Haoyuan Zhang, Yonghua Zhang, Zhonghua Lu, Jidong Zhai |
| 2024 | USENIX | PUZZLE: Efficiently Aligning Large Language Models through Light-Weight Context Switch. | Kinman Lei, Yuyang Jin, Mingshu Zhai, Kezhao Huang, Haoxing Ye, Jidong Zhai |
| 2024 | USENIX | MAGPY: Compiling Eager Mode DNN Programs by Monitoring Execution States. | Chen Zhang, Rongchao Dong, Haojie Wang, Runxin Zhong, Jike Chen, Jidong Zhai |
| 2023 | AAAI | Unveiling the Black Box of PLMs with Semantic Anchors: Towards Interpretable Neural Semantic Parsing. | Lunyiu Nie, Jiuding Sun, Yanlin Wang, Lun Du, Shi Han, Dongmei Zhang, Lei Hou, Juanzi Li, Jidong Zhai |
| 2023 | EMNLP | Joint Geometrical and Statistical Domain Adaptation for Cross-domain Code Vulnerability Detection. | Qianjin Du, Shiji Zhou, Xiaohui Kuang, Gang Zhao, Jidong Zhai |
| 2023 | ICLR | GLM-130B: An Open Bilingual Pre-trained Model. | Aohan Zeng, Xiao Liu, Zhengxiao Du, Zihan Wang, Hanyu Lai, Ming Ding, Zhuoyi Yang, Yifan Xu, Wendi Zheng, Xiao Xia, Weng Lam Tam, Zixuan Ma, Yufei Xue, Jidong Zhai, Wenguang Chen, Zhiyuan Liu, Peng Zhang, Yuxiao Dong, Jie Tang |
| 2023 | OSDI | Cocktailer: Analyzing and Optimizing Dynamic Control Flow in Deep Learning. | Chen Zhang, Lingxiao Ma, Jilong Xue, Yining Shi, Ziming Miao, Fan Yang, Jidong Zhai, Zhi Yang, Mao Yang |
| 2023 | OSDI | EINNET: Optimizing Tensor Programs with Derivation-Based Transformations. | Liyan Zheng, Haojie Wang, Jidong Zhai, Muyan Hu, Zixuan Ma, Tuowei Wang, Shuhong Huang, Xupeng Miao, Shizhi Tang, Kezhao Huang, Zhihao Jia |
| 2023 | SC | GraphSet: High Performance Graph Mining through Equivalent Set Transformations. | Tianhui Shi, Jidong Zhai, Haojie Wang, Qiqian Chen, Mingshu Zhai, Zixu Hao, Haoyu Yang, Wenguang Chen |
| 2023 | USENIX | SmartMoE: Efficiently Training Sparsely-Activated Models through Combining Offline and Online Parallelization. | Mingshu Zhai, Jiaao He, Zixuan Ma, Zan Zong, Runqing Zhang, Jidong Zhai |
| 2022 | ASPLOS | Suppressing ZZ crosstalk of Quantum computers through pulse and scheduling co-optimization. | Lei Xie, Jidong Zhai, Zhenxing Zhang, Jonathan Allcock, Shengyu Zhang, Yicong Zheng |
| 2022 | ASPLOS | AStitch: enabling a new multi-dimensional optimization space for memory-intensive ML training and inference on modern SIMT architectures. | Zhen Zheng, Xuanda Yang, Pengzhan Zhao, Guoping Long, Kai Zhu, Feiwen Zhu, Wenyi Zhao, Xiaoyong Liu, Jun Yang, Jidong Zhai, Shuaiwen Leon Song, Wei Lin |
| 2022 | EMNLP | GraphQ IR: Unifying the Semantic Parsing of Graph Query Languages with One Intermediate Representation. | Lunyiu Nie, Shulin Cao, Jiaxin Shi, Jiuding Sun, Qi Tian, Lei Hou, Juanzi Li, Jidong Zhai |
| 2022 | HPCC | Message from the High Performance Computing and Communications 2022 Program Chairs. | Yunquan Zhang, Jidong Zhai, Rajiv Ranjan |
| 2022 | ICS | Efficiently emulating high-bitwidth computation with low-bitwidth hardware. | Zixuan Ma, Haojie Wang, Guanyu Feng, Chen Zhang, Lei Xie, Jiaao He, Shengqi Chen, Jidong Zhai |
| 2022 | PLDI | FreeTensor: a free-form DSL with holistic optimizations for irregular tensor programs. | Shizhi Tang, Jidong Zhai, Haojie Wang, Lin Jiang, Liyan Zheng, Zhenhao Yuan, Chen Zhang |
| 2022 | PPoPP | FasterMoE: modeling and optimizing training of large-scale dynamic pre-trained models. | Jiaao He, Jidong Zhai, Tiago Antunes, Haojie Wang, Fuwen Luo, Shangfeng Shi, Qin Li |
| 2022 | PPoPP | PerFlow: a domain specific framework for automatic performance analysis of parallel applications. | Yuyang Jin, Haojie Wang, Runxin Zhong, Chen Zhang, Jidong Zhai |
| 2022 | PPoPP | BaGuaLu: targeting brain scale pretrained models with over 37 million cores. | Zixuan Ma, Jiaao He, Jiezhong Qiu, Huanqi Cao, Yuanwei Wang, Zhenbo Sun, Liyan Zheng, Haojie Wang, Shizhi Tang, Tianyu Zheng, Junyang Lin, Guanyu Feng, Zeqiang Huang, Jie Gao, Aohan Zeng, Jianwei Zhang, Runxin Zhong, Tianhui Shi, Sha Liu, Weimin Zheng, Jie Tang, Hongxia Yang, Xin Liu, Jidong Zhai, Wenguang Chen |
| 2022 | PPoPP | Vapro: performance variance detection and diagnosis for production-run parallel applications. | Liyan Zheng, Jidong Zhai, Xiongchao Tang, Haojie Wang, Teng Yu, Yuyang Jin, Shuaiwen Leon Song, Wenguang Chen |
| 2022 | SC | UniQ: A Unified Programming Model for Efficient Quantum Circuit Simulation. | Chen Zhang, Haojie Wang, Zixuan Ma, Lei Xie, Zeyu Song, Jidong Zhai |
| 2022 | SIGMOD | CompressDB: Enabling Efficient Compressed Data Direct Processing for Various Databases. | Feng Zhang, Weitao Wan, Chenyang Zhang, Jidong Zhai, Yunpeng Chai, Haixiang Li, Xiaoyong Du |
| 2021 | CLUSTER | Accelerating GPU Message Communication for Autonomous Navigation Systems. | Hao Wu, Jiangming Jin, Jidong Zhai, Yifan Gong, Wei Liu |
| 2021 | DAC | Mitigating Crosstalk in Quantum Computers through Commutativity-Based Instruction Reordering. | Lei Xie, Jidong Zhai, Weimin Zheng |
| 2021 | ICDE | G-TADOC: Enabling Efficient GPU-Based Text Analytics without Decompression. | Feng Zhang, Zaifeng Pan, Yanliang Zhou, Jidong Zhai, Xipeng Shen, Onur Mutlu, Xiaoyong Du |
| 2021 | ICS | HyQuas: hybrid partitioner based quantum circuit simulation system on GPU. | Chen Zhang, Zeyu Song, Haojie Wang, Kaiyuan Rong, Jidong Zhai |
| 2021 | OSDI | PET: Optimizing Tensor Programs with Partially Equivalent Transformations and Automated Corrections. | Haojie Wang, Jidong Zhai, Mingyu Gao, Zixuan Ma, Shizhi Tang, Liyan Zheng, Yuanzhi Li, Kaiyuan Rong, Yuanyong Chen, Zhihao Jia |
| 2021 | PPoPP | Understanding and bridging the gaps in current GNN performance optimizations. | Kezhao Huang, Jidong Zhai, Zhen Zheng, Youngmin Yi, Xipeng Shen |
| 2020 | ICDCS | Elan: Towards Generic and Efficient Elastic Training for Deep Learning. | Lei Xie, Jidong Zhai, Baodong Wu, Yuanbo Wang, Xingcheng Zhang, Peng Sun, Shengen Yan |
| 2020 | ICDE | Enabling Efficient Random Access to Hierarchically-Compressed Data. | Feng Zhang, Jidong Zhai, Xipeng Shen, Onur Mutlu, Xiaoyong Du |
| 2020 | ICPP | ParSecureML: An Efficient Parallel Secure Machine Learning Framework on GPUs. | Zheng Chen, Feng Zhang, Amelie Chi Zhou, Jidong Zhai, Chenyang Zhang, Xiaoyong Du |
| 2020 | ICPP | Memory-Centric Communication Mechanism for Real-time Autonomous Navigation Applications. | Wei Liu, Yifan Gong, Hao Wu, Jidong Zhai, Jiangming Jin |
| 2020 | IJCAI | PewLSTM: Periodic LSTM with Weather-Aware Gating Mechanism for Parking Behavior Prediction. | Feng Zhang, Ningxuan Feng, Yani Liu, Cheng Yang, Jidong Zhai, Shuhao Zhang, Bingsheng He, Jiazao Lin, Xiaoyong Du |
| 2020 | NPC | Payment Behavior Prediction and Statistical Analysis for Shared Parking Lots. | Qingyu Xu, Feng Zhang, Mingde Zhang, Jidong Zhai, Jiazao Lin, Haidi Liu, Xiaoyong Du |
| 2020 | PPoPP | Identifying scalability bottlenecks for large-scale parallel programs with graph analysis. | Yuyang Jin, Haojie Wang, Xiongchao Tang, Torsten Hoefler, Xu Liu, Jidong Zhai |
| 2020 | SC | ScalAna: automating scaling loss detection with graph analysis. | Yuyang Jin, Haojie Wang, Teng Yu, Xiongchao Tang, Torsten Hoefler, Xu Liu, Jidong Zhai |
| 2020 | SC | GraphPi: high performance graph pattern matching through effective redundancy elimination. | Tianhui Shi, Mingshu Zhai, Yi Xu, Jidong Zhai |
| 2019 | ASPLOS | pLock: A Fast Lock for Architectures with Explicit Inter-core Message Passing. | Xiongchao Tang, Jidong Zhai, Xuehai Qian, Wenguang Chen |
| 2019 | ASPLOS | HiWayLib: A Software Framework for Enabling High Performance Communications for Heterogeneous Pipeline Computations. | Zhen Zheng, Chanyoung Oh, Jidong Zhai, Xipeng Shen, Youngmin Yi, Wenguang Chen |
| 2019 | FAST | Automatic, Application-Aware I/O Forwarding Resource Allocation. | Xu Ji, Bin Yang, Tianyu Zhang, Xiaosong Ma, Xiupeng Zhu, Xiyang Wang, Nosayba El-Sayed, Jidong Zhai, Weiguo Liu, Wei Xue |
| 2019 | NPC | Statistical Analysis and Prediction of Parking Behavior. | Ningxuan Feng, Feng Zhang, Jiazao Lin, Jidong Zhai, Xiaoyong Du |
| 2019 | NSDI | End-to-end I/O Monitoring on a Leading Supercomputer. | Bin Yang, Xu Ji, Xiaosong Ma, Xiyang Wang, Tianyu Zhang, Xiupeng Zhu, Nosayba El-Sayed, Haidong Lan, Yibo Yang, Jidong Zhai, Weiguo Liu, Wei Xue |
| 2019 | PPoPP | GOPipe: a granularity-oblivious programming framework for pipelined stencil executions on GPU. | Chanyoung Oh, Zhen Zheng, Xipeng Shen, Jidong Zhai, Youngmin Yi |
| 2019 | SC | Spread-n-share: improving application performance and cluster throughput with resource-aware job placement. | Xiongchao Tang, Haojie Wang, Xiaosong Ma, Nosayba El-Sayed, Jidong Zhai, Wenguang Chen, Ashraf Aboulnaga |
| 2018 | ICS | Zwift: A Programming Framework for High Performance Text Analytics on Compressed Data. | Feng Zhang, Jidong Zhai, Xipeng Shen, Onur Mutlu, Wenguang Chen |
| 2018 | MICRO | CSE: Parallel Finite State Machines with Convergence Set Enumeration. | Youwei Zhuo, Jinglei Cheng, Qinyi Luo, Jidong Zhai, Yanzhi Wang, Zhongzhi Luan, Xuehai Qian |
| 2018 | PPoPP | vSensor: leveraging fixed-workload snippets of programs for performance variance detection. | Xiongchao Tang, Jidong Zhai, Xuehai Qian, Bingsheng He, Wei Xue, Wenguang Chen |
| 2018 | USENIX | Spindle: Informed Memory Access Monitoring. | Haojie Wang, Jidong Zhai, Xiongchao Tang, Bowen Yu, Xiaosong Ma, Wenguang Chen |
| 2017 | CGO | FinePar: irregularity-aware fine-grained workload partitioning on integrated architectures. | Feng Zhang, Bo Wu, Jidong Zhai, Bingsheng He, Wenguang Chen |
| 2017 | CLUSTER | Algorithm-Directed Crash Consistence in Non-volatile Memory for HPC. | Shuo Yang, Kai Wu, Yifan Qiao, Dong Li, Jidong Zhai |
| 2017 | MICRO | Versapipe: a versatile programming framework for pipelined computing on GPU. | Zhen Zheng, Chanyoung Oh, Jidong Zhai, Xipeng Shen, Youngmin Yi, Wenguang Chen |
| 2017 | PPoPP | Self-Checkpoint: An In-Memory Checkpoint Method Using Less Space and Its Practice on Fault-Tolerant HPL. | Xiongchao Tang, Jidong Zhai, Bowen Yu, Wenguang Chen, Weimin Zheng |
| 2017 | SC | Efficient process mapping in geo-distributed cloud data centers. | Amelie Chi Zhou, Yifan Gong, Bingsheng He, Jidong Zhai |
| 2015 | ICA3PP | A Power-Conserving Online Scheduling Scheme for Video Streaming Services. | Yunyun Jiang, Tian Xiao, Jidong Zhai, Ying Zhao, Wenguang Chen |
| 2015 | MASCOTS | To Co-run, or Not to Co-run: A Performance Study on Integrated Architectures. | Feng Zhang, Jidong Zhai, Wenguang Chen, Bingsheng He, Shuhao Zhang |
| 2014 | ICPADS | Optimizing Seam Carving on multi-GPU systems for real-time image resizing. | Ikjoon Kim, Jidong Zhai, Yan Li, Wenguang Chen |
| 2014 | SC | CYPRESS: Combining Static and Dynamic Analysis for Top-Down Communication Trace Compression. | Jidong Zhai, Jianfei Hu, Xiongchao Tang, Xiaosong Ma, Wenguang Chen |
| 2013 | HPDC | ACIC: automatic cloud I/O configurator for parallel applications. | Mingliang Liu, Ye Jin, Jidong Zhai, Yan Zhai, Qianqian Shi, Xiaosong Ma, Wenguang Chen |
| 2013 | SC | ACIC: automatic cloud I/O configurator for HPC applications. | Mingliang Liu, Ye Jin, Jidong Zhai, Yan Zhai, Qianqian Shi, Xiaosong Ma, Wenguang Chen |
| 2013 | SC | Cost-effective cloud HPC resource provisioning by building semi-elastic virtual clusters. | Shuangcheng Niu, Jidong Zhai, Xiaosong Ma, Xiongchao Tang, Wenguang Chen |
| 2012 | JSSPP | Employing Checkpoint to Improve Job Scheduling in Large-Scale Systems. | Shuangcheng Niu, Jidong Zhai, Xiaosong Ma, Mingliang Liu, Yan Zhai, Wenguang Chen, Weimin Zheng |
| 2011 | SC | Cloud versus in-house cluster: evaluating Amazon cluster compute instances for running MPI applications. | Yan Zhai, Mingliang Liu, Jidong Zhai, Xiaosong Ma, Wenguang Chen |
| 2010 | PPoPP | PHANTOM: predicting performance of parallel applications on large-scale parallel machines using a single node. | Jidong Zhai, Wenguang Chen, Weimin Zheng |
| 2009 | EuroPar | Process Mapping for MPI Collective Communications. | Jin Zhang, Jidong Zhai, Wenguang Chen, Weimin Zheng |
| 2009 | SC | FACT: fast communication trace collection for parallel applications through program slicing. | Jidong Zhai, Tianwei Sheng, Jiangzhou He, Wenguang Chen, Weimin Zheng |