Yilong Zhao
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
23
Venues
16
Active years
2019–2026
Best venue rank
A*
Where they publish
Papers
23 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | ASPDAC | BLADE: Boosting LLM Decoding's Communication Efficiency in DRAM-based PIM. | Yilong Zhao, Fangxin Liu, Zongwu Wang, Mingjian Li, Mingxing Zhang, Chixiao Chen, Li Jiang |
| 2026 | ASPLOS | BlendServe: Optimizing Offline Inference with Resource-Aware Batching. | Yilong Zhao, Shuo Yang, Kan Zhu, Lianmin Zheng, Baris Kasikci, Yifan Qiao, Yang Zhou, Jiarong Xing, Ion Stoica |
| 2026 | ISCA | COSM: A Cooperative Scheduling Framework for Concurrent PIM and CPU Execution on Mobile Devices. | Yilong Zhao, Fangxin Liu, Onur Mutlu, Mingyu Gao, Jian Liu, Haibing Guan, Li Jiang |
| 2025 | ASPLOS | PUSHtap: PIM-based In-Memory HTAP with Unified Data Storage Format. | Yilong Zhao, Mingyu Gao, Huanchen Zhang, Fangxin Liu, Gongye Chen, He Xian, Haibing Guan, Li Jiang |
| 2025 | CIKM | LLM-Enhanced Generalized Category Discovery via Iterative Graph Diffusion. | Kangjia Fan, Yilong Zhao, Daifeng Li, Changze Lin, Weijun Zhang, Zhiwen Zhong |
| 2025 | HPCA | From Optimal to Practical: Efficient Micro-op Cache Replacement Policies for Data Center Applications. | Kan Zhu, Yilong Zhao, Yufei Gao, Peter Braun, Tanvir Ahmed Khan, Heiner Litz, Baris Kasikci, Shuwen Deng |
| 2025 | ICCAD | PLAIN: Leveraging High Internal Bandwidth in PIM for Accelerating Large Language Model Inference via Mixed-Precision Quantization. | Yiwei Hu, Fangxin Liu, Zongwu Wang, Yilong Zhao, Tao Yang, Li Jiang, Haibing Guan |
| 2025 | ICML | Sparse Video-Gen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity. | Haocheng Xi, Shuo Yang, Yilong Zhao, Chenfeng Xu, Muyang Li, Xiuyu Li, Yujun Lin, Han Cai, Jintao Zhang, Dacheng Li, Jianfei Chen, Ion Stoica, Kurt Keutzer, Song Han |
| 2025 | OSDI | NanoFlow: Towards Optimal Large Language Model Serving Throughput. | Kan Zhu, Yufei Gao, Yilong Zhao, Liangyu Zhao, Gefei Zuo, Yile Gu, Dedong Xie, Zihao Ye, Keisuke Kamahori, Chien-Yu Lin, Ziren Wang, Stephanie Wang, Arvind Krishnamurthy, Baris Kasikci |
| 2024 | DASFAA | Sparsity-Aware Personalized Pattern Extractor Network for Music Multi-task Learning. | Shijia Wang, Yi Zheng, Qiang Xiao, Yilong Zhao, Qimeng Yang, Chuanjiang Luo |
| 2024 | ICML | QUEST: Query-Aware Sparsity for Efficient Long-Context LLM Inference. | Jiaming Tang, Yilong Zhao, Kan Zhu, Guangxuan Xiao, Baris Kasikci, Song Han |
| 2024 | ISCA | UM-PIM: DRAM-based PIM with Uniform & Shared Memory Space. | Yilong Zhao, Mingyu Gao, Fangxin Liu, Yiwei Hu, Zongwu Wang, Han Lin, Jin Li, He Xian, Hanlin Dong, Tao Yang, Naifeng Jing, Xiaoyao Liang, Li Jiang |
| 2024 | SEKE | RustPruner: A Program Slicing Tool for Rust Programs. | Yanfeng Hu, Weihong Chen, Yilong Zhao, Ruiyu Zhang, Liangze Yin, Wei Dong |
| 2023 | DATE | PIMPR: PIM-based Personalized Recommendation with Heterogeneous Memory Hierarchy. | Tao Yang, Hui Ma, Yilong Zhao, Fangxin Liu, Zhezhi He, Xiaoli Sun, Li Jiang |
| 2023 | ICPADS | Microless: Cost-Efficient Hybrid Deployment of Microservices on IaaS VMs and Serverless. | Jiagan Cheng, Yilong Zhao, Zijun Li, Quan Chen, Weihao Cui, Minyi Guo |
| 2022 | DATE | DTQAtten: Leveraging Dynamic Token-based Quantization for Efficient Attention Architecture. | Tao Yang, Dongyue Li, Zhuoran Song, Yilong Zhao, Fangxin Liu, Zongwu Wang, Zhezhi He, Li Jiang |
| 2021 | DAC | PIMGCN: A ReRAM-Based PIM Design for Graph Convolutional Network Acceleration. | Tao Yang, Dongyue Li, Yibo Han, Yilong Zhao, Fangxin Liu, Xiaoyao Liang, Zhezhi He, Li Jiang |
| 2021 | DATE | Digital Offset for RRAM-based Neuromorphic Computing: A Novel Solution to Conquer Cycle-to-cycle Variation. | Ziqi Meng, Weikang Qian, Yilong Zhao, Yanan Sun, Rui Yang, Li Jiang |
| 2021 | ICCAD | Bit-Transformer: Transforming Bit-level Sparsity into Higher Preformance in ReRAM-based Accelerator. | Fangxin Liu, Wenbo Zhao, Zhezhi He, Zongwu Wang, Yilong Zhao, Yongbiao Chen, Li Jiang |
| 2021 | ICCD | SME: ReRAM-based Sparse-Multiplication-Engine to Squeeze-Out Bit Sparsity of Neural Network. | Fangxin Liu, Wenbo Zhao, Zhezhi He, Zongwu Wang, Yilong Zhao, Tao Yang, Jingnai Feng, Xiaoyao Liang, Li Jiang |
| 2021 | TrustCom | Research on Droplet Digital PCR Amplification System. | Jie Zhang, Jiaqi Yan, Jinxian Wang, Jie Xu, Yilong Zhao, Gangyin Luo |
| 2020 | DAC | PIM-Prune: Fine-Grain DCNN Pruning for Crossbar-Based Process-In-Memory Architecture. | Chaoqun Chu, Yanzhi Wang, Yilong Zhao, Xiaolong Ma, Shaokai Ye, Yunyan Hong, Xiaoyao Liang, Yinhe Han, Li Jiang |
| 2019 | ISLPED | An Ultra-Efficient Memristor-Based DNN Framework with Structured Weight Pruning and Quantization Using ADMM. | Geng Yuan, Xiaolong Ma, Caiwen Ding, Sheng Lin, Tianyun Zhang, Zeinab S. Jalali, Yilong Zhao, Li Jiang, Sucheta Soundarajan, Yanzhi Wang |