Size Zheng
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
25
Venues
10
Active years
2020–2026
Best venue rank
A*
Where they publish
Papers
25 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | ASPLOS | SwiftSpec: Disaggregated Speculative Decoding and Fused Kernels for Low-Latency LLM Inference. | Ziyi Zhang, Ziheng Jiang, Chengquan Jiang, Menghan Yu, Size Zheng, Haibin Lin, Xin Liu, Henry Hoffmann |
| 2026 | DATE | LATIAS: A General Architecture-Operator Model for Spatial Accelerators with Complex Topology and Memory Hierarchy. | Chengrui Zhang, Liancheng Jia, Chu Wang, Tianqi Li, Renze Chen, Xiuping Cui, Size Zheng, Shengen Yan, Xiuhong Li, Yu Wang, Xiang Chen, Yun (Eric) Liang |
| 2026 | DATE | DynaMo: Runtime Switchable Quantization for MoE with Cross-Dataset Adaptation. | Zihao Zheng, Xiuping Cui, Size Zheng, Maoliang Li, Jiayu Chen, Yun Liang, Xiang Chen |
| 2026 | EuroSys | MegaScale-MoE: Large-Scale Communication-Efficient Training of Mixture-of-Experts Models in Production. | Chao Jin, Ziheng Jiang, Zhihao Bai, Zheng Zhong, Juncai Liu, Xiang Li, Ningxin Zheng, Xi Wang, Cong Xie, Qi Huang, Wen Heng, Yiyuan Ma, Wenlei Bao, Size Zheng, Xuegui Zheng, Yanghua Peng, Haibin Lin, Xuanzhe Liu, Xin Jin, Xin Liu |
| 2026 | HPCA | TENET-v2: Applying Relation-Centric Notation to Model and Optimize Data Swizzle in the Cache of Modern NPU. | Hanyu Zhang, Fangxu Guo, Liqiang Lu, Long Wang, Yunfei Du, Zhe Wang, Jinghan Zhang, Jie Zhang, Chenli Xue, Chengpeng Wu, Ziyi Zhang, Yun Liang, Size Zheng, Jianwei Yin |
| 2026 | HPDC | UniEP: Unified Expert-Parallel MegaKernel MoE for LLM Training. | Size Zheng, Xuegui Zheng, Li-Wen Chang, Jidong Zhai |
| 2026 | ISCA | Tetris: Efficient Long-context LLM Serving with Chunkwise Dynamic Sequence Parallelism. | Cong Li, Yuzhe Yang, Xuegui Zheng, Qifan Yang, Yijin Guan, Size Zheng, Li-Wen Chang, Shufan Liu, Xin Liu, Guangyu Sun |
| 2026 | ISCA | PipeComm: Maximizing Link Utilization Through Pipeline-Aware Collective Communication Synthesis. | Ruifan Xu, Yuze Luo, Yuhao Meng, Size Zheng, Meng Li, Yun Liang |
| 2025 | DAC | DyREM: Dynamically Mitigating Quantum Readout Error with Embedded Accelerator. | Kaiwen Zhou, Liqiang Lu, Hanyu Zhang, Debin Xiang, Chenning Tao, Xinkui Zhao, Size Zheng, Jianwei Yin |
| 2025 | ICML | MxMoE: Mixed-precision Quantization for MoE with Accuracy and Performance Co-Design. | Haojie Duanmu, Xiuhong Li, Zhihang Yuan, Size Zheng, Jiangfei Duan, Xingcheng Zhang, Dahua Lin |
| 2025 | ICML | ShadowKV: KV Cache in Shadows for High-Throughput Long-Context LLM Inference. | Hanshi Sun, Li-Wen Chang, Wenlei Bao, Size Zheng, Ningxin Zheng, Xin Liu, Harry Dong, Yuejie Chi, Beidi Chen |
| 2025 | ISCA | Qtenon: Towards Low-Latency Architecture Integration for Accelerating Hybrid Quantum-Classical Computing. | Chenning Tao, Liqiang Lu, Size Zheng, Li-Wen Chang, Minghua Shen, Hanyu Zhang, Fangxin Liu, Kaiwen Zhou, Jianwei Yin |
| 2024 | ASPLOS | MAGIS: Memory Optimization via Coordinated Graph Transformation and Scheduling for DNN. | Renze Chen, Zijian Ding, Size Zheng, Chengrui Zhang, Jingwen Leng, Xuanzhe Liu, Yun Liang |
| 2024 | ASPLOS | SpecPIM: Accelerating Speculative Inference on PIM-Enabled System via Architecture-Dataflow Co-Exploration. | Cong Li, Zhe Zhou, Size Zheng, Jiaxi Zhang, Yun Liang, Guangyu Sun |
| 2024 | DAC | MoteNN: Memory Optimization via Fine-grained Scheduling for Deep Neural Networks on Tiny Devices. | Renze Chen, Zijian Ding, Size Zheng, Meng Li, Yun Liang |
| 2024 | DAC | SpREM: Exploiting Hamming Sparsity for Fast Quantum Readout Error Mitigation. | Hanyu Zhang, Liqiang Lu, Siwei Tan, Size Zheng, Jia Yu, Jianwei Yin |
| 2023 | DAC | Rubick: A Synthesis Framework for Spatial Architectures via Dataflow Decomposition. | Zizhang Luo, Liqiang Lu, Size Zheng, Jieming Yin, Jason Cong, Jianwei Yin, Yun Liang |
| 2023 | DAC | Memory and Computation Coordinated Mapping of DNNs onto Complex Heterogeneous SoC. | Size Zheng, Siyuan Chen, Yun Liang |
| 2023 | HPCA | Chimera: An Analytical Optimizing Framework for Effective Compute-intensive Operators Fusion. | Size Zheng, Siyuan Chen, Peidi Song, Renze Chen, Xiuhong Li, Shengen Yan, Dahua Lin, Jingwen Leng, Yun Liang |
| 2023 | ICCAD | ARES: A Mapping Framework of DNNs Towards Diverse PIMs with General Abstractions. | Xiuping Cui, Size Zheng, Tianyu Jia, Le Ye, Yun Liang |
| 2023 | MICRO | TileFlow: A Framework for Modeling Fusion Dataflow via Tree-based Analysis. | Size Zheng, Siyuan Chen, Siyuan Gao, Liancheng Jia, Guangyu Sun, Runsheng Wang, Yun Liang |
| 2022 | ISCA | AMOS: enabling automatic mapping for tensor computations on spatial accelerators with hardware abstraction. | Size Zheng, Renze Chen, Anjiang Wei, Yicheng Jin, Qin Han, Liqiang Lu, Bingyang Wu, Xiuhong Li, Shengen Yan, Yun Liang |
| 2021 | ISCA | HASCO: Towards Agile HArdware and Software CO-design for Tensor Computation. | Qingcheng Xiao, Size Zheng, Bingzhe Wu, Pengcheng Xu, Xuehai Qian, Yun Liang |
| 2020 | ASPLOS | FlexTensor: An Automatic Schedule Exploration and Optimization Framework for Tensor Computation on Heterogeneous System. | Size Zheng, Yun Liang, Shuo Wang, Renze Chen, Kaiwen Sheng |
| 2020 | ICCAD | SuSy: A Programming Model for Productive Construction of High-Performance Systolic Arrays on FPGAs. | Yi-Hsiang Lai, Hongbo Rong, Size Zheng, Weihao Zhang, Xiuping Cui, Yunshan Jia, Jie Wang, Brendan Sullivan, Zhiru Zhang, Yun Liang, Youhui Zhang, Jason Cong, Nithin George, Jose Alvarez, Christopher J. Hughes, Pradeep Dubey |