Skip to content

Size Zheng

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

25

Venues

10

Active years

2020–2026

Best venue rank

A*

Where they publish

Papers

25 indexed papers, newest first.

YearVenueTitleAuthors
2026ASPLOSSwiftSpec: Disaggregated Speculative Decoding and Fused Kernels for Low-Latency LLM Inference.Ziyi Zhang, Ziheng Jiang, Chengquan Jiang, Menghan Yu, Size Zheng, Haibin Lin, Xin Liu, Henry Hoffmann
2026DATELATIAS: A General Architecture-Operator Model for Spatial Accelerators with Complex Topology and Memory Hierarchy.Chengrui Zhang, Liancheng Jia, Chu Wang, Tianqi Li, Renze Chen, Xiuping Cui, Size Zheng, Shengen Yan, Xiuhong Li, Yu Wang, Xiang Chen, Yun (Eric) Liang
2026DATEDynaMo: Runtime Switchable Quantization for MoE with Cross-Dataset Adaptation.Zihao Zheng, Xiuping Cui, Size Zheng, Maoliang Li, Jiayu Chen, Yun Liang, Xiang Chen
2026EuroSysMegaScale-MoE: Large-Scale Communication-Efficient Training of Mixture-of-Experts Models in Production.Chao Jin, Ziheng Jiang, Zhihao Bai, Zheng Zhong, Juncai Liu, Xiang Li, Ningxin Zheng, Xi Wang, Cong Xie, Qi Huang, Wen Heng, Yiyuan Ma, Wenlei Bao, Size Zheng, Xuegui Zheng, Yanghua Peng, Haibin Lin, Xuanzhe Liu, Xin Jin, Xin Liu
2026HPCATENET-v2: Applying Relation-Centric Notation to Model and Optimize Data Swizzle in the Cache of Modern NPU.Hanyu Zhang, Fangxu Guo, Liqiang Lu, Long Wang, Yunfei Du, Zhe Wang, Jinghan Zhang, Jie Zhang, Chenli Xue, Chengpeng Wu, Ziyi Zhang, Yun Liang, Size Zheng, Jianwei Yin
2026HPDCUniEP: Unified Expert-Parallel MegaKernel MoE for LLM Training.Size Zheng, Xuegui Zheng, Li-Wen Chang, Jidong Zhai
2026ISCATetris: Efficient Long-context LLM Serving with Chunkwise Dynamic Sequence Parallelism.Cong Li, Yuzhe Yang, Xuegui Zheng, Qifan Yang, Yijin Guan, Size Zheng, Li-Wen Chang, Shufan Liu, Xin Liu, Guangyu Sun
2026ISCAPipeComm: Maximizing Link Utilization Through Pipeline-Aware Collective Communication Synthesis.Ruifan Xu, Yuze Luo, Yuhao Meng, Size Zheng, Meng Li, Yun Liang
2025DACDyREM: Dynamically Mitigating Quantum Readout Error with Embedded Accelerator.Kaiwen Zhou, Liqiang Lu, Hanyu Zhang, Debin Xiang, Chenning Tao, Xinkui Zhao, Size Zheng, Jianwei Yin
2025ICMLMxMoE: Mixed-precision Quantization for MoE with Accuracy and Performance Co-Design.Haojie Duanmu, Xiuhong Li, Zhihang Yuan, Size Zheng, Jiangfei Duan, Xingcheng Zhang, Dahua Lin
2025ICMLShadowKV: KV Cache in Shadows for High-Throughput Long-Context LLM Inference.Hanshi Sun, Li-Wen Chang, Wenlei Bao, Size Zheng, Ningxin Zheng, Xin Liu, Harry Dong, Yuejie Chi, Beidi Chen
2025ISCAQtenon: Towards Low-Latency Architecture Integration for Accelerating Hybrid Quantum-Classical Computing.Chenning Tao, Liqiang Lu, Size Zheng, Li-Wen Chang, Minghua Shen, Hanyu Zhang, Fangxin Liu, Kaiwen Zhou, Jianwei Yin
2024ASPLOSMAGIS: Memory Optimization via Coordinated Graph Transformation and Scheduling for DNN.Renze Chen, Zijian Ding, Size Zheng, Chengrui Zhang, Jingwen Leng, Xuanzhe Liu, Yun Liang
2024ASPLOSSpecPIM: Accelerating Speculative Inference on PIM-Enabled System via Architecture-Dataflow Co-Exploration.Cong Li, Zhe Zhou, Size Zheng, Jiaxi Zhang, Yun Liang, Guangyu Sun
2024DACMoteNN: Memory Optimization via Fine-grained Scheduling for Deep Neural Networks on Tiny Devices.Renze Chen, Zijian Ding, Size Zheng, Meng Li, Yun Liang
2024DACSpREM: Exploiting Hamming Sparsity for Fast Quantum Readout Error Mitigation.Hanyu Zhang, Liqiang Lu, Siwei Tan, Size Zheng, Jia Yu, Jianwei Yin
2023DACRubick: A Synthesis Framework for Spatial Architectures via Dataflow Decomposition.Zizhang Luo, Liqiang Lu, Size Zheng, Jieming Yin, Jason Cong, Jianwei Yin, Yun Liang
2023DACMemory and Computation Coordinated Mapping of DNNs onto Complex Heterogeneous SoC.Size Zheng, Siyuan Chen, Yun Liang
2023HPCAChimera: An Analytical Optimizing Framework for Effective Compute-intensive Operators Fusion.Size Zheng, Siyuan Chen, Peidi Song, Renze Chen, Xiuhong Li, Shengen Yan, Dahua Lin, Jingwen Leng, Yun Liang
2023ICCADARES: A Mapping Framework of DNNs Towards Diverse PIMs with General Abstractions.Xiuping Cui, Size Zheng, Tianyu Jia, Le Ye, Yun Liang
2023MICROTileFlow: A Framework for Modeling Fusion Dataflow via Tree-based Analysis.Size Zheng, Siyuan Chen, Siyuan Gao, Liancheng Jia, Guangyu Sun, Runsheng Wang, Yun Liang
2022ISCAAMOS: enabling automatic mapping for tensor computations on spatial accelerators with hardware abstraction.Size Zheng, Renze Chen, Anjiang Wei, Yicheng Jin, Qin Han, Liqiang Lu, Bingyang Wu, Xiuhong Li, Shengen Yan, Yun Liang
2021ISCAHASCO: Towards Agile HArdware and Software CO-design for Tensor Computation.Qingcheng Xiao, Size Zheng, Bingzhe Wu, Pengcheng Xu, Xuehai Qian, Yun Liang
2020ASPLOSFlexTensor: An Automatic Schedule Exploration and Optimization Framework for Tensor Computation on Heterogeneous System.Size Zheng, Yun Liang, Shuo Wang, Renze Chen, Kaiwen Sheng
2020ICCADSuSy: A Programming Model for Productive Construction of High-Performance Systolic Arrays on FPGAs.Yi-Hsiang Lai, Hongbo Rong, Size Zheng, Weihao Zhang, Xiuping Cui, Yunshan Jia, Jie Wang, Brendan Sullivan, Zhiru Zhang, Yun Liang, Youhui Zhang, Jason Cong, Nithin George, Jose Alvarez, Christopher J. Hughes, Pradeep Dubey