Skip to content

Xianzhi Yu

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

12

Venues

10

Active years

2020–2026

Best venue rank

A*

Where they publish

Papers

12 indexed papers, newest first.

YearVenueTitleAuthors
2026ACLAnalytical FFN-to-MoE Restructuring via Activation Pattern Analysis.Zehua Pei, Hui-Ling Zhen, Lancheng Zou, Xianzhi Yu, Wulong Liu, Sinno Jialin Pan, Mingxuan Yuan, Bei Yu
2026ACLBenchmarking Post-Training Quantization of Large Language Models under Microscaling Floating Point Formats.Manyi Zhang, Ji-Fu Li, Zhongao Sun, Haoli Bai, Hui-Ling Zhen, Zhenhua Dong, Xianzhi Yu
2026ACLUnleashing Low-Bit Inference on Ascend NPUs: A Comprehensive Evaluation of HiFloat Formats.Pengxiang Zhao, Hui-Ling Zhen, Xing Li, Han Bao, Weizhe Lin, Zhiyuan Yang, Yu Zi Wei, Xin Wang, Mingxuan Yuan, Xianzhi Yu, Zhenhua Dong
2026ICSEPLoN: Exploiting Efficient Parallelism with Selective Rematerialization for Lightning Attention on Ascend NPU.Han Bao, Zhenfeng Su, Alexander Setyaev, Stanislav Kamenev, Alexander Gneushev, Kang Zhao, Junmin Xiao, Haoran Lin, Anastasiya Bistrigova, Sergey Buzykanov, Evgeny Tetin, Guangming Tan, Boxiao Liu, Xueyi Zou, Zhenhua Dong, Constantine Korikov, Xianzhi Yu, Zhongzhe Hu
2026SIGCOMMUBEP: Re-architecting Expert Parallelism Communication Library for Production Superpods.Yipeng Liu, Chang Liu, Si Shen, Jiaqi Zheng, Mingfan Li, Yuyang Yang, Guanhua Li, Yuquan Zhang, Yimeng Xu, Zhongzhe Hu, Zhiyuan Huang, Qihang Duan, Junsong Wang, Wenkai Ling, Baochuan Yang, Xianzhi Yu, Han Bao, Yijie Chen, Guihai Chen
2025DACLLMShare: Optimizing LLM Inference Serving with Hardware Architecture Exploration.Hongduo Liu, Chen Bai, Peng Xu, Lihao Yin, Xianzhi Yu, Hui-Ling Zhen, Mingxuan Yuan, Tsung-Yi Ho, Bei Yu
2025EMNLPFaster and Better LLMs via Latency-Aware Test-Time Scaling.Zili Wang, Tianyu Zhang, Haoli Bai, Lu Hou, Xianzhi Yu, Wulong Liu, Shiming Xiang, Lei Zhu
2025ICMLFlatQuant: Flatness Matters for LLM Quantization.Yuxuan Sun, Ruikang Liu, Haoli Bai, Han Bao, Kang Zhao, Yuening Li, Jiaxin Hu, Xianzhi Yu, Lu Hou, Chun Yuan, Xin Jiang, Wulong Liu, Jun Yao
2025ICPADSHAP: Hybrid Adaptive Parallelism for Efficient Mixture-of-Experts Inference.Haoran Lin, Xianzhi Yu, Kang Zhao, Han Bao, Zongyuan Zhan, Ting Hu, Wulong Liu, Zekun Yin, Xin Li, Weiguo Liu
2023ICPPEC-SpMM: Efficient Compilation of SpMM Kernel on GPUs.Junqing Lin, Honghe Zhang, Xiaolong Shi, Jingwei Sun, Xianzhi Yu, Jun Yao, Guangzhong Sun
2021ISPASSPinpointing the Memory Behaviors of DNN Training.Jiansong Li, Xiao Dong, Guangli Li, Peng Zhao, Xueying Wang, Xiaobing Chen, Xianzhi Yu, Yongxin Yang, Zihan Jiang, Wei Cao, Lei Liu, Xiaobing Feng
2020PPoPPRevisiting linpack algorithm on large-scale CPU-GPU heterogeneous systems.Chaoyang Shui, Xianzhi Yu, Yujin Yan, Yinshan Wang, Ke Meng, Guangming Tan