Xianzhi Yu
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
12
Venues
10
Active years
2020–2026
Best venue rank
A*
Where they publish
Papers
12 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | ACL | Analytical FFN-to-MoE Restructuring via Activation Pattern Analysis. | Zehua Pei, Hui-Ling Zhen, Lancheng Zou, Xianzhi Yu, Wulong Liu, Sinno Jialin Pan, Mingxuan Yuan, Bei Yu |
| 2026 | ACL | Benchmarking Post-Training Quantization of Large Language Models under Microscaling Floating Point Formats. | Manyi Zhang, Ji-Fu Li, Zhongao Sun, Haoli Bai, Hui-Ling Zhen, Zhenhua Dong, Xianzhi Yu |
| 2026 | ACL | Unleashing Low-Bit Inference on Ascend NPUs: A Comprehensive Evaluation of HiFloat Formats. | Pengxiang Zhao, Hui-Ling Zhen, Xing Li, Han Bao, Weizhe Lin, Zhiyuan Yang, Yu Zi Wei, Xin Wang, Mingxuan Yuan, Xianzhi Yu, Zhenhua Dong |
| 2026 | ICS | EPLoN: Exploiting Efficient Parallelism with Selective Rematerialization for Lightning Attention on Ascend NPU. | Han Bao, Zhenfeng Su, Alexander Setyaev, Stanislav Kamenev, Alexander Gneushev, Kang Zhao, Junmin Xiao, Haoran Lin, Anastasiya Bistrigova, Sergey Buzykanov, Evgeny Tetin, Guangming Tan, Boxiao Liu, Xueyi Zou, Zhenhua Dong, Constantine Korikov, Xianzhi Yu, Zhongzhe Hu |
| 2026 | SIGCOMM | UBEP: Re-architecting Expert Parallelism Communication Library for Production Superpods. | Yipeng Liu, Chang Liu, Si Shen, Jiaqi Zheng, Mingfan Li, Yuyang Yang, Guanhua Li, Yuquan Zhang, Yimeng Xu, Zhongzhe Hu, Zhiyuan Huang, Qihang Duan, Junsong Wang, Wenkai Ling, Baochuan Yang, Xianzhi Yu, Han Bao, Yijie Chen, Guihai Chen |
| 2025 | DAC | LLMShare: Optimizing LLM Inference Serving with Hardware Architecture Exploration. | Hongduo Liu, Chen Bai, Peng Xu, Lihao Yin, Xianzhi Yu, Hui-Ling Zhen, Mingxuan Yuan, Tsung-Yi Ho, Bei Yu |
| 2025 | EMNLP | Faster and Better LLMs via Latency-Aware Test-Time Scaling. | Zili Wang, Tianyu Zhang, Haoli Bai, Lu Hou, Xianzhi Yu, Wulong Liu, Shiming Xiang, Lei Zhu |
| 2025 | ICML | FlatQuant: Flatness Matters for LLM Quantization. | Yuxuan Sun, Ruikang Liu, Haoli Bai, Han Bao, Kang Zhao, Yuening Li, Jiaxin Hu, Xianzhi Yu, Lu Hou, Chun Yuan, Xin Jiang, Wulong Liu, Jun Yao |
| 2025 | ICPADS | HAP: Hybrid Adaptive Parallelism for Efficient Mixture-of-Experts Inference. | Haoran Lin, Xianzhi Yu, Kang Zhao, Han Bao, Zongyuan Zhan, Ting Hu, Wulong Liu, Zekun Yin, Xin Li, Weiguo Liu |
| 2023 | ICPP | EC-SpMM: Efficient Compilation of SpMM Kernel on GPUs. | Junqing Lin, Honghe Zhang, Xiaolong Shi, Jingwei Sun, Xianzhi Yu, Jun Yao, Guangzhong Sun |
| 2021 | ISPASS | Pinpointing the Memory Behaviors of DNN Training. | Jiansong Li, Xiao Dong, Guangli Li, Peng Zhao, Xueying Wang, Xiaobing Chen, Xianzhi Yu, Yongxin Yang, Zihan Jiang, Wei Cao, Lei Liu, Xiaobing Feng |
| 2020 | PPoPP | Revisiting linpack algorithm on large-scale CPU-GPU heterogeneous systems. | Chaoyang Shui, Xianzhi Yu, Yujin Yan, Yinshan Wang, Ke Meng, Guangming Tan |