Skip to content

Xianwei Zhang

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

22

Venues

14

Active years

2018–2026

Best venue rank

A*

Where they publish

Papers

22 indexed papers, newest first.

YearVenueTitleAuthors
2026AAAIFusedRec: Fused Embedding Communication for Distributed Recommendation Training on GPUs.Xuanteng Huang, Fan Li, Riyang Hu, Jianchang Zhang, Yuan Peng, Yang Zhou, Fangying Chen, Xianwei Zhang
2026ASPLOSBullet: Boosting GPU Utilization for LLM Serving via Dynamic Spatial-Temporal Orchestration.Zejia Lin, Hongxin Xu, Guanyi Chen, Zhiguang Chen, Yutong Lu, Xianwei Zhang
2026DATEFedCM: Fine-grained Kernel Scheduling and Management to Improve GPU Sharing.Xianwei Zhang, Xuanteng Huang, Nong Xiao
2026EuroParSMEAtten: Fast and Memory-Efficient Outer Product-Based Attention on ARMv9 CPUs with SME.Tengyang Zheng, Han Huang, Junru Chen, Xianwei Zhang, Yutong Lu
2025ASPDACMpache: Interaction Aware Multi-level Cache Bypassing on GPUs.Mengyue Xi, Tianyu Guo, Xuanteng Huang, Zejia Lin, Xianwei Zhang
2025DACGoPTX: Fine-grained GPU Kernel Fusion by PTX-level Instruction Flow Weaving.Kan Wu, Zejia Lin, Mengyue Xi, Zhongchun Zheng, Wenxuan Pan, Xianwei Zhang, Yutong Lu
2025EuroParEFIM: Efficient Serving of LLMs for Infilling Tasks with Improved KV Cache Reuse.Tianyu Guo, Hande Dong, Yichong Leng, Feng Liu, Cheater Lin, Nong Xiao, Xianwei Zhang
2025EuroParCacheC: LLM-Based GPU Cache Management to Enhance Kernel Concurrency.Mengyue Xi, Jingyi He, Xianwei Zhang
2025WWWORFA: Exploring WebAssembly as a Turing Complete Query Language for Web APIs.Yuhao Gu, Chunyu Chen, Jiangsu Du, Xiaoxi Zhang, Xianwei Zhang
2025SCgLLM: Global Balanced Pipeline Parallelism Systems for Distributed LLMs Serving with Token Throttling.Tianyu Guo, Xianwei Zhang, Jiangsu Du, Zhiguang Chen, Nong Xiao, Yutong Lu
2025SCcoMtainer: Compilation-assisted HPC Container Images with Enhanced Adaptability.Yuhao Gu, Haoquan Chen, Xianjie Chen, Jiangsu Du, Zhiguang Chen, Nong Xiao, Xianwei Zhang, Yutong Lu
2025SCHStencil: Matrix-Vector Stencil Computation with Interleaved Outer Product and MLA.Han Huang, Jiabin Xie, Guangnan Feng, Xianwei Zhang, Dan Huang, Zhiguang Chen, Yutong Lu
2024DACSMILE: LLC-based Shared Memory Expansion to Improve GPU Thread Level Parallelism.Tianyu Guo, Xuanteng Huang, Kan Wu, Xianwei Zhang, Nong Xiao
2024IJCNNopenLG: A Tunable and Efficient Open-source LSTM on GPUs.Zhaowen Shan, Xuanteng Huang, Zheng Zhou, Xianwei Zhang
2024SCAPTMoE: Affinity-Aware Pipeline Tuning for MoE Models on Bandwidth-Constrained GPU Nodes.Yuanxin Wei, Jiangsu Du, Jiazhi Jiang, Xiao Shi, Xianwei Zhang, Dan Huang, Nong Xiao, Yutong Lu
2023ICCDKeSCo: Compiler-based Kernel Scheduling for Multi-task GPU Applications.Zejia Lin, Zewei Mo, Xuanteng Huang, Xianwei Zhang, Yutong Lu
2023ICPADSHay: Enhancing GPU Sharing Performance With Two-Level Scheduling for Ray.Lianghong Huang, Zejia Lin, Wei Liu, Xianwei Zhang
2022CCGRIDRAISE: Efficient GPU Resource Management via Hybrid Scheduling.Yue Weng, Tianao Ge, Xi Zhang, Xianwei Zhang, Yutong Lu
2021InterspeechEnd-to-End Cross-Lingual Spoken Language Understanding Model with Multilingual Pretraining.Xianwei Zhang, Liang He
2020InterspeechTHUEE System for NIST SRE19 CTS Challenge.Ruyun Li, Tianyu Liang, Dandan Song, Yi Liu, Yangcheng Wu, Can Xu, Peng Ouyang, Xianwei Zhang, Xianhong Chen, Weiqiang Zhang, Shouyi Yin, Liang He
2019ASPDACBoosting chipkill capability under retention-error induced reliability emergency.Xianwei Zhang, Rujia Wang, Youtao Zhang, Jun Yang
2018HPCALost in Abstraction: Pitfalls of Analyzing GPUs at the Intermediate Language Level.Anthony Gutierrez, Bradford M. Beckmann, Alexandru Dutu, Joseph Gross, Michael LeBeane, John Kalamatianos, Onur Kayiran, Matthew Poremba, Brandon Potter, Sooraj Puthoor, Matthew D. Sinclair, Mark Wyse, Jieming Yin, Xianwei Zhang, Akshay Jain, Timothy G. Rogers