Skip to content

Lingxiao Ma

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

22

Venues

10

Active years

2017–2026

Best venue rank

A*

Where they publish

Papers

22 indexed papers, newest first.

YearVenueTitleAuthors
2026ASPLOSFastTTS: Accelerating Test-Time Scaling for Edge LLM Reasoning.Hao Mark Chen, Zhiwen Mo, Guanxi Lu, Shuang Liang, Lingxiao Ma, Wayne Luk, Hongxiang Fan
2026PPoPPMetaAttention: A Unified and Performant Attention Framework across Hardware Backends.Feiyang Chen, Yu Cheng, Lei Wang, Yuqing Xia, Ziming Miao, Lingxiao Ma, Fan Yang, Jilong Xue, Zhi Yang, Mao Yang, Xingda Wei, Haibo Chen
2025EuroSysT-MAC: CPU Renaissance via Table Lookup for Low-Bit LLM Deployment on Edge.Jianyu Wei, Shijie Cao, Ting Cao, Lingxiao Ma, Lei Wang, Yanyong Zhang, Mao Yang
2025EuroSysNeuStream: Bridging Deep Learning Serving and Stream Processing.Haochen Yuan, Yuanqing Wang, Wenhao Xie, Yu Cheng, Ziming Miao, Lingxiao Ma, Jilong Xue, Zhi Yang
2025ISCALUT Tensor Core: A Software-Hardware Co-Design for LUT-Based Low-Bit LLM Inference.Zhiwen Mo, Lei Wang, Jianyu Wei, Zhichen Zeng, Shijie Cao, Lingxiao Ma, Naifeng Jing, Ting Cao, Jilong Xue, Fan Yang, Mao Yang
2025OSDIPipeThreader: Software-Defined Pipelining for Efficient DNN Execution.Yu Cheng, Lei Wang, Yining Shi, Yuqing Xia, Lingxiao Ma, Jilong Xue, Yang Wang, Zhiwen Mo, Feiyang Chen, Fan Yang, Mao Yang, Zhi Yang
2025OSDIWaferLLM: Large Language Model Inference at Wafer Scale.Congjie He, Yeqi Huang, Pei Mu, Ziming Miao, Jilong Xue, Lingxiao Ma, Fan Yang, Luo Mai
2024OSDILadder: Enabling Efficient Low-Precision Deep Learning Computing through Hardware-aware Tensor Transformation.Lei Wang, Lingxiao Ma, Shijie Cao, Quanlu Zhang, Jilong Xue, Yining Shi, Ningxin Zheng, Ziming Miao, Fan Yang, Ting Cao, Yuqing Yang, Mao Yang
2024PPoPPConvStencil: Transform Stencil Computation to Matrix Multiplication on Tensor Cores.Yuetao Chen, Kun Li, Yuhao Wang, Donglin Bai, Lei Wang, Lingxiao Ma, Liang Yuan, Yunquan Zhang, Ting Cao, Mao Yang
2024SOSPScaling Deep Learning Computation over the Inter-Core Connected Intelligence Processor with T10.Yiqi Liu, Yuqi Xue, Yu Cheng, Lingxiao Ma, Ziming Miao, Jilong Xue, Jian Huang
2023OSDIWelder: Scheduling Deep Learning Memory Access via Tile-graph.Yining Shi, Zhi Yang, Jilong Xue, Lingxiao Ma, Yuqing Xia, Ziming Miao, Yuxiao Guo, Fan Yang, Lidong Zhou
2023OSDIOptimizing Dynamic Neural Networks with Brainstorm.Weihao Cui, Zhenhua Han, Lingji Ouyang, Yichuan Wang, Ningxin Zheng, Lingxiao Ma, Yuqing Yang, Fan Yang, Jilong Xue, Lili Qiu, Lidong Zhou, Quan Chen, Haisheng Tan, Minyi Guo
2023OSDICocktailer: Analyzing and Optimizing Dynamic Control Flow in Deep Learning.Chen Zhang, Lingxiao Ma, Jilong Xue, Yining Shi, Ziming Miao, Fan Yang, Jidong Zhai, Zhi Yang, Mao Yang
2023SOSPPIT: Optimization of Dynamic Sparse Deep Learning Models via Permutation Invariant Transformation.Ningxin Zheng, Huiqiang Jiang, Quanlu Zhang, Zhenhua Han, Lingxiao Ma, Yuqing Yang, Fan Yang, Chengruidong Zhang, Lili Qiu, Mao Yang, Lidong Zhou
2022OSDISparTA: Deep-Learning Model Sparsity via Tensor-with-Sparsity-Attribute.Ningxin Zheng, Bin Lin, Quanlu Zhang, Lingxiao Ma, Yuqing Yang, Fan Yang, Yang Wang, Mao Yang, Lidong Zhou
2022OSDIROLLER: Fast and Efficient Tensor Compilation for Deep Learning.Hongyu Zhu, Ruofan Wu, Yijia Diao, Shanbin Ke, Haoyu Li, Chen Zhang, Jilong Xue, Lingxiao Ma, Yuqing Xia, Wei Cui, Fan Yang, Mao Yang, Lidong Zhou, Asaf Cidon, Gennady Pekhimenko
2021ICDECuWide: Towards Efficient Flow-based Training for Sparse Wide Models on GPUs (Extended Abstract).Xupeng Miao, Lingxiao Ma, Zhi Yang, Yingxia Shao, Bin Cui, Lele Yu, Jiawei Jiang
2021SIGMODHeterogeneity-Aware Distributed Machine Learning Training via Partial Reduce.Xupeng Miao, Xiaonan Nie, Yingxia Shao, Zhi Yang, Jiawei Jiang, Lingxiao Ma, Bin Cui
2020OSDIRammer: Enabling Holistic Deep Learning Compiler Optimizations with rTasks.Lingxiao Ma, Zhiqiang Xie, Zhi Yang, Jilong Xue, Youshan Miao, Wei Cui, Wenxiang Hu, Fan Yang, Lintao Zhang, Lidong Zhou
2019CVPRSeerNet: Predicting Convolutional Neural Network Feature-Map Sparsity Through Low-Bit Quantization.Shijie Cao, Lingxiao Ma, Wencong Xiao, Chen Zhang, Yunxin Liu, Lintao Zhang, Lanshun Nie, Zhi Yang
2019USENIXNeuGraph: Parallel Deep Neural Network Computation on Large Graphs.Lingxiao Ma, Zhi Yang, Youshan Miao, Jilong Xue, Ming Wu, Lidong Zhou, Yafei Dai
2017USENIXGaraph: Efficient GPU-accelerated Graph Processing on a Single Machine with Balanced Replication.Lingxiao Ma, Zhi Yang, Han Chen, Jilong Xue, Yafei Dai