Lingxiao Ma
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
22
Venues
10
Active years
2017–2026
Best venue rank
A*
Where they publish
Papers
22 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | ASPLOS | FastTTS: Accelerating Test-Time Scaling for Edge LLM Reasoning. | Hao Mark Chen, Zhiwen Mo, Guanxi Lu, Shuang Liang, Lingxiao Ma, Wayne Luk, Hongxiang Fan |
| 2026 | PPoPP | MetaAttention: A Unified and Performant Attention Framework across Hardware Backends. | Feiyang Chen, Yu Cheng, Lei Wang, Yuqing Xia, Ziming Miao, Lingxiao Ma, Fan Yang, Jilong Xue, Zhi Yang, Mao Yang, Xingda Wei, Haibo Chen |
| 2025 | EuroSys | T-MAC: CPU Renaissance via Table Lookup for Low-Bit LLM Deployment on Edge. | Jianyu Wei, Shijie Cao, Ting Cao, Lingxiao Ma, Lei Wang, Yanyong Zhang, Mao Yang |
| 2025 | EuroSys | NeuStream: Bridging Deep Learning Serving and Stream Processing. | Haochen Yuan, Yuanqing Wang, Wenhao Xie, Yu Cheng, Ziming Miao, Lingxiao Ma, Jilong Xue, Zhi Yang |
| 2025 | ISCA | LUT Tensor Core: A Software-Hardware Co-Design for LUT-Based Low-Bit LLM Inference. | Zhiwen Mo, Lei Wang, Jianyu Wei, Zhichen Zeng, Shijie Cao, Lingxiao Ma, Naifeng Jing, Ting Cao, Jilong Xue, Fan Yang, Mao Yang |
| 2025 | OSDI | PipeThreader: Software-Defined Pipelining for Efficient DNN Execution. | Yu Cheng, Lei Wang, Yining Shi, Yuqing Xia, Lingxiao Ma, Jilong Xue, Yang Wang, Zhiwen Mo, Feiyang Chen, Fan Yang, Mao Yang, Zhi Yang |
| 2025 | OSDI | WaferLLM: Large Language Model Inference at Wafer Scale. | Congjie He, Yeqi Huang, Pei Mu, Ziming Miao, Jilong Xue, Lingxiao Ma, Fan Yang, Luo Mai |
| 2024 | OSDI | Ladder: Enabling Efficient Low-Precision Deep Learning Computing through Hardware-aware Tensor Transformation. | Lei Wang, Lingxiao Ma, Shijie Cao, Quanlu Zhang, Jilong Xue, Yining Shi, Ningxin Zheng, Ziming Miao, Fan Yang, Ting Cao, Yuqing Yang, Mao Yang |
| 2024 | PPoPP | ConvStencil: Transform Stencil Computation to Matrix Multiplication on Tensor Cores. | Yuetao Chen, Kun Li, Yuhao Wang, Donglin Bai, Lei Wang, Lingxiao Ma, Liang Yuan, Yunquan Zhang, Ting Cao, Mao Yang |
| 2024 | SOSP | Scaling Deep Learning Computation over the Inter-Core Connected Intelligence Processor with T10. | Yiqi Liu, Yuqi Xue, Yu Cheng, Lingxiao Ma, Ziming Miao, Jilong Xue, Jian Huang |
| 2023 | OSDI | Welder: Scheduling Deep Learning Memory Access via Tile-graph. | Yining Shi, Zhi Yang, Jilong Xue, Lingxiao Ma, Yuqing Xia, Ziming Miao, Yuxiao Guo, Fan Yang, Lidong Zhou |
| 2023 | OSDI | Optimizing Dynamic Neural Networks with Brainstorm. | Weihao Cui, Zhenhua Han, Lingji Ouyang, Yichuan Wang, Ningxin Zheng, Lingxiao Ma, Yuqing Yang, Fan Yang, Jilong Xue, Lili Qiu, Lidong Zhou, Quan Chen, Haisheng Tan, Minyi Guo |
| 2023 | OSDI | Cocktailer: Analyzing and Optimizing Dynamic Control Flow in Deep Learning. | Chen Zhang, Lingxiao Ma, Jilong Xue, Yining Shi, Ziming Miao, Fan Yang, Jidong Zhai, Zhi Yang, Mao Yang |
| 2023 | SOSP | PIT: Optimization of Dynamic Sparse Deep Learning Models via Permutation Invariant Transformation. | Ningxin Zheng, Huiqiang Jiang, Quanlu Zhang, Zhenhua Han, Lingxiao Ma, Yuqing Yang, Fan Yang, Chengruidong Zhang, Lili Qiu, Mao Yang, Lidong Zhou |
| 2022 | OSDI | SparTA: Deep-Learning Model Sparsity via Tensor-with-Sparsity-Attribute. | Ningxin Zheng, Bin Lin, Quanlu Zhang, Lingxiao Ma, Yuqing Yang, Fan Yang, Yang Wang, Mao Yang, Lidong Zhou |
| 2022 | OSDI | ROLLER: Fast and Efficient Tensor Compilation for Deep Learning. | Hongyu Zhu, Ruofan Wu, Yijia Diao, Shanbin Ke, Haoyu Li, Chen Zhang, Jilong Xue, Lingxiao Ma, Yuqing Xia, Wei Cui, Fan Yang, Mao Yang, Lidong Zhou, Asaf Cidon, Gennady Pekhimenko |
| 2021 | ICDE | CuWide: Towards Efficient Flow-based Training for Sparse Wide Models on GPUs (Extended Abstract). | Xupeng Miao, Lingxiao Ma, Zhi Yang, Yingxia Shao, Bin Cui, Lele Yu, Jiawei Jiang |
| 2021 | SIGMOD | Heterogeneity-Aware Distributed Machine Learning Training via Partial Reduce. | Xupeng Miao, Xiaonan Nie, Yingxia Shao, Zhi Yang, Jiawei Jiang, Lingxiao Ma, Bin Cui |
| 2020 | OSDI | Rammer: Enabling Holistic Deep Learning Compiler Optimizations with rTasks. | Lingxiao Ma, Zhiqiang Xie, Zhi Yang, Jilong Xue, Youshan Miao, Wei Cui, Wenxiang Hu, Fan Yang, Lintao Zhang, Lidong Zhou |
| 2019 | CVPR | SeerNet: Predicting Convolutional Neural Network Feature-Map Sparsity Through Low-Bit Quantization. | Shijie Cao, Lingxiao Ma, Wencong Xiao, Chen Zhang, Yunxin Liu, Lintao Zhang, Lanshun Nie, Zhi Yang |
| 2019 | USENIX | NeuGraph: Parallel Deep Neural Network Computation on Large Graphs. | Lingxiao Ma, Zhi Yang, Youshan Miao, Jilong Xue, Ming Wu, Lidong Zhou, Yafei Dai |
| 2017 | USENIX | Garaph: Efficient GPU-accelerated Graph Processing on a Single Machine with Balanced Replication. | Lingxiao Ma, Zhi Yang, Han Chen, Jilong Xue, Yafei Dai |