Ting Cao
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
62
Venues
32
Active years
2010–2026
Best venue rank
A*
Where they publish
- AMobisys7 papers
- A*MOBICOM6 papers
- ASC4 papers
- A*ACL3 papers
- A*ASPLOS3 papers
- A*ICCV3 papers
- A*ISCA3 papers
- BPPoPP3 papers
- UnrankedSENSYS3 papers
- AEuroSys2 papers
- A*HPCA2 papers
- NationalNSDI2 papers
- BWCNC2 papers
- A*SIGCOMM1 paper
- AUSENIX1 paper
- A*EMNLP1 paper
- MulticonferenceICASSP1 paper
- BIJCNN1 paper
- A*OSDI1 paper
- AECAI1 paper
- AInterspeech1 paper
- A*KDD1 paper
- ACIKM1 paper
- NationalHCI1 paper
- CIPCCC1 paper
- CICCE1 paper
- A*PLDI1 paper
- ACGO1 paper
- CNPC1 paper
- NationalICIG1 paper
- BICPP1 paper
- CICCD1 paper
Papers
62 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | EuroSys | Scaling LLM Test-Time Compute with Mobile NPU on Smartphones. | Zixu Hao, Jianyu Wei, Tuowei Wang, Minxing Huang, Huiqiang Jiang, Shiqi Jiang, Ting Cao, Ju Ren |
| 2026 | HPCA | BitDecoding: Unlocking Tensor Cores for Long-Context LLMs with Low-Bit KV Cache. | Dayou Du, Shijie Cao, Jianyi Cheng, Luo Mai, Ting Cao, Mao Yang |
| 2026 | Mobisys | Vec-LUT: Vector Table Lookup for Parallel Ultra-Low-Bit LLM Inference on Edge Devices. | Xiangyu Li, Chengyu Yin, Weijun Wang, Jianyu Wei, Ting Cao, Yunxin Liu |
| 2026 | NSDI | AVA: Towards Agentic Video Analytics with Vision Language Models. | Yuxuan Yan, Shiqi Jiang, Ting Cao, Yifan Yang, Qianqian Yang, Yuanchao Shu, Yuqing Yang, Lili Qiu |
| 2026 | SIGCOMM | Efficient Remote KV Cache Reuse with GPU-native Video Codec. | Liang Mi, Weijun Wang, Jinghan Chen, Ting Cao, Haipeng Dai, Yunxin Liu |
| 2025 | ACL | Bitnet.cpp: Efficient Edge Inference for Ternary LLMs. | Jinheng Wang, Hansong Zhou, Ting Song, Shijie Cao, Yan Xia, Ting Cao, Jianyu Wei, Shuming Ma, Hongyu Wang, Furu Wei |
| 2025 | ASPLOS | Neuralink: Fast on-Device LLM Inference with Neuron Co-Activation Linking. | Tuowei Wang, Ruwen Fan, Minxing Huang, Zixu Hao, Kun Li, Ting Cao, Youyou Lu, Yaoxue Zhang, Ju Ren |
| 2025 | EuroSys | T-MAC: CPU Renaissance via Table Lookup for Low-Bit LLM Deployment on Edge. | Jianyu Wei, Shijie Cao, Ting Cao, Lingxiao Ma, Lei Wang, Yanyong Zhang, Mao Yang |
| 2025 | HPCA | LUT-DLA: Lookup Table as Efficient Extreme Low-Bit Deep Learning Accelerator. | Guoyu Li, Shengyu Ye, Chunyun Chen, Yang Wang, Fan Yang, Ting Cao, Cheng Liu, Mohamed M. Sabry Aly, Mao Yang |
| 2025 | ICCV | StreamMind: Unlocking Full Frame Rate Streaming Video Dialogue through Event-Gated Cognition. | Xin Ding, Hao Wu, Yifan Yang, Shiqi Jiang, Qianxi Zhang, Donglin Bai, Zhibo Chen, Ting Cao |
| 2025 | ISCA | LUT Tensor Core: A Software-Hardware Co-Design for LUT-Based Low-Bit LLM Inference. | Zhiwen Mo, Lei Wang, Jianyu Wei, Zhichen Zeng, Shijie Cao, Lingxiao Ma, Naifeng Jing, Ting Cao, Jilong Xue, Fan Yang, Mao Yang |
| 2025 | MOBICOM | Demo: EdgeMind-OS: A Plug-and-Play Embodied Intelligence System for Real-Time On-Device Deployment. | Xin Ding, Jianyu Wei, Fucheng Jia, Liang Mi, Ruofei Ju, Xianye Wang, Yikai Zheng, Ziming Zhang, Weijun Wang, Shiqi Jiang, Yunxin Liu, Ting Cao |
| 2025 | PPoPP | FlashFFTStencil: Bridging Fast Fourier Transforms to Memory-Efficient Stencil Computations on Tensor Core Units. | Haozhi Han, Kun Li, Wei Cui, Donglin Bai, Yiwei Zhang, Liang Yuan, Yifeng Chen, Yunquan Zhang, Ting Cao, Mao Yang |
| 2025 | PPoPP | Jigsaw: Toward Conflict-free Vectorized Stencil Computation by Tessellating Swizzled Registers. | Yiwei Zhang, Kun Li, Liang Yuan, Haozhi Han, Yunquan Zhang, Ting Cao, Mao Yang |
| 2025 | SC | Matrix Is All You Need: Rearchitecting Quantum Chemistry to Scale on AI Accelerators. | Haozhi Han, Kun Li, Fusong Ju, Qi Li, Hong An, Yifeng Chen, Yunquan Zhang, Ting Cao, Mao Yang |
| 2025 | SC | SparStencil: Retargeting Sparse Tensor Cores to Scientific Stencil Computations via Structured Sparsity Transformation. | Qi Li, Kun Li, Haozhi Han, Liang Yuan, Yunquan Zhang, Yifeng Chen, Junshi Chen, Hong An, Ting Cao, Mao Yang |
| 2025 | SENSYS | Babel: A Scalable Pre-trained Model for Multi-Modal Sensing via Expandable Modality Alignment. | Shenghong Dai, Shiqi Jiang, Yifan Yang, Ting Cao, Mo Li, Suman Banerjee, Lili Qiu |
| 2025 | USENIX | JENGA: Enhancing LLM Long-Context Fine-tuning with Contextual Token Sparsity. | Tuowei Wang, Xingyu Chen, Kun Li, Ting Cao, Ju Ren, Yaoxue Zhang |
| 2024 | ACL | BitDistiller: Unleashing the Potential of Sub-4-Bit LLMs via Self-Distillation. | Dayou Du, Yijia Zhang, Shijie Cao, Jiaqi Guo, Ting Cao, Xiaowen Chu, Ningyi Xu |
| 2024 | ACL | AFPQ: Asymmetric Floating Point Quantization for LLMs. | Yijia Zhang, Sicheng Zhang, Shijie Cao, Dayou Du, Jianyu Wei, Ting Cao, Ningyi Xu |
| 2024 | ASPLOS | PIM-DL: Expanding the Applicability of Commodity DRAM-PIMs for Deep Learning via Algorithm-System Co-Optimization. | Cong Li, Zhe Zhou, Yang Wang, Fan Yang, Ting Cao, Mao Yang, Yun Liang, Guangyu Sun |
| 2024 | EMNLP | VPTQ: Extreme Low-bit Vector Post-Training Quantization for Large Language Models. | Yifei Liu, Jicheng Wen, Yang Wang, Shengyu Ye, Li Lyna Zhang, Ting Cao, Cheng Li, Mao Yang |
| 2024 | ICASSP | A Fine-Grained Tri-Modal Interaction Model for Multimodal Sentiment Analysis. | Yuxing Zhi, Junhuai Li, Huaijun Wang, Jing Chen, Ting Cao |
| 2024 | IJCNN | Cross-Domain Activity Recognition Based on Stacked Transfer Network. | Junhuai Li, Jingyi Cao, Yuxing Zhi, Huaijun Wang, Ting Cao, Rong Fei |
| 2024 | ISCA | Pre-gated MoE: An Algorithm-System Co-Design for Fast and Scalable Mixture-of-Expert Inference. | Ranggi Hwang, Jianyu Wei, Shijie Cao, Changho Hwang, Xiaohu Tang, Ting Cao, Mao Yang |
| 2024 | MOBICOM | FlexNN: Efficient and Adaptive DNN Inference on Memory-Constrained Edge Devices. | Xiangyu Li, Yuanchun Li, Yuanzhe Li, Ting Cao, Yunxin Liu |
| 2024 | Mobisys | Empowering In-Browser Deep Learning Inference on Edge Through Just-In-Time Kernel Optimization. | Fucheng Jia, Shiqi Jiang, Ting Cao, Wei Cui, Tianrui Xia, Xu Cao, Yuanchun Li, Qipeng Wang, Deyu Zhang, Ju Ren, Yunxin Liu, Lili Qiu, Mao Yang |
| 2024 | Mobisys | Poster: Design of Elastic Deep Neural Network Candidate Spaces for Inference on Diverse Devices. | Jeongho Won, Ting Cao, Huiqiang Jiang, Junehwa Song |
| 2024 | NSDI | LitePred: Transferable and Scalable Latency Prediction for Hardware-Aware Neural Architecture Search. | Chengquan Feng, Li Lyna Zhang, Yuanchi Liu, Jiahang Xu, Chengruidong Zhang, Zhiyuan Wang, Ting Cao, Mao Yang, Haisheng Tan |
| 2024 | OSDI | Ladder: Enabling Efficient Low-Precision Deep Learning Computing through Hardware-aware Tensor Transformation. | Lei Wang, Lingxiao Ma, Shijie Cao, Quanlu Zhang, Jilong Xue, Yining Shi, Ningxin Zheng, Ziming Miao, Fan Yang, Ting Cao, Yuqing Yang, Mao Yang |
| 2024 | PPoPP | ConvStencil: Transform Stencil Computation to Matrix Multiplication on Tensor Cores. | Yuetao Chen, Kun Li, Yuhao Wang, Donglin Bai, Lei Wang, Lingxiao Ma, Liang Yuan, Yunquan Zhang, Ting Cao, Mao Yang |
| 2024 | SC | Long Exposure: Accelerating Parameter-Efficient Fine-Tuning for LLMs under Shadowy Sparsity. | Tuowei Wang, Kun Li, Zixu Hao, Donglin Bai, Ju Ren, Yaoxue Zhang, Ting Cao, Mao Yang |
| 2024 | SC | LoRAStencil: Low-Rank Adaptation of Stencil Computation on Tensor Cores. | Yiwei Zhang, Kun Li, Liang Yuan, Jiawen Cheng, Yunquan Zhang, Ting Cao, Mao Yang |
| 2023 | ECAI | Adam Accumulation to Reduce Memory Footprints of Both Activations and Gradients for Large-Scale DNN Training. | Yijia Zhang, Yibo Han, Shijie Cao, Guohao Dai, Youshan Miao, Ting Cao, Fan Yang, Ningyi Xu |
| 2023 | ICCV | ElasticViT: Conflict-aware Supernet Training for Deploying Fast Vision Transformer on Diverse Mobile Devices. | Chen Tang, Li Lyna Zhang, Huiqiang Jiang, Jiahang Xu, Ting Cao, Quanlu Zhang, Yuqing Yang, Zhi Wang, Mao Yang |
| 2023 | ICCV | SpaceEvo: Hardware-Friendly Search Space Design for Efficient INT8 Inference. | Xudong Wang, Li Lyna Zhang, Jiahang Xu, Quanlu Zhang, Yujing Wang, Yuqing Yang, Ningxin Zheng, Ting Cao, Mao Yang |
| 2023 | Interspeech | Accurate and Structured Pruning for Efficient Automatic Speech Recognition. | Huiqiang Jiang, Li Lyna Zhang, Yuang Li, Yu Wu, Shijie Cao, Ting Cao, Yuqing Yang, Jinyu Li, Mao Yang, Lili Qiu |
| 2023 | KDD | Constraint-aware and Ranking-distilled Token Pruning for Efficient Transformer Inference. | Junyan Li, Li Lyna Zhang, Jiahang Xu, Yujing Wang, Shaoguang Yan, Yunqing Xia, Yuqing Yang, Ting Cao, Hao Sun, Weiwei Deng, Qi Zhang, Mao Yang |
| 2023 | MOBICOM | LUT-NN: Empower Efficient Neural Network Inference with Centroid Learning and Table Lookup. | Xiaohu Tang, Yang Wang, Ting Cao, Li Lyna Zhang, Qi Chen, Deng Cai, Yunxin Liu, Mao Yang |
| 2023 | Mobisys | NN-Stretch: Automatic Neural Network Branching for Parallel Inference on Heterogeneous Multi-Processors. | Jianyu Wei, Ting Cao, Shijie Cao, Shiqi Jiang, Shaowei Fu, Mao Yang, Yanyong Zhang, Yunxin Liu |
| 2023 | Mobisys | Boosting DNN Cold Inference on Edge Devices. | Rongjie Yi, Ting Cao, Ao Zhou, Xiao Ma, Shangguang Wang, Mengwei Xu |
| 2022 | CIKM | SwiftPruner: Reinforced Evolutionary Pruning for Efficient Ad Relevance. | Li Lyna Zhang, Youkow Homma, Yujing Wang, Min Wu, Mao Yang, Ruofei Zhang, Ting Cao, Wei Shen |
| 2022 | MOBICOM | Romou: rapidly generate high-performance tensor kernels for mobile GPUs. | Rendong Liang, Ting Cao, Jicheng Wen, Manni Wang, Yang Wang, Jianhua Zou, Yunxin Liu |
| 2022 | MOBICOM | MobiDepth: real-time depth estimation using on-device dual cameras. | Jinrui Zhang, Huan Yang, Ju Ren, Deyu Zhang, Bangwen He, Ting Cao, Yuanchun Li, Yaoxue Zhang, Yunxin Liu |
| 2022 | Mobisys | CoDL: efficient CPU-GPU co-execution for deep learning inference on mobile devices. | Fucheng Jia, Deyu Zhang, Ting Cao, Shiqi Jiang, Yunxin Liu, Ju Ren, Yaoxue Zhang |
| 2022 | SENSYS | Turbo: Opportunistic Enhancement for Edge Video Analytics. | Yan Lu, Shiqi Jiang, Ting Cao, Yuanchao Shu |
| 2022 | SENSYS | Hyperion: A Generic and Distributed Mobile Offloading Framework on OpenCL. | Ziyan Fu, Ju Ren, Yunxin Liu, Ting Cao, Deyu Zhang, Yuezhi Zhou, Yaoxue Zhang |
| 2021 | HCI | Insights and Lessons Learned from the Design, Development and Deployment of Pervasive Location-Based Mobile Systems "in the Wild". | Konstantinos Papangelis, Alan Chamberlain, Nicolas J. LaLone, Ting Cao |
| 2021 | MOBICOM | AsyMo: scalable and efficient deep-learning inference on asymmetric mobile CPUs. | Manni Wang, Shaohua Ding, Ting Cao, Yunxin Liu, Fengyuan Xu |
| 2021 | Mobisys | nn-Meter: towards accurate latency prediction of deep-learning model inference on diverse edge devices. | Li Lyna Zhang, Shihao Han, Jianyu Wei, Ningxin Zheng, Ting Cao, Yuqing Yang, Yunxin Liu |
| 2020 | IPCCC | Modeling Energy Consumption of Virtual Machines in DVFS-Enabled Cloud Data Centers. | Jianzhou Mao, Tathagata Bhattacharya, Xiaopu Peng, Ting Cao, Xiao Qin |
| 2019 | ICCE | Exploring Chinese Rural Primary School Teachers' Application Competencies of Educational Technologies. | Xiaorong Yu, Di Wu, Chun Lu, Ting Cao, Xi-Being Xiong |
| 2019 | PLDI | Panthera: holistic memory management for big data processing over hybrid memories. | Chenxi Wang, Huimin Cui, Ting Cao, John N. Zigman, Haris Volos, Onur Mutlu, Fang Lv, Xiaobing Feng, Guoqing Harry Xu |
| 2016 | CGO | Portable performance on asymmetric multicore processors. | Ivan Jibaja, Ting Cao, Stephen M. Blackburn, Kathryn S. McKinley |
| 2016 | NPC | Efficient Management for Hybrid Memory in Managed Language Runtime. | Chenxi Wang, Ting Cao, John N. Zigman, Fang Lv, Yunquan Zhang, Xiaobing Feng |
| 2015 | ICIG | Road Detection Based on Image Boundary Prior. | Huan Wang, Yan Gong, Yangyang Hou, Ting Cao |
| 2015 | ICPP | Optimizing Image Sharpening Algorithm on GPU. | Mengran Fan, Haipeng Jia, Yunquan Zhang, Xiaojing An, Ting Cao |
| 2013 | WCNC | Traffic Aware Routing in urban vehicular networks. | Ting Cao, Xinchao Zhang, Linghe Kong, Xiao-Yang Liu, Wei Shu, Min-You Wu |
| 2012 | ISCA | The Yin and Yang of power and performance for asymmetric hardware and managed software. | Ting Cao, Stephen M. Blackburn, Tiejun Gao, Kathryn S. McKinley |
| 2011 | ASPLOS | Looking back on the language and hardware revolutions: measured power, performance, and scaling. | Hadi Esmaeilzadeh, Ting Cao, Xi Yang, Stephen M. Blackburn, Kathryn S. McKinley |
| 2010 | ICCD | DSS: Applying asynchronous techniques to architectures exploiting ILP at compile time. | Wei Shi, Zhiying Wang, Hongguang Ren, Ting Cao, Wei Chen, Bo Su, Hongyi Lu |
| 2010 | WCNC | A Novel Bus Lane Enforcement System with Vehicular Sensor Networks. | Xu Li, Ting Cao, Hongyu Huang, Minglu Li, Wei Shu, Min-You Wu |