Skip to content

Ting Cao

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

62

Venues

32

Active years

2010–2026

Best venue rank

A*

Where they publish

Papers

62 indexed papers, newest first.

YearVenueTitleAuthors
2026EuroSysScaling LLM Test-Time Compute with Mobile NPU on Smartphones.Zixu Hao, Jianyu Wei, Tuowei Wang, Minxing Huang, Huiqiang Jiang, Shiqi Jiang, Ting Cao, Ju Ren
2026HPCABitDecoding: Unlocking Tensor Cores for Long-Context LLMs with Low-Bit KV Cache.Dayou Du, Shijie Cao, Jianyi Cheng, Luo Mai, Ting Cao, Mao Yang
2026MobisysVec-LUT: Vector Table Lookup for Parallel Ultra-Low-Bit LLM Inference on Edge Devices.Xiangyu Li, Chengyu Yin, Weijun Wang, Jianyu Wei, Ting Cao, Yunxin Liu
2026NSDIAVA: Towards Agentic Video Analytics with Vision Language Models.Yuxuan Yan, Shiqi Jiang, Ting Cao, Yifan Yang, Qianqian Yang, Yuanchao Shu, Yuqing Yang, Lili Qiu
2026SIGCOMMEfficient Remote KV Cache Reuse with GPU-native Video Codec.Liang Mi, Weijun Wang, Jinghan Chen, Ting Cao, Haipeng Dai, Yunxin Liu
2025ACLBitnet.cpp: Efficient Edge Inference for Ternary LLMs.Jinheng Wang, Hansong Zhou, Ting Song, Shijie Cao, Yan Xia, Ting Cao, Jianyu Wei, Shuming Ma, Hongyu Wang, Furu Wei
2025ASPLOSNeuralink: Fast on-Device LLM Inference with Neuron Co-Activation Linking.Tuowei Wang, Ruwen Fan, Minxing Huang, Zixu Hao, Kun Li, Ting Cao, Youyou Lu, Yaoxue Zhang, Ju Ren
2025EuroSysT-MAC: CPU Renaissance via Table Lookup for Low-Bit LLM Deployment on Edge.Jianyu Wei, Shijie Cao, Ting Cao, Lingxiao Ma, Lei Wang, Yanyong Zhang, Mao Yang
2025HPCALUT-DLA: Lookup Table as Efficient Extreme Low-Bit Deep Learning Accelerator.Guoyu Li, Shengyu Ye, Chunyun Chen, Yang Wang, Fan Yang, Ting Cao, Cheng Liu, Mohamed M. Sabry Aly, Mao Yang
2025ICCVStreamMind: Unlocking Full Frame Rate Streaming Video Dialogue through Event-Gated Cognition.Xin Ding, Hao Wu, Yifan Yang, Shiqi Jiang, Qianxi Zhang, Donglin Bai, Zhibo Chen, Ting Cao
2025ISCALUT Tensor Core: A Software-Hardware Co-Design for LUT-Based Low-Bit LLM Inference.Zhiwen Mo, Lei Wang, Jianyu Wei, Zhichen Zeng, Shijie Cao, Lingxiao Ma, Naifeng Jing, Ting Cao, Jilong Xue, Fan Yang, Mao Yang
2025MOBICOMDemo: EdgeMind-OS: A Plug-and-Play Embodied Intelligence System for Real-Time On-Device Deployment.Xin Ding, Jianyu Wei, Fucheng Jia, Liang Mi, Ruofei Ju, Xianye Wang, Yikai Zheng, Ziming Zhang, Weijun Wang, Shiqi Jiang, Yunxin Liu, Ting Cao
2025PPoPPFlashFFTStencil: Bridging Fast Fourier Transforms to Memory-Efficient Stencil Computations on Tensor Core Units.Haozhi Han, Kun Li, Wei Cui, Donglin Bai, Yiwei Zhang, Liang Yuan, Yifeng Chen, Yunquan Zhang, Ting Cao, Mao Yang
2025PPoPPJigsaw: Toward Conflict-free Vectorized Stencil Computation by Tessellating Swizzled Registers.Yiwei Zhang, Kun Li, Liang Yuan, Haozhi Han, Yunquan Zhang, Ting Cao, Mao Yang
2025SCMatrix Is All You Need: Rearchitecting Quantum Chemistry to Scale on AI Accelerators.Haozhi Han, Kun Li, Fusong Ju, Qi Li, Hong An, Yifeng Chen, Yunquan Zhang, Ting Cao, Mao Yang
2025SCSparStencil: Retargeting Sparse Tensor Cores to Scientific Stencil Computations via Structured Sparsity Transformation.Qi Li, Kun Li, Haozhi Han, Liang Yuan, Yunquan Zhang, Yifeng Chen, Junshi Chen, Hong An, Ting Cao, Mao Yang
2025SENSYSBabel: A Scalable Pre-trained Model for Multi-Modal Sensing via Expandable Modality Alignment.Shenghong Dai, Shiqi Jiang, Yifan Yang, Ting Cao, Mo Li, Suman Banerjee, Lili Qiu
2025USENIXJENGA: Enhancing LLM Long-Context Fine-tuning with Contextual Token Sparsity.Tuowei Wang, Xingyu Chen, Kun Li, Ting Cao, Ju Ren, Yaoxue Zhang
2024ACLBitDistiller: Unleashing the Potential of Sub-4-Bit LLMs via Self-Distillation.Dayou Du, Yijia Zhang, Shijie Cao, Jiaqi Guo, Ting Cao, Xiaowen Chu, Ningyi Xu
2024ACLAFPQ: Asymmetric Floating Point Quantization for LLMs.Yijia Zhang, Sicheng Zhang, Shijie Cao, Dayou Du, Jianyu Wei, Ting Cao, Ningyi Xu
2024ASPLOSPIM-DL: Expanding the Applicability of Commodity DRAM-PIMs for Deep Learning via Algorithm-System Co-Optimization.Cong Li, Zhe Zhou, Yang Wang, Fan Yang, Ting Cao, Mao Yang, Yun Liang, Guangyu Sun
2024EMNLPVPTQ: Extreme Low-bit Vector Post-Training Quantization for Large Language Models.Yifei Liu, Jicheng Wen, Yang Wang, Shengyu Ye, Li Lyna Zhang, Ting Cao, Cheng Li, Mao Yang
2024ICASSPA Fine-Grained Tri-Modal Interaction Model for Multimodal Sentiment Analysis.Yuxing Zhi, Junhuai Li, Huaijun Wang, Jing Chen, Ting Cao
2024IJCNNCross-Domain Activity Recognition Based on Stacked Transfer Network.Junhuai Li, Jingyi Cao, Yuxing Zhi, Huaijun Wang, Ting Cao, Rong Fei
2024ISCAPre-gated MoE: An Algorithm-System Co-Design for Fast and Scalable Mixture-of-Expert Inference.Ranggi Hwang, Jianyu Wei, Shijie Cao, Changho Hwang, Xiaohu Tang, Ting Cao, Mao Yang
2024MOBICOMFlexNN: Efficient and Adaptive DNN Inference on Memory-Constrained Edge Devices.Xiangyu Li, Yuanchun Li, Yuanzhe Li, Ting Cao, Yunxin Liu
2024MobisysEmpowering In-Browser Deep Learning Inference on Edge Through Just-In-Time Kernel Optimization.Fucheng Jia, Shiqi Jiang, Ting Cao, Wei Cui, Tianrui Xia, Xu Cao, Yuanchun Li, Qipeng Wang, Deyu Zhang, Ju Ren, Yunxin Liu, Lili Qiu, Mao Yang
2024MobisysPoster: Design of Elastic Deep Neural Network Candidate Spaces for Inference on Diverse Devices.Jeongho Won, Ting Cao, Huiqiang Jiang, Junehwa Song
2024NSDILitePred: Transferable and Scalable Latency Prediction for Hardware-Aware Neural Architecture Search.Chengquan Feng, Li Lyna Zhang, Yuanchi Liu, Jiahang Xu, Chengruidong Zhang, Zhiyuan Wang, Ting Cao, Mao Yang, Haisheng Tan
2024OSDILadder: Enabling Efficient Low-Precision Deep Learning Computing through Hardware-aware Tensor Transformation.Lei Wang, Lingxiao Ma, Shijie Cao, Quanlu Zhang, Jilong Xue, Yining Shi, Ningxin Zheng, Ziming Miao, Fan Yang, Ting Cao, Yuqing Yang, Mao Yang
2024PPoPPConvStencil: Transform Stencil Computation to Matrix Multiplication on Tensor Cores.Yuetao Chen, Kun Li, Yuhao Wang, Donglin Bai, Lei Wang, Lingxiao Ma, Liang Yuan, Yunquan Zhang, Ting Cao, Mao Yang
2024SCLong Exposure: Accelerating Parameter-Efficient Fine-Tuning for LLMs under Shadowy Sparsity.Tuowei Wang, Kun Li, Zixu Hao, Donglin Bai, Ju Ren, Yaoxue Zhang, Ting Cao, Mao Yang
2024SCLoRAStencil: Low-Rank Adaptation of Stencil Computation on Tensor Cores.Yiwei Zhang, Kun Li, Liang Yuan, Jiawen Cheng, Yunquan Zhang, Ting Cao, Mao Yang
2023ECAIAdam Accumulation to Reduce Memory Footprints of Both Activations and Gradients for Large-Scale DNN Training.Yijia Zhang, Yibo Han, Shijie Cao, Guohao Dai, Youshan Miao, Ting Cao, Fan Yang, Ningyi Xu
2023ICCVElasticViT: Conflict-aware Supernet Training for Deploying Fast Vision Transformer on Diverse Mobile Devices.Chen Tang, Li Lyna Zhang, Huiqiang Jiang, Jiahang Xu, Ting Cao, Quanlu Zhang, Yuqing Yang, Zhi Wang, Mao Yang
2023ICCVSpaceEvo: Hardware-Friendly Search Space Design for Efficient INT8 Inference.Xudong Wang, Li Lyna Zhang, Jiahang Xu, Quanlu Zhang, Yujing Wang, Yuqing Yang, Ningxin Zheng, Ting Cao, Mao Yang
2023InterspeechAccurate and Structured Pruning for Efficient Automatic Speech Recognition.Huiqiang Jiang, Li Lyna Zhang, Yuang Li, Yu Wu, Shijie Cao, Ting Cao, Yuqing Yang, Jinyu Li, Mao Yang, Lili Qiu
2023KDDConstraint-aware and Ranking-distilled Token Pruning for Efficient Transformer Inference.Junyan Li, Li Lyna Zhang, Jiahang Xu, Yujing Wang, Shaoguang Yan, Yunqing Xia, Yuqing Yang, Ting Cao, Hao Sun, Weiwei Deng, Qi Zhang, Mao Yang
2023MOBICOMLUT-NN: Empower Efficient Neural Network Inference with Centroid Learning and Table Lookup.Xiaohu Tang, Yang Wang, Ting Cao, Li Lyna Zhang, Qi Chen, Deng Cai, Yunxin Liu, Mao Yang
2023MobisysNN-Stretch: Automatic Neural Network Branching for Parallel Inference on Heterogeneous Multi-Processors.Jianyu Wei, Ting Cao, Shijie Cao, Shiqi Jiang, Shaowei Fu, Mao Yang, Yanyong Zhang, Yunxin Liu
2023MobisysBoosting DNN Cold Inference on Edge Devices.Rongjie Yi, Ting Cao, Ao Zhou, Xiao Ma, Shangguang Wang, Mengwei Xu
2022CIKMSwiftPruner: Reinforced Evolutionary Pruning for Efficient Ad Relevance.Li Lyna Zhang, Youkow Homma, Yujing Wang, Min Wu, Mao Yang, Ruofei Zhang, Ting Cao, Wei Shen
2022MOBICOMRomou: rapidly generate high-performance tensor kernels for mobile GPUs.Rendong Liang, Ting Cao, Jicheng Wen, Manni Wang, Yang Wang, Jianhua Zou, Yunxin Liu
2022MOBICOMMobiDepth: real-time depth estimation using on-device dual cameras.Jinrui Zhang, Huan Yang, Ju Ren, Deyu Zhang, Bangwen He, Ting Cao, Yuanchun Li, Yaoxue Zhang, Yunxin Liu
2022MobisysCoDL: efficient CPU-GPU co-execution for deep learning inference on mobile devices.Fucheng Jia, Deyu Zhang, Ting Cao, Shiqi Jiang, Yunxin Liu, Ju Ren, Yaoxue Zhang
2022SENSYSTurbo: Opportunistic Enhancement for Edge Video Analytics.Yan Lu, Shiqi Jiang, Ting Cao, Yuanchao Shu
2022SENSYSHyperion: A Generic and Distributed Mobile Offloading Framework on OpenCL.Ziyan Fu, Ju Ren, Yunxin Liu, Ting Cao, Deyu Zhang, Yuezhi Zhou, Yaoxue Zhang
2021HCIInsights and Lessons Learned from the Design, Development and Deployment of Pervasive Location-Based Mobile Systems "in the Wild".Konstantinos Papangelis, Alan Chamberlain, Nicolas J. LaLone, Ting Cao
2021MOBICOMAsyMo: scalable and efficient deep-learning inference on asymmetric mobile CPUs.Manni Wang, Shaohua Ding, Ting Cao, Yunxin Liu, Fengyuan Xu
2021Mobisysnn-Meter: towards accurate latency prediction of deep-learning model inference on diverse edge devices.Li Lyna Zhang, Shihao Han, Jianyu Wei, Ningxin Zheng, Ting Cao, Yuqing Yang, Yunxin Liu
2020IPCCCModeling Energy Consumption of Virtual Machines in DVFS-Enabled Cloud Data Centers.Jianzhou Mao, Tathagata Bhattacharya, Xiaopu Peng, Ting Cao, Xiao Qin
2019ICCEExploring Chinese Rural Primary School Teachers' Application Competencies of Educational Technologies.Xiaorong Yu, Di Wu, Chun Lu, Ting Cao, Xi-Being Xiong
2019PLDIPanthera: holistic memory management for big data processing over hybrid memories.Chenxi Wang, Huimin Cui, Ting Cao, John N. Zigman, Haris Volos, Onur Mutlu, Fang Lv, Xiaobing Feng, Guoqing Harry Xu
2016CGOPortable performance on asymmetric multicore processors.Ivan Jibaja, Ting Cao, Stephen M. Blackburn, Kathryn S. McKinley
2016NPCEfficient Management for Hybrid Memory in Managed Language Runtime.Chenxi Wang, Ting Cao, John N. Zigman, Fang Lv, Yunquan Zhang, Xiaobing Feng
2015ICIGRoad Detection Based on Image Boundary Prior.Huan Wang, Yan Gong, Yangyang Hou, Ting Cao
2015ICPPOptimizing Image Sharpening Algorithm on GPU.Mengran Fan, Haipeng Jia, Yunquan Zhang, Xiaojing An, Ting Cao
2013WCNCTraffic Aware Routing in urban vehicular networks.Ting Cao, Xinchao Zhang, Linghe Kong, Xiao-Yang Liu, Wei Shu, Min-You Wu
2012ISCAThe Yin and Yang of power and performance for asymmetric hardware and managed software.Ting Cao, Stephen M. Blackburn, Tiejun Gao, Kathryn S. McKinley
2011ASPLOSLooking back on the language and hardware revolutions: measured power, performance, and scaling.Hadi Esmaeilzadeh, Ting Cao, Xi Yang, Stephen M. Blackburn, Kathryn S. McKinley
2010ICCDDSS: Applying asynchronous techniques to architectures exploiting ILP at compile time.Wei Shi, Zhiying Wang, Hongguang Ren, Ting Cao, Wei Chen, Bo Su, Hongyi Lu
2010WCNCA Novel Bus Lane Enforcement System with Vehicular Sensor Networks.Xu Li, Ting Cao, Hongyu Huang, Minglu Li, Wei Shu, Min-You Wu