Skip to content

Shijie Cao

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

17

Venues

13

Active years

2019–2026

Best venue rank

A*

Where they publish

Papers

17 indexed papers, newest first.

YearVenueTitleAuthors
2026ACLRectified Sparse Attention for Efficient Long-Sequence Generation.Yutao Sun, Tianzhu Ye, Li Dong, Yuqing Xia, Jian Chen, Yizhao Gao, Shijie Cao, Jianyong Wang, Furu Wei
2026ASPDACROMA: A Read-Only-Memory-based Accelerator for QLoRA-based On-Device LLM.Wenqiang Wang, Yijia Zhang, Zikai Zhang, Guanting Huo, Hao Liang, Shijie Cao, Ningyi Xu
2026HPCABitDecoding: Unlocking Tensor Cores for Long-Context LLMs with Low-Bit KV Cache.Dayou Du, Shijie Cao, Jianyi Cheng, Luo Mai, Ting Cao, Mao Yang
2025ACLBitnet.cpp: Efficient Edge Inference for Ternary LLMs.Jinheng Wang, Hansong Zhou, Ting Song, Shijie Cao, Yan Xia, Ting Cao, Jianyu Wei, Shuming Ma, Hongyu Wang, Furu Wei
2025EuroSysT-MAC: CPU Renaissance via Table Lookup for Low-Bit LLM Deployment on Edge.Jianyu Wei, Shijie Cao, Ting Cao, Lingxiao Ma, Lei Wang, Yanyong Zhang, Mao Yang
2025ISCALUT Tensor Core: A Software-Hardware Co-Design for LUT-Based Low-Bit LLM Inference.Zhiwen Mo, Lei Wang, Jianyu Wei, Zhichen Zeng, Shijie Cao, Lingxiao Ma, Naifeng Jing, Ting Cao, Jilong Xue, Fan Yang, Mao Yang
2025KSEMA Dual-Module System Design and Application for Digital Payment Fraud Detection.Yingxin Hong, Qingqing Ren, Shijie Cao, Hualing Liu
2024ACLBitDistiller: Unleashing the Potential of Sub-4-Bit LLMs via Self-Distillation.Dayou Du, Yijia Zhang, Shijie Cao, Jiaqi Guo, Ting Cao, Xiaowen Chu, Ningyi Xu
2024ACLAFPQ: Asymmetric Floating Point Quantization for LLMs.Yijia Zhang, Sicheng Zhang, Shijie Cao, Dayou Du, Jianyu Wei, Ting Cao, Ningyi Xu
2024ISCAPre-gated MoE: An Algorithm-System Co-Design for Fast and Scalable Mixture-of-Expert Inference.Ranggi Hwang, Jianyu Wei, Shijie Cao, Changho Hwang, Xiaohu Tang, Ting Cao, Mao Yang
2024OSDILadder: Enabling Efficient Low-Precision Deep Learning Computing through Hardware-aware Tensor Transformation.Lei Wang, Lingxiao Ma, Shijie Cao, Quanlu Zhang, Jilong Xue, Yining Shi, Ningxin Zheng, Ziming Miao, Fan Yang, Ting Cao, Yuqing Yang, Mao Yang
2023ECAIAdam Accumulation to Reduce Memory Footprints of Both Activations and Gradients for Large-Scale DNN Training.Yijia Zhang, Yibo Han, Shijie Cao, Guohao Dai, Youshan Miao, Ting Cao, Fan Yang, Ningyi Xu
2023InterspeechAccurate and Structured Pruning for Efficient Automatic Speech Recognition.Huiqiang Jiang, Li Lyna Zhang, Yuang Li, Yu Wu, Shijie Cao, Ting Cao, Yuqing Yang, Jinyu Li, Mao Yang, Lili Qiu
2023MobisysNN-Stretch: Automatic Neural Network Branching for Parallel Inference on Heterogeneous Multi-Processors.Jianyu Wei, Ting Cao, Shijie Cao, Shiqi Jiang, Shaowei Fu, Mao Yang, Yanyong Zhang, Yunxin Liu
2019AAAIBalanced Sparsity for Efficient DNN Inference on GPU.Zhuliang Yao, Shijie Cao, Wencong Xiao, Chen Zhang, Lanshun Nie
2019CVPRSeerNet: Predicting Convolutional Neural Network Feature-Map Sparsity Through Low-Bit Quantization.Shijie Cao, Lingxiao Ma, Wencong Xiao, Chen Zhang, Yunxin Liu, Lintao Zhang, Lanshun Nie, Zhi Yang
2019FPGAEfficient and Effective Sparse LSTM on FPGA with Bank-Balanced Sparsity.Shijie Cao, Chen Zhang, Zhuliang Yao, Wencong Xiao, Lanshun Nie, De-chen Zhan, Yunxin Liu, Ming Wu, Lintao Zhang