Shijie Cao
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
17
Venues
13
Active years
2019–2026
Best venue rank
A*
Where they publish
Papers
17 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | ACL | Rectified Sparse Attention for Efficient Long-Sequence Generation. | Yutao Sun, Tianzhu Ye, Li Dong, Yuqing Xia, Jian Chen, Yizhao Gao, Shijie Cao, Jianyong Wang, Furu Wei |
| 2026 | ASPDAC | ROMA: A Read-Only-Memory-based Accelerator for QLoRA-based On-Device LLM. | Wenqiang Wang, Yijia Zhang, Zikai Zhang, Guanting Huo, Hao Liang, Shijie Cao, Ningyi Xu |
| 2026 | HPCA | BitDecoding: Unlocking Tensor Cores for Long-Context LLMs with Low-Bit KV Cache. | Dayou Du, Shijie Cao, Jianyi Cheng, Luo Mai, Ting Cao, Mao Yang |
| 2025 | ACL | Bitnet.cpp: Efficient Edge Inference for Ternary LLMs. | Jinheng Wang, Hansong Zhou, Ting Song, Shijie Cao, Yan Xia, Ting Cao, Jianyu Wei, Shuming Ma, Hongyu Wang, Furu Wei |
| 2025 | EuroSys | T-MAC: CPU Renaissance via Table Lookup for Low-Bit LLM Deployment on Edge. | Jianyu Wei, Shijie Cao, Ting Cao, Lingxiao Ma, Lei Wang, Yanyong Zhang, Mao Yang |
| 2025 | ISCA | LUT Tensor Core: A Software-Hardware Co-Design for LUT-Based Low-Bit LLM Inference. | Zhiwen Mo, Lei Wang, Jianyu Wei, Zhichen Zeng, Shijie Cao, Lingxiao Ma, Naifeng Jing, Ting Cao, Jilong Xue, Fan Yang, Mao Yang |
| 2025 | KSEM | A Dual-Module System Design and Application for Digital Payment Fraud Detection. | Yingxin Hong, Qingqing Ren, Shijie Cao, Hualing Liu |
| 2024 | ACL | BitDistiller: Unleashing the Potential of Sub-4-Bit LLMs via Self-Distillation. | Dayou Du, Yijia Zhang, Shijie Cao, Jiaqi Guo, Ting Cao, Xiaowen Chu, Ningyi Xu |
| 2024 | ACL | AFPQ: Asymmetric Floating Point Quantization for LLMs. | Yijia Zhang, Sicheng Zhang, Shijie Cao, Dayou Du, Jianyu Wei, Ting Cao, Ningyi Xu |
| 2024 | ISCA | Pre-gated MoE: An Algorithm-System Co-Design for Fast and Scalable Mixture-of-Expert Inference. | Ranggi Hwang, Jianyu Wei, Shijie Cao, Changho Hwang, Xiaohu Tang, Ting Cao, Mao Yang |
| 2024 | OSDI | Ladder: Enabling Efficient Low-Precision Deep Learning Computing through Hardware-aware Tensor Transformation. | Lei Wang, Lingxiao Ma, Shijie Cao, Quanlu Zhang, Jilong Xue, Yining Shi, Ningxin Zheng, Ziming Miao, Fan Yang, Ting Cao, Yuqing Yang, Mao Yang |
| 2023 | ECAI | Adam Accumulation to Reduce Memory Footprints of Both Activations and Gradients for Large-Scale DNN Training. | Yijia Zhang, Yibo Han, Shijie Cao, Guohao Dai, Youshan Miao, Ting Cao, Fan Yang, Ningyi Xu |
| 2023 | Interspeech | Accurate and Structured Pruning for Efficient Automatic Speech Recognition. | Huiqiang Jiang, Li Lyna Zhang, Yuang Li, Yu Wu, Shijie Cao, Ting Cao, Yuqing Yang, Jinyu Li, Mao Yang, Lili Qiu |
| 2023 | Mobisys | NN-Stretch: Automatic Neural Network Branching for Parallel Inference on Heterogeneous Multi-Processors. | Jianyu Wei, Ting Cao, Shijie Cao, Shiqi Jiang, Shaowei Fu, Mao Yang, Yanyong Zhang, Yunxin Liu |
| 2019 | AAAI | Balanced Sparsity for Efficient DNN Inference on GPU. | Zhuliang Yao, Shijie Cao, Wencong Xiao, Chen Zhang, Lanshun Nie |
| 2019 | CVPR | SeerNet: Predicting Convolutional Neural Network Feature-Map Sparsity Through Low-Bit Quantization. | Shijie Cao, Lingxiao Ma, Wencong Xiao, Chen Zhang, Yunxin Liu, Lintao Zhang, Lanshun Nie, Zhi Yang |
| 2019 | FPGA | Efficient and Effective Sparse LSTM on FPGA with Bank-Balanced Sparsity. | Shijie Cao, Chen Zhang, Zhuliang Yao, Wencong Xiao, Lanshun Nie, De-chen Zhan, Yunxin Liu, Ming Wu, Lintao Zhang |