Skip to content

Chengruidong Zhang

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

8

Venues

7

Active years

2023–2026

Best venue rank

A*

Where they publish

Papers

8 indexed papers, newest first.

YearVenueTitleAuthors
2026ACLAccelerating Prefilling via Decoding-time Contribution Sparsity.Zhiyuan He, Yike Zhang, Chengruidong Zhang, Huiqiang Jiang, Yuqing Yang, Lili Qiu
2025EMNLPLeanK: Learnable K Cache Channel Pruning for Efficient Decoding.Yike Zhang, Zhiyuan He, Huiqiang Jiang, Chengruidong Zhang, Yuqing Yang, Jianyong Wang, Lili Qiu
2025ICLRSCBench: A KV Cache-Centric Analysis of Long-Context Methods.Yucheng Li, Huiqiang Jiang, Qianhui Wu, Xufang Luo, Surin Ahn, Chengruidong Zhang, Amir H. Abdi, Dongsheng Li, Jianfeng Gao, Yuqing Yang, Lili Qiu
2025ICMLMMInference: Accelerating Pre-filling for Long-Context Visual Language Models via Modality-Aware Permutation Sparse Attention.Yucheng Li, Huiqiang Jiang, Chengruidong Zhang, Qianhui Wu, Xufang Luo, Surin Ahn, Amir H. Abdi, Dongsheng Li, Jianfeng Gao, Yuqing Yang, Lili Qiu
2024ICMLLongRoPE: Extending LLM Context Window Beyond 2 Million Tokens.Yiran Ding, Li Lyna Zhang, Chengruidong Zhang, Yuanyuan Xu, Ning Shang, Jiahang Xu, Fan Yang, Mao Yang
2024NSDILitePred: Transferable and Scalable Latency Prediction for Hardware-Aware Neural Architecture Search.Chengquan Feng, Li Lyna Zhang, Yuanchi Liu, Jiahang Xu, Chengruidong Zhang, Zhiyuan Wang, Ting Cao, Mao Yang, Haisheng Tan
2024OSDIParrot: Efficient Serving of LLM-based Applications with Semantic Variable.Chaofan Lin, Zhenhua Han, Chengruidong Zhang, Yuqing Yang, Fan Yang, Chen Chen, Lili Qiu
2023SOSPPIT: Optimization of Dynamic Sparse Deep Learning Models via Permutation Invariant Transformation.Ningxin Zheng, Huiqiang Jiang, Quanlu Zhang, Zhenhua Han, Lingxiao Ma, Yuqing Yang, Fan Yang, Chengruidong Zhang, Lili Qiu, Mao Yang, Lidong Zhou