Ruihao Gong
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
39
Venues
13
Active years
2019–2026
Best venue rank
A*
Where they publish
Papers
39 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | AAAI | LLMC+: Benchmarking Vision-Language Model Compression with a plug-and-play Toolkit. | Chengtao Lv, Bilang Zhang, Yang Yong, Ruihao Gong, Yushi Huang, Shiqiao Gu, Jiajun Wu, Yumeng Shi, Jinyang Guo, Wenya Wang |
| 2026 | ACL | Half-S: Halving the Scale for Near-Lossless 4-Bit LLM Training. | Jinyang Du, Ruihao Gong, Linghan Ai, Zining Wang, Yunke Peng, Yao Wang, Lei Yan, Xuefei Wang, Yaoyuan Wang, Jinyang Guo, Dahua Lin, Xianglong Liu |
| 2026 | ACL | Focus-dLLM: Accelerating Long-Context Diffusion LLM Inference via Confidence-Guided Context Focusing. | Lingkun Long, Yushi Huang, Shihao Bai, Ruihao Gong, Jun Zhang, Ao Zhou, Jianlei Yang |
| 2026 | EuroSys | PiLLM: Resource-Efficient LLM Inference Using Workload Prediction. | Yunqian Fan, Shihao Bai, Ruihao Gong, Zaijun Wang, Rui Fan |
| 2025 | AAAI | AtomNet: Designing Tiny Models from Operators Under Extreme MCU Constraints. | Zhiwei Dong, Mingzhu Shen, Shihao Bai, Xiuying Wei, Jinyang Guo, Ruihao Gong, Song-Lu Chen, Xianglong Liu, Xu-Cheng Yin |
| 2025 | ACL | Pre³: Enabling Deterministic Pushdown Automata for Faster Structured LLM Generation. | Junyi Chen, Shihao Bai, Zaijun Wang, Siyu Wu, Chuheng Du, Hailong Yang, Ruihao Gong, Shengzhong Liu, Fan Wu, Guihai Chen |
| 2025 | ASPLOS | Past-Future Scheduler for LLM Serving under SLA Guarantees. | Ruihao Gong, Shihao Bai, Siyu Wu, Yunqian Fan, Zaijun Wang, Xiuhong Li, Hailong Yang, Xianglong Liu |
| 2025 | ICASSP | Tool Playgrounds: A Comprehensive and Analyzable Benchmark for LLM Tool Invocation. | Zhiwei Dong, Ruihao Gong, Yang Yong, Shuo Wu, Yongqiang Yao, Song-Lu Chen, Xu-Cheng Yin |
| 2025 | ICML | DA-KD: Difficulty-Aware Knowledge Distillation for Efficient Large Language Models. | Changyi He, Yifu Ding, Jinyang Guo, Ruihao Gong, Haotong Qin, Xianglong Liu |
| 2025 | ICML | HarmoniCa: Harmonizing Training and Inference for Better Feature Caching in Diffusion Transformer Acceleration. | Yushi Huang, Zining Wang, Ruihao Gong, Jing Liu, Xinjie Zhang, Jinyang Guo, Xianglong Liu, Jun Zhang |
| 2025 | ICML | OmniBal: Towards Fast Instruction-Tuning for Vision-Language Models via Omniverse Computation Balance. | Yongqiang Yao, Jingru Tan, Feizhao Zhang, Jiahao Hu, Yazhe Niu, Xin Jin, Bo Li, Pengfei Liu, Ruihao Gong, Dahua Lin, Ningyi Xu |
| 2025 | SC | Towards Efficient LLM Inference via Collective and Adaptive Speculative Decoding. | Siqi Wang, Hailong Yang, Xuezhu Wang, Tongxuan Liu, Pengbo Wang, Yufan Xu, Xuning Liang, Kejie Ma, Tianyu Feng, Xin You, Ruihao Gong, Rui Wang, Zhongzhi Luan, Yi Liu, Depei Qian |
| 2024 | AAAI | Selective Focus: Investigating Semantics Sensitivity in Post-training Quantization for Lane Detection. | Yunqian Fan, Xiuying Wei, Ruihao Gong, Yuqing Ma, Xiangguo Zhang, Qi Zhang, Xianglong Liu |
| 2024 | AAAI | Fast and Controllable Post-training Sparsity: Learning Optimal Sparsity Allocation with Global Constraint in Minutes. | Ruihao Gong, Yang Yong, Zining Wang, Jinyang Guo, Xiuying Wei, Yuqing Ma, Xianglong Liu |
| 2024 | CVPR | TFMQ-DM: Temporal Feature Maintenance Quantization for Diffusion Models. | Yushi Huang, Ruihao Gong, Jing Liu, Tianlong Chen, Xianglong Liu |
| 2024 | EMNLP | LLMC: Benchmarking Large Language Model Quantization with a Versatile Compression Toolkit. | Ruihao Gong, Yang Yong, Shiqiao Gu, Yushi Huang, Chengtao Lv, Yunchen Zhang, Dacheng Tao, Xianglong Liu |
| 2024 | ICCAD | ProPD: Dynamic Token Tree Pruning and Generation for LLM Parallel Decoding. | Shuzhang Zhong, Zebin Yang, Ruihao Gong, Runsheng Wang, Ru Huang, Meng Li |
| 2024 | ICLR | QLLM: Accurate and Efficient Low-Bitwidth Quantization for Large Language Models. | Jing Liu, Ruihao Gong, Xiuying Wei, Zhiwei Dong, Jianfei Cai, Bohan Zhuang |
| 2024 | ICML | Compressing Large Language Models by Joint Sparsification and Quantization. | Jinyang Guo, Jianyu Wu, Zining Wang, Jiaheng Liu, Ge Yang, Yifu Ding, Ruihao Gong, Haotong Qin, Xianglong Liu |
| 2024 | ICPP | PRoof: A Comprehensive Hierarchical Profiling Framework for Deep Neural Networks with Roofline Analysis. | Siyu Wu, Hailong Yang, Xin You, Ruihao Gong, Yi Liu, Zhongzhi Luan, Depei Qian |
| 2023 | ACL | Adaptive Contrastive Knowledge Distillation for BERT Compression. | Jinyang Guo, Jiaheng Liu, Zining Wang, Yuqing Ma, Ruihao Gong, Ke Xu, Xianglong Liu |
| 2023 | CVPR | Exploring the Relationship Between Architectural Design and Adversarially Robust Generalization. | Aishan Liu, Shiyu Tang, Siyuan Liang, Ruihao Gong, Boxi Wu, Xianglong Liu, Dacheng Tao |
| 2023 | CVPR | Annealing-based Label-Transfer Learning for Open World Object Detection. | Yuqing Ma, Hainan Li, Zhange Zhang, Jinyang Guo, Shanghang Zhang, Ruihao Gong, Xianglong Liu |
| 2023 | EMNLP | Outlier Suppression+: Accurate quantization of large language models by equivalent and effective shifting and scaling. | Xiuying Wei, Yunchen Zhang, Yuhang Li, Xiangguo Zhang, Ruihao Gong, Jinyang Guo, Xianglong Liu |
| 2023 | ICCV | Lossy and Lossless (L | Yumeng Shi, Shihao Bai, Xiuying Wei, Ruihao Gong, Jianlei Yang |
| 2023 | ICPP | Exploiting Subgraph Similarities for Efficient Auto-tuning of Tensor Programs. | Mingzhen Li, Hailong Yang, Shanjun Zhang, Fengwei Yu, Ruihao Gong, Yi Liu, Zhongzhi Luan, Depei Qian |
| 2022 | ICLR | QDrop: Randomly Dropping Quantization for Extremely Low-bit Post-Training Quantization. | Xiuying Wei, Ruihao Gong, Yuhang Li, Xianglong Liu, Fengwei Yu |
| 2022 | ICPP | NNLQP: A Multi-Platform Neural Network Latency Query and Prediction System with An Evolving Database. | Liang Liu, Mingzhu Shen, Ruihao Gong, Fengwei Yu, Hailong Yang |
| 2021 | CVPR | Diversifying Sample Generation for Accurate Data-Free Quantization. | Xiangguo Zhang, Haotong Qin, Yifu Ding, Ruihao Gong, Qinghua Yan, Renshuai Tao, Yuhang Li, Fengwei Yu, Xianglong Liu |
| 2021 | ICCV | MixMix: All You Need for Data-Free Compression Are Feature and Data Mixing. | Yuhang Li, Feng Zhu, Ruihao Gong, Mingzhu Shen, Xin Dong, Fengwei Yu, Shaoqing Lu, Shi Gu |
| 2021 | ICCV | Once Quantization-Aware Training: High Performance Extremely Low-bit Architecture Search. | Mingzhu Shen, Feng Liang, Ruihao Gong, Yuhang Li, Chuming Li, Chen Lin, Fengwei Yu, Junjie Yan, Wanli Ouyang |
| 2021 | ICLR | BRECQ: Pushing the Limit of Post-Training Quantization by Block Reconstruction. | Yuhang Li, Ruihao Gong, Xu Tan, Yang Yang, Peng Hu, Qi Zhang, Fengwei Yu, Wei Wang, Shi Gu |
| 2021 | ICML | A Free Lunch From ANN: Towards Efficient, Accurate Spiking Neural Networks Calibration. | Yuhang Li, Shikuang Deng, Xin Dong, Ruihao Gong, Shi Gu |
| 2020 | CVPR | Forward and Backward Information Retention for Accurate Binary Neural Networks. | Haotong Qin, Ruihao Gong, Xianglong Liu, Mingzhu Shen, Ziran Wei, Fengwei Yu, Jingkuan Song |
| 2020 | CVPR | Rotation Consistent Margin Loss for Efficient Low-Bit Face Recognition. | Yudong Wu, Yichao Wu, Ruihao Gong, Yuanhao Lv, Ken Chen, Ding Liang, Xiaolin Hu, Xianglong Liu, Junjie Yan |
| 2020 | CVPR | Towards Unified INT8 Training for Convolutional Neural Network. | Feng Zhu, Ruihao Gong, Fengwei Yu, Xianglong Liu, Yanfei Wang, Zhelong Li, Xiuqi Yang, Junjie Yan |
| 2020 | ICASSP | Balanced Binary Neural Networks with Gated Residual. | Mingzhu Shen, Xianglong Liu, Ruihao Gong, Kai Han |
| 2020 | ICPP | Extremely Low-bit Convolution Optimization for Quantized Neural Network on Modern Computer Architectures. | Qingchang Han, Yongmin Hu, Fengwei Yu, Hailong Yang, Bing Liu, Peng Hu, Ruihao Gong, Yanfei Wang, Rui Wang, Zhongzhi Luan, Depei Qian |
| 2019 | ICCV | Differentiable Soft Quantization: Bridging Full-Precision and Low-Bit Neural Networks. | Ruihao Gong, Xianglong Liu, Shenghu Jiang, Tianxiang Li, Peng Hu, Jiazhen Lin, Fengwei Yu, Junjie Yan |