Skip to content

Haocheng Xi

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

7

Venues

3

Active years

2024–2025

Best venue rank

A*

Where they publish

Papers

7 indexed papers, newest first.

YearVenueTitleAuthors
2025CVPRNVILA: Efficient Frontier Visual Language Models.Zhijian Liu, Ligeng Zhu, Baifeng Shi, Zhuoyang Zhang, Yuming Lou, Shang Yang, Haocheng Xi, Shiyi Cao, Yuxian Gu, Dacheng Li, Xiuyu Li, Haotian Tang, Yunhao Fang, Yukang Chen, Cheng-Yu Hsieh, De-An Huang, An-Chieh Cheng, Jinyi Hu, Sifei Liu, Ranjay Krishna, Pavlo Molchanov, Jan Kautz, Hongxu Yin, Song Han, Yao Lu
2025ICLRCOAT: Compressing Optimizer states and Activations for Memory-Efficient FP8 Training.Haocheng Xi, Han Cai, Ligeng Zhu, Yao Lu, Kurt Keutzer, Jianfei Chen, Song Han
2025ICMLOscillation-Reduced MXFP4 Training for Vision Transformers.Yuxiang Chen, Haocheng Xi, Jun Zhu, Jianfei Chen
2025ICMLQuantSpec: Self-Speculative Decoding with Hierarchical Quantized KV Cache.Rishabh Tiwari, Haocheng Xi, Aditya Tomar, Coleman Richard Charles Hooper, Sehoon Kim, Maxwell Horton, Mahyar Najibi, Michael W. Mahoney, Kurt Keutzer, Amir Gholami
2025ICMLSparse Video-Gen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity.Haocheng Xi, Shuo Yang, Yilong Zhao, Chenfeng Xu, Muyang Li, Xiuyu Li, Yujun Lin, Han Cai, Jintao Zhang, Dacheng Li, Jianfei Chen, Ion Stoica, Kurt Keutzer, Song Han
2025ICMLSpargeAttention: Accurate and Training-free Sparse Attention Accelerating Any Model Inference.Jintao Zhang, Chendong Xiang, Haofeng Huang, Jia Wei, Haocheng Xi, Jun Zhu, Jianfei Chen
2024ICMLJetfire: Efficient and Accurate Transformer Pretraining with INT8 Data Flow and Per-Block Quantization.Haocheng Xi, Yuxiang Chen, Kang Zhao, Kai Jun Teh, Jianfei Chen, Jun Zhu