Skip to content

Zhihang Yuan

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

29

Venues

16

Active years

2017–2026

Best venue rank

A*

Where they publish

Papers

29 indexed papers, newest first.

YearVenueTitleAuthors
2026AAAIOTARo: Once Tuning for All Precisions Toward Robust On-Device LLMs.Shaoyuan Chen, Zhixuan Chen, Dawei Yang, Zhihang Yuan, Qiang Wu
2026ACLVocabTailor: Dynamic Vocabulary Selection for Downstream Tasks in Small Language Models.Hanling Zhang, Yayu Zhou, Tongcheng Fang, Zhihang Yuan, Guohao Dai, Wanli Ouyang, Yu Wang
2025ACLGSQ-Tuning: Group-Shared Exponents Integer in Fully Quantized Training for LLMs On-Device Fine-tuning.Sifan Zhou, Shuo Wang, Zhihang Yuan, Mingjia Shi, Yuzhang Shang, Dawei Yang
2025CVPRA Closer Look at Time Steps is Worthy of Triple Speed-Up for Diffusion Model Training.Kai Wang, Mingjia Shi, Yukun Zhou, Zekai Li, Zhihang Yuan, Yuzhang Shang, Xiaojiang Peng, Hanwang Zhang, Yang You
2025CVPRPillarHist: A Quantization-aware Pillar Feature Encoder based on Height-aware Histogram.Sifan Zhou, Zhihang Yuan, Dawei Yang, Xing Hu, Jian Qian, Ziyu Zhao
2025EMNLPSpec-VLA: Speculative Decoding for Vision-Language-Action Models with Relaxed Acceptance.Songsheng Wang, Rucheng Yu, Zhihang Yuan, Chao Yu, Feng Gao, Yu Wang, Derek F. Wong
2025ICCVQuEST: Low-Bit Diffusion Model Quantization via Efficient Selective Finetuning.Haoxuan Wang, Yuzhang Shang, Zhihang Yuan, Junyi Wu, Junchi Yan, Yan Yan
2025ICCVDlfr-Gen: Diffusion-Based Video Generation With Dynamic Latent Frame Rate.Zhihang Yuan, Rui Xie, Yuzhang Shang, Hanling Zhang, Siyuan Wang, Shengen Yan, Guohao Dai, Yu Wang
2025ICCVDiTFastAttnV2: Head-Wise Attention Compression for Multi-Modality Diffusion Transformers.Hanling Zhang, Rundong Su, Zhihang Yuan, Pengtao Chen, Mingzhu Shen, Yibo Fan, Shengen Yan, Guohao Dai, Yu Wang
2025ICCVEA-Vit: Efficient Adaptation for Elastic Vision Transformer.Chen Zhu, Wangbo Zhao, Huiwen Zhang, Yuhao Zhou, Weidong Tang, Shuo Wang, Zhihang Yuan, Yuzhang Shang, Xiaojiang Peng, Kai Wang, Dawei Yang
2025ICLROSTQuant: Refining Large Language Model Quantization with Orthogonal and Scaling Transformations for Better Distribution Fitting.Xing Hu, Yuan Cheng, Dawei Yang, Zhixuan Chen, Zukang Xu, Jiangyong Yu, Chen Xu, Zhihang Yuan, Zhe Jiang, Sifan Zhou
2025ICLRMambaQuant: Quantizing the Mamba Family with Variance Aligned Rotation Methods.Zukang Xu, Yuxuan Yue, Xing Hu, Dawei Yang, Zhihang Yuan, Zixu Jiang, Zhixuan Chen, Jiangyong Yu, Chen Xu, Sifan Zhou
2025ICMLMoEQuant: Enhancing Quantization for Mixture-of-Experts Large Language Models via Expert-Balanced Sampling and Affinity Guidance.Zhixuan Chen, Xing Hu, Dawei Yang, Zukang Xu, Chen Xu, Zhihang Yuan, Sifan Zhou, Jiangyong Yu
2025ICMLMxMoE: Mixed-precision Quantization for MoE with Accuracy and Performance Co-Design.Haojie Duanmu, Xiuhong Li, Zhihang Yuan, Size Zheng, Jiangfei Duan, Xingcheng Zhang, Dahua Lin
2025ICMLRWKVQuant: Quantizing the RWKV Family with Proxy Guided Hybrid of Scalar and Vector Quantization.Chen Xu, Yuxuan Yue, Zukang Xu, Xing Hu, Jiangyong Yu, Zhixuan Chen, Sifan Zhou, Zhihang Yuan, Dawei Yang
2025ICRAMVCTrack: Boosting 3D Point Cloud Tracking via Multimodal-Guided Virtual Cues.Zhaofeng Hu, Sifan Zhou, Zhihang Yuan, Dawei Yang, Shibo Zhao, Ci-Jyun Liang
2025IJCNNBidirectional Multitask Learning for Non-Autoregressive Machine Translation.Songsheng Wang, Shijie Zhang, Zhihang Yuan, Dongkun Wang, Derek F. Wong
2025ISCAAIM: Software and Hardware Co-design for Architecture-level IR-drop Mitigation in High-performance PIM.Yuanpeng Zhang, Xing Hu, Xi Chen, Zhihang Yuan, Cong Li, Jingchen Zhu, Zhao Wang, Chenguang Zhang, Xin Si, Wei Gao, Qiang Wu, Runsheng Wang, Guangyu Sun
2024DATEAlgorithm-Hardware Co-Design for Energy-Efficient A/D Conversion in ReRAM-Based Accelerators.Chenguang Zhang, Zhihang Yuan, Xingchen Li, Guangyu Sun
2024ICLRPB-LLM: Partially Binarized Large Language Models.Zhihang Yuan, Yuzhang Shang, Zhen Dong
2024ICMLLearning High-Frequency Functions Made Easy with Sinusoidal Positional Encoding.Chuanhao Sun, Zhihang Yuan, Kai Xu, Luo Mai, N. Siddharth, Shuo Chen, Mahesh K. Marina
2023CVPRPD-Quant: Post-Training Quantization Based on Prediction Difference Metric.Jiawei Liu, Lin Niu, Zhihang Yuan, Dawei Yang, Xinggang Wang, Wenyu Liu
2023CVPRPost-Training Quantization on Diffusion Models.Yuzhang Shang, Zhihang Yuan, Bin Xie, Bingzhe Wu, Yan Yan
2022DACTailor: removing redundant operations in memristive analog neural network accelerators.Xingchen Li, Zhihang Yuan, Guangyu Sun, Liang Zhao, Zhichao Lu
2022ECCVPTQ4ViT: Post-training Quantization for Vision Transformers with Twin Uniform Quantization.Zhihang Yuan, Chenhao Xue, Yiqi Chen, Qiang Wu, Guangyu Sun
2022HPCAEnabling High-Quality Uncertainty Quantification in a PIM Designed for Bayesian Neural Network.Xingchen Li, Bingzhe Wu, Guangyu Sun, Zhe Zhang, Zhihang Yuan, Runsheng Wang, Ru Huang, Dimin Niu, Hongzhong Zheng, Zhichao Lu, Liang Zhao, Meng-Fan Marvin Chang, Tianchan Guan, Xin Si
2020ECCVS2DNAS: Transforming Static CNN Model for Dynamic Inference via Neural Architecture Search.Zhihang Yuan, Bingzhe Wu, Guangyu Sun, Zheng Liang, Shiwan Zhao, Weichen Bi
2017ASPDACFPGA-based accelerator for long short-term memory recurrent neural networks.Yijin Guan, Zhihang Yuan, Guangyu Sun, Jason Cong
2017ICANNReducing Overfitting in Deep Convolutional Neural Networks Using Redundancy Regularizer.Bingzhe Wu, Zhichao Liu, Zhihang Yuan, Guangyu Sun, Charles Wu