Zhihang Yuan
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
29
Venues
16
Active years
2017–2026
Best venue rank
A*
Where they publish
Papers
29 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | AAAI | OTARo: Once Tuning for All Precisions Toward Robust On-Device LLMs. | Shaoyuan Chen, Zhixuan Chen, Dawei Yang, Zhihang Yuan, Qiang Wu |
| 2026 | ACL | VocabTailor: Dynamic Vocabulary Selection for Downstream Tasks in Small Language Models. | Hanling Zhang, Yayu Zhou, Tongcheng Fang, Zhihang Yuan, Guohao Dai, Wanli Ouyang, Yu Wang |
| 2025 | ACL | GSQ-Tuning: Group-Shared Exponents Integer in Fully Quantized Training for LLMs On-Device Fine-tuning. | Sifan Zhou, Shuo Wang, Zhihang Yuan, Mingjia Shi, Yuzhang Shang, Dawei Yang |
| 2025 | CVPR | A Closer Look at Time Steps is Worthy of Triple Speed-Up for Diffusion Model Training. | Kai Wang, Mingjia Shi, Yukun Zhou, Zekai Li, Zhihang Yuan, Yuzhang Shang, Xiaojiang Peng, Hanwang Zhang, Yang You |
| 2025 | CVPR | PillarHist: A Quantization-aware Pillar Feature Encoder based on Height-aware Histogram. | Sifan Zhou, Zhihang Yuan, Dawei Yang, Xing Hu, Jian Qian, Ziyu Zhao |
| 2025 | EMNLP | Spec-VLA: Speculative Decoding for Vision-Language-Action Models with Relaxed Acceptance. | Songsheng Wang, Rucheng Yu, Zhihang Yuan, Chao Yu, Feng Gao, Yu Wang, Derek F. Wong |
| 2025 | ICCV | QuEST: Low-Bit Diffusion Model Quantization via Efficient Selective Finetuning. | Haoxuan Wang, Yuzhang Shang, Zhihang Yuan, Junyi Wu, Junchi Yan, Yan Yan |
| 2025 | ICCV | Dlfr-Gen: Diffusion-Based Video Generation With Dynamic Latent Frame Rate. | Zhihang Yuan, Rui Xie, Yuzhang Shang, Hanling Zhang, Siyuan Wang, Shengen Yan, Guohao Dai, Yu Wang |
| 2025 | ICCV | DiTFastAttnV2: Head-Wise Attention Compression for Multi-Modality Diffusion Transformers. | Hanling Zhang, Rundong Su, Zhihang Yuan, Pengtao Chen, Mingzhu Shen, Yibo Fan, Shengen Yan, Guohao Dai, Yu Wang |
| 2025 | ICCV | EA-Vit: Efficient Adaptation for Elastic Vision Transformer. | Chen Zhu, Wangbo Zhao, Huiwen Zhang, Yuhao Zhou, Weidong Tang, Shuo Wang, Zhihang Yuan, Yuzhang Shang, Xiaojiang Peng, Kai Wang, Dawei Yang |
| 2025 | ICLR | OSTQuant: Refining Large Language Model Quantization with Orthogonal and Scaling Transformations for Better Distribution Fitting. | Xing Hu, Yuan Cheng, Dawei Yang, Zhixuan Chen, Zukang Xu, Jiangyong Yu, Chen Xu, Zhihang Yuan, Zhe Jiang, Sifan Zhou |
| 2025 | ICLR | MambaQuant: Quantizing the Mamba Family with Variance Aligned Rotation Methods. | Zukang Xu, Yuxuan Yue, Xing Hu, Dawei Yang, Zhihang Yuan, Zixu Jiang, Zhixuan Chen, Jiangyong Yu, Chen Xu, Sifan Zhou |
| 2025 | ICML | MoEQuant: Enhancing Quantization for Mixture-of-Experts Large Language Models via Expert-Balanced Sampling and Affinity Guidance. | Zhixuan Chen, Xing Hu, Dawei Yang, Zukang Xu, Chen Xu, Zhihang Yuan, Sifan Zhou, Jiangyong Yu |
| 2025 | ICML | MxMoE: Mixed-precision Quantization for MoE with Accuracy and Performance Co-Design. | Haojie Duanmu, Xiuhong Li, Zhihang Yuan, Size Zheng, Jiangfei Duan, Xingcheng Zhang, Dahua Lin |
| 2025 | ICML | RWKVQuant: Quantizing the RWKV Family with Proxy Guided Hybrid of Scalar and Vector Quantization. | Chen Xu, Yuxuan Yue, Zukang Xu, Xing Hu, Jiangyong Yu, Zhixuan Chen, Sifan Zhou, Zhihang Yuan, Dawei Yang |
| 2025 | ICRA | MVCTrack: Boosting 3D Point Cloud Tracking via Multimodal-Guided Virtual Cues. | Zhaofeng Hu, Sifan Zhou, Zhihang Yuan, Dawei Yang, Shibo Zhao, Ci-Jyun Liang |
| 2025 | IJCNN | Bidirectional Multitask Learning for Non-Autoregressive Machine Translation. | Songsheng Wang, Shijie Zhang, Zhihang Yuan, Dongkun Wang, Derek F. Wong |
| 2025 | ISCA | AIM: Software and Hardware Co-design for Architecture-level IR-drop Mitigation in High-performance PIM. | Yuanpeng Zhang, Xing Hu, Xi Chen, Zhihang Yuan, Cong Li, Jingchen Zhu, Zhao Wang, Chenguang Zhang, Xin Si, Wei Gao, Qiang Wu, Runsheng Wang, Guangyu Sun |
| 2024 | DATE | Algorithm-Hardware Co-Design for Energy-Efficient A/D Conversion in ReRAM-Based Accelerators. | Chenguang Zhang, Zhihang Yuan, Xingchen Li, Guangyu Sun |
| 2024 | ICLR | PB-LLM: Partially Binarized Large Language Models. | Zhihang Yuan, Yuzhang Shang, Zhen Dong |
| 2024 | ICML | Learning High-Frequency Functions Made Easy with Sinusoidal Positional Encoding. | Chuanhao Sun, Zhihang Yuan, Kai Xu, Luo Mai, N. Siddharth, Shuo Chen, Mahesh K. Marina |
| 2023 | CVPR | PD-Quant: Post-Training Quantization Based on Prediction Difference Metric. | Jiawei Liu, Lin Niu, Zhihang Yuan, Dawei Yang, Xinggang Wang, Wenyu Liu |
| 2023 | CVPR | Post-Training Quantization on Diffusion Models. | Yuzhang Shang, Zhihang Yuan, Bin Xie, Bingzhe Wu, Yan Yan |
| 2022 | DAC | Tailor: removing redundant operations in memristive analog neural network accelerators. | Xingchen Li, Zhihang Yuan, Guangyu Sun, Liang Zhao, Zhichao Lu |
| 2022 | ECCV | PTQ4ViT: Post-training Quantization for Vision Transformers with Twin Uniform Quantization. | Zhihang Yuan, Chenhao Xue, Yiqi Chen, Qiang Wu, Guangyu Sun |
| 2022 | HPCA | Enabling High-Quality Uncertainty Quantification in a PIM Designed for Bayesian Neural Network. | Xingchen Li, Bingzhe Wu, Guangyu Sun, Zhe Zhang, Zhihang Yuan, Runsheng Wang, Ru Huang, Dimin Niu, Hongzhong Zheng, Zhichao Lu, Liang Zhao, Meng-Fan Marvin Chang, Tianchan Guan, Xin Si |
| 2020 | ECCV | S2DNAS: Transforming Static CNN Model for Dynamic Inference via Neural Architecture Search. | Zhihang Yuan, Bingzhe Wu, Guangyu Sun, Zheng Liang, Shiwan Zhao, Weichen Bi |
| 2017 | ASPDAC | FPGA-based accelerator for long short-term memory recurrent neural networks. | Yijin Guan, Zhihang Yuan, Guangyu Sun, Jason Cong |
| 2017 | ICANN | Reducing Overfitting in Deep Convolutional Neural Networks Using Redundancy Regularizer. | Bingzhe Wu, Zhichao Liu, Zhihang Yuan, Guangyu Sun, Charles Wu |