| 2025 | EventPSR: Surface Normal and Reflectance Estimation from Photometric Stereo Using an Event Camera. | Bohan Yu, Jin Han, Boxin Shi, Imari Sato |
| 2025 | Once-Tuning-Multiple-Variants: Tuning Once and Expanded as Multiple Vision-Language Model Variants. | Chong Yu, Tao Chen, Zhongxue Gan |
| 2025 | SeqAfford: Sequential 3D Affordance Reasoning via Multimodal Large Language Model. | Chunlin Yu, Hanqing Wang, Ye Shi, Haoyang Luo, Sibei Yang, Jingyi Yu, Jingya Wang |
| 2025 | VISTREAM: Improving Computation Efficiency of Visual Streaming Perception via Law-of-Charge-Conservation Inspired Spiking Neural Network. | Kang You, Ziling Wei, Jing Yan, Boning Zhang, Qinghai Guo, Yaoyu Zhang, Zhezhi He |
| 2025 | Teaching Large Language Models to Regress Accurate Image Quality Scores Using Score Distribution. | Zhiyuan You, Xin Cai, Jinjin Gu, Tianfan Xue, Chao Dong |
| 2025 | Layer- and Timestep-Adaptive Differentiable Token Compression Ratios for Efficient Diffusion Transformers. | Haoran You, Connelly Barnes, Yuqian Zhou, Yan Kang, Zhenbang Du, Wei Zhou, Lingzhi Zhang, Yotam Nitzan, Xiaoyang Liu, Zhe Lin, Eli Shechtman, Sohrab Amirghodsi, Yingyan Celine Lin |
| 2025 | Are Images Indistinguishable to Humans Also Indistinguishable to Classifiers? | Zebin You, Xinyu Zhang, Hanzhong Guo, Jingdong Wang, Chongxuan Li |
| 2025 | RENO: Real-Time Neural Compression for 3D LiDAR Point Clouds. | Kang You, Tong Chen, Dandan Ding, M. Salman Asif, Zhan Ma |
| 2025 | Generating 6DoF Object Manipulation Trajectories from Action Description in Egocentric Vision. | Tomoya Yoshida, Shuhei Kurita, Taichi Nishimura, Shinsuke Mori |
| 2025 | Stop Learning it all to Mitigate Visual Hallucination, Focus on the Hallucination Target. | Dokyoon Yoon, Youngsook Song, Woomyoung Park |
| 2025 | Estimating Body and Hand Motion in an Ego-sensed World. | Brent Yi, Vickie Ye, Maya Zheng, Yunqi Li, Lea Mller, Georgios Pavlakos, Yi Ma, Jitendra Malik, Angjoo Kanazawa |
| 2025 | Video-Panda: Parameter-efficient Alignment for Encoder-free Video-Language Models. | Jinhui Yi, Syed Talal Wasim, Yanan Luo, Muzammal Naseer, Juergen Gall |
| 2025 | Towards Precise Scaling Laws for Video Diffusion Transformers. | Yuanyang Yin, Yaqi Zhao, Mingwu Zheng, Ke Lin, Jiarong Ou, Rui Chen, Victor Shea-Jay Huang, Jiahao Wang, Xin Tao, Pengfei Wan, Di Zhang, Baoqun Yin, Wentao Zhang, Kun Gai |
| 2025 | From Slow Bidirectional to Fast Autoregressive Video Diffusion Models. | Tianwei Yin, Qiang Zhang, Richard Zhang, William T. Freeman, Frdo Durand, Eli Shechtman, Xun Huang |
| 2025 | UniGoal: Towards Universal Zero-shot Goal-oriented Navigation. | Hang Yin, Xiuwei Xu, Linqing Zhao, Ziwei Wang, Jie Zhou, Jiwen Lu |
| 2025 | Knowledge-Aligned Counterfactual-Enhancement Diffusion Perception for Unsupervised Cross-Domain Visual Emotion Recognition. | Wen Yin, Yong Wang, Guiduo Duan, Dongyang Zhang, Xin Hu, Yuan-Fang Li, Tao He |
| 2025 | ClearSight: Visual Signal Enhancement for Object Hallucination Mitigation in Multimodal Large Language Models. | Hao Yin, Guangzong Si, Zilei Wang |
| 2025 | Lifting the Veil on Visual Information Flow in MLLMs: Unlocking Pathways to Faster Inference. | Hao Yin, Guangzong Si, Zilei Wang |
| 2025 | ROD-MLLM: Towards More Reliable Object Detection in Multimodal Large Language Models. | Heng Yin, Yuqiang Ren, Ke Yan, Shouhong Ding, Yongtao Hao |
| 2025 | Towards Cost-Effective Learning: A Synergy of Semi-Supervised and Active Learning. | Tianxiang Yin, Ningzhong Liu, Han Sun |
| 2025 | Towards Satellite Image Road Graph Extraction: A Global-Scale Dataset and A Novel Method. | Pan Yin, Kaiyu Li, Xiangyong Cao, Jing Yao, Lei Liu, Xueru Bai, Feng Zhou, Deyu Meng |
| 2025 | 5%>100%: Breaking Performance Shackles of Full Fine-Tuning on Visual Recognition Tasks. | Dongshuo Yin, Leiyi Hu, Bin Li, Youqun Zhang, Xue Yang |
| 2025 | Beyond Background Shift: Rethinking Instance Replay in Continual Semantic Segmentation. | Hongmei Yin, Tingliang Feng, Fan Lyu, Fanhua Shang, Hongying Liu, Wei Feng, Liang Wan |
| 2025 | DFormerv2: Geometry Self-Attention for RGBD Semantic Segmentation. | Bowen Yin, Jiao-Long Cao, Ming-Ming Cheng, Qibin Hou |
| 2025 | DL2G: Degradation-guided Local-to-Global Restoration for Eyeglass Reflection Removal. | Zhilv Yi, Xiao Lu, Hong Ding, Jingbo Hu, Zhi Jiang, Chunxia Xiao |