| 2025 | VEGGIE: Instructional Editing and Reasoning Video Concepts with Grounded Generation. | Shoubin Yu, Difan Liu, Ziqiao Ma, Yicong Hong, Yang Zhou, Hao Tan, Joyce Chai, Mohit Bansal |
| 2025 | ODP-Bench: Benchmarking Out-Of-Distribution Performance Prediction. | Han Yu, Kehan Li, Dongbai Li, Yue He, Xingxuan Zhang, Peng Cui |
| 2025 | Heavy Labels Out! Dataset Distillation with Label Space Lightening. | Ruonan Yu, Songhua Liu, Zigeng Chen, Jingwen Ye, Xinchao Wang |
| 2025 | Multi-View Slot Attention using Paraphrased Texts for Face Anti-Spoofing. | Jeongmin Yu, Susang Kim, Kisu Lee, Taekyoung Kwon, Won-Yong Shin, Ha Young Kim |
| 2025 | BoxDreamer: Dreaming Box Corners for Generalizable Object Pose Estimation. | Yuanhong Yu, Xingyi He, Chen Zhao, Junhao Yu, Jiaqi Yang, Ruizhen Hu, Yujun Shen, Xing Zhu, Xiaowei Zhou, Sida Peng |
| 2025 | TrajectoryCrafter: Redirecting Camera Trajectory for Monocular Videos via Diffusion Models. | Mark Yu, Wenbo Hu, Jinbo Xing, Ying Shan |
| 2025 | Latent Expression Generation for Referring Image Segmentation and Grounding. | Seonghoon Yu, Joonbeom Hong, Joonseok Lee, Jeany Son |
| 2025 | Randomized Autoregressive Visual Generation. | Qihang Yu, Ju He, Xueqing Deng, Xiaohui Shen, Liang-Chieh Chen |
| 2025 | Wasserstein Style Distribution Analysis and Transform for Stylized Image Generation. | Xi Yu, Xiang Gu, Zhihao Shi, Jian Sun |
| 2025 | GaussianReg: Rapid 2D/3D Registration for Emergency Surgery Via Explicit 3D Modeling with Gaussian Primitives. | Weihao Yu, Xiaoqing Guo, Xinyu Liu, Yifan Liu, Hao Zheng, Yawen Huang, Yixuan Yuan |
| 2025 | Anomaly Detection of Integrated Circuits Package Substrates Using the Large Vision Model SAIC: Dataset Construction, Methodology, and Application. | Ruiyun Yu, Bingyang Guo, Haoyuan Li |
| 2025 | Evagaussians: Event Stream Assisted Gaussian Splatting from Blurry Images. | Wangbo Yu, Chaoran Feng, Jianing Li, Jiye Tang, Jiashu Yang, Zhenyu Tang, Meng Cao, Xu Jia, Yuchao Yang, Li Yuan, Yonghong Tian |
| 2025 | Zero-Shot Vision Encoder Grafting via LLM Surrogates. | Kaiyu Yue, Vasu Singla, Menglin Jia, John Kirchenbauer, Rifaa Qadri, Zikui Cai, Abhinav Bhatele, Furong Huang, Tom Goldstein |
| 2025 | DADet: Safeguarding Image Conditional Diffusion Models Against Adversarial and Backdoor Attacks via Diffusion Anomaly Detection. | Hongwei Yu, Xinlong Ding, Jiawei Li, Jinlong Wang, Yudong Zhang, Rongquan Wang, Huimin Ma, Jiansheng Chen |
| 2025 | Learning to Generalize Without Bias for Open-Vocabulary Action Recognition. | Yating Yu, Congqi Cao, Yifan Zhang, Yanning Zhang |
| 2025 | $\mathbf{X}^{\mathbf{2}}$-Gaussian: 4D Radiative Gaussian Splatting for Continuous-Time Tomographic Reconstruction. | Weihao Yu, Yuanhao Cai, Ruyi Zha, Zhiwen Fan, Chenxin Li, Yixuan Yuan |
| 2025 | From Flat to Round: Redefining Brain Decoding with Surface-Based fMRI and Cortex Structure. | Sijin Yu, Zijiao Chen, Wenxuan Wu, Shengxian Chen, Zhongliang Liu, Jingxin Nie, Xiaofen Xing, Xiangmin Xu, Xin Zhang |
| 2025 | Data Bias Mitigation and Evaluation Framework for Diffusion-Based Generative Face Models. | Hao Yu, Margrit Betke, Sarah Adel Bargal |
| 2025 | WalkVLM: Aid Visually Impaired People Walking by Vision Language Model. | Zhiqiang Yuan, Ting Zhang, Yeshuang Zhu, Jiapei Zhang, Ying Deng, Zexi Jia, Peixiang Luo, Xiaoyue Duan, Jie Zhou, Jinchao Zhang |
| 2025 | CAT: A Unified Click-and-Track Framework for Realistic Tracking. | Yongsheng Yuan, Jie Zhao, Dong Wang, Huchuan Lu |
| 2025 | ShortV: Efficient Multimodal Large Language Models by Freezing Visual Tokens in Ineffective Layers. | Qianhao Yuan, Qingyu Zhang, Yanjiang Liu, Jiawei Chen, Yaojie Lu, Hongyu Lin, Jia Zheng, Xianpei Han, Le Sun |
| 2025 | Scaling 3D Compositional Models for Robust Classification and Pose Estimation. | Xiaoding Yuan, Guofeng Zhang, Prakhar Kaushik, Artur Jesslen, Adam Kortylewski, Alan L. Yuille |
| 2025 | Not Only Vision: Evolve Visual Speech Recognition via Peripheral Information. | Zhaoxin Yuan, Shuang Yang, Shiguang Shan, Xilin Chen |
| 2025 | Dlfr-Gen: Diffusion-Based Video Generation With Dynamic Latent Frame Rate. | Zhihang Yuan, Rui Xie, Yuzhang Shang, Hanling Zhang, Siyuan Wang, Shengen Yan, Guohao Dai, Yu Wang |
| 2025 | StyleSRN: Scene Text Image Super-Resolution with Text Style Embedding. | Shengrong Yuan, Runmin Wang, Ke Hao, Xuqi Ma, Changxin Gao, Li Liu, Nong Sang |