| 2025 | Instructseg: Unifying Instructed Visual Segmentation with Multi-Modal Large Language Models. | Cong Wei, Yujie Zhong, Haoxian Tan, Yingsen Zeng, Yong Liu, Hongfa Wang, Yujiu Yang |
| 2025 | Disrupting Model Merging: A Parameter-Level Defense without Sacrificing Accuracy. | Junhao Wei, Yu Zhe, Jun Sakuma |
| 2025 | Hierarchical Multi-Modal Fusion for Roadside VRU Detection: Method Complementarity Under Sparse Label Constraints. | Chuheng Wei, Ziyan Zhang, Haishan Liu, Guoyuan Wu, Matthew J. Barth |
| 2025 | FreeFlux: Understanding and Exploiting Layer-Specific Roles in RoPE-Based MMDiT for Versatile Image Editing. | Tianyi Wei, Yifan Zhou, Dongdong Chen, Xingang Pan |
| 2025 | GTR: Guided Thought Reinforcement Prevents Thought Collapse in RL-Based VLM Agent Training. | Tong Wei, Yijun Yang, Junliang Xing, Yuanchun Shi, Zongqing Lu, Deheng Ye |
| 2025 | 3D Test-Time Adaptation via Graph Spectral Driven Point Shift. | Xin Wei, Qin Yang, Yijie Fang, Mingrui Zhu, Nannan Wang |
| 2025 | EMD: Explicit Motion Modeling for High-Quality Street Gaussian Splatting. | Xiaobao Wei, Qingpo Wuwu, Zhongyu Zhao, Zhuangzhe Wu, Nan Huang, Ming Lu, Ningning Ma, Shanghang Zhang |
| 2025 | Noise2Score3D: Tweedie's Approach for Unsupervised Point Cloud Denoising. | Xiangbin Wei, Yuanfeng Wang, Ao Xu, Lingyu Zhu, Dongyong Sun, Keren Li, Yang Li, Qi Qin |
| 2025 | HQ-CLIP: Leveraging Large Vision-Language Models to Create High-Quality Image-Text Datasets and CLIP Models. | Zhixiang Wei, Guangting Wang, Xiaoxiao Ma, Ke Mei, Huaian Chen, Yi Jin, Fengyun Rao |
| 2025 | EKI-GAN: Context-Aware Vehicle Trajectory Forecasting with Vehicle Factors and Environmental Information at Signalized Intersections. | Chuheng Wei, Guoyuan Wu, Matthew J. Barth |
| 2025 | Augmenting Moment Retrieval: Zero-Dependency Two-Stage Learning. | Zhengxuan Wei, Jiajin Tang, Sibei Yang |
| 2025 | Two-stage Text-Guided Diffusion Models for Disentangled Industrial Defect Generation. | Jing Wei, Qingfeng Shi, Fei Shen, Zhengtao Zhang |
| 2025 | Backdoor Mitigation by Distance-Driven Detoxification. | Shaokui Wei, Jiayin Liu, Hongyuan Zha |
| 2025 | RayletDF: Raylet Distance Fields for Generalizable 3D Surface Reconstruction from Point Clouds or Gaussians. | Shenxing Wei, Jinxi Li, Yafei Yang, Siyuan Zhou, Bo Yang |
| 2025 | Perceive, Understand and Restore: Real-World Image Super-Resolution with Autoregressive Multimodal Generative Models. | Hongyang Wei, Shuaizheng Liu, Chun Yuan, Lei Zhang |
| 2025 | Passing the Driving Knowledge Test. | Maolin Wei, Wanzhou Liu, Eshed Ohn-Bar |
| 2025 | AffordDexGrasp: Open-Set Language-Guided Dexterous Grasp With Generalizable-Instructive Affordance. | Yi-Lin Wei, Mu Lin, Yuhao Lin, Jian-Jian Jiang, Xiao-Ming Wu, Ling-An Zeng, Wei-Shi Zheng |
| 2025 | Boosting Multimodal Learning via Disentangled Gradient Learning. | Shicai Wei, Chunbo Luo, Yang Luo |
| 2025 | Improving Multimodal Learning via Imbalanced Learning. | Shicai Wei, Chunbo Luo, Yang Luo |
| 2025 | Uncovering Anomalous Events for Marine Environmental Monitoring via Visual Anomaly Detection. | Laura Weihl, Nejc Novak, Stefan Hein Bengtson, Malte Pedersen |
| 2025 | Trackverse: a Large-Scale Object-Centric Video Dataset for Image-Level Representation Learning. | Yibing Wei, Samuel Church, Victor Suciu, Jinhong Lin, Cheng-En Wu |
| 2025 | GazeGaussian: High-Fidelity Gaze Redirection with 3D Gaussian Splatting. | Xiaobao Wei, Peng Chen, Guangyu Li, Ming Lu, Hui Chen, Feng Tian |
| 2025 | ViT-Linearizer: Distilling Quadratic Knowledge into Linear-Time Vision Models. | Guoyizhe Wei, Rama Chellappa |
| 2025 | Multi-modal Identity Extraction. | Ryan Webster, Teddy Furon |
| 2025 | MixANT: Observation-Dependent Memory Propagation for Stochastic Dense Action Anticipation. | Syed Talal Wasim, Hamid Suleman, Olga Zatsarynna, Muzammal Naseer, Juergen Gall |