| 2025 | DASC-SPT: Towards Self-Supervised Panoramic Semantic Segmentation. | Tianlong Tan, Bin Chen, Hongliang Cao, Chenggang Yan, Yike Ma, Feng Dai |
| 2025 | Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models. | Niloufar Alipour Talemi, Hossein Kashiani, Fatemeh Afghah |
| 2025 | Self-Relaxed Joint Training: Sample Selection for Severity Estimation with Ordinal Noisy Labels. | Shumpei Takezaki, Kiyohito Tanaka, Seiichi Uchida |
| 2025 | MD-Glow: Multi-task Despeckling Glow for SAR Image Enhancement. | Shunsuke Takao |
| 2025 | AMP-ViT: Optimizing Vision Transformer Efficiency with Adaptive Mixed-Precision Post-Training Quantization. | Yu-Shan Tai, An-Yeu Andy Wu |
| 2025 | Videogamebunny: Towards Vision Assistants for Video Games. | Mohammad Reza Taesiri, Cor-Paul Bezemer |
| 2025 | Mind the Map! Accounting for Existing Maps When Estimating Online HDMaps from Sensors. | Rmy Sun, Li Yang, Diane Lingrand, Frdric Precioso |
| 2025 | GET-UP: GEomeTric-aware Depth Estimation with Radar Points UPsampling. | Huawei Sun, Zixu Wang, Hao Feng, Julius Ott, Lorenzo Servadei, Robert Wille |
| 2025 | Advancing Weight and Channel Sparsification with Enhanced Saliency. | Xinglong Sun, Maying Shen, Hongxu Yin, Lei Mao, Pavlo Molchanov, Jos M. lvarez |
| 2025 | Cross-Modal Feature Alignment and MMD Improve Robustness of Prompt Tuning. | Jingchen Sun, Rohan Sharma, Vishnu Suresh Lokhande, Changyou Chen |
| 2025 | Multi-Modal Large Language Models are Effective Vision Learners. | Li Sun, Chaitanya Ahuja, Peng Chen, Matt D'Zmura, Kayhan Batmanghelich, Philip Bontrager |
| 2025 | MOOSS: Mask-Enhanced Temporal Contrastive Learning for Smooth State Evolution in Visual Reinforcement Learning. | Jiarui Sun, M. Ugur Akcal, Girish Chowdhary, Wei Zhang |
| 2025 | Just Shift It: Test-Time Prototype Shifting for Zero-Shot Generalization with Vision-Language Models. | Elaine Sui, Xiaohan Wang, Serena Yeung-Levy |
| 2025 | Situational Scene Graph for Structured Human-Centric Situation Understanding. | Chinthani Sugandhika, Chen Li, Deepu Rajan, Basura Fernando |
| 2025 | DiffuCE: Expert-Level CBCT Image Enhancement Using a Novel Conditional Denoising Diffusion Model with Latent Alignment. | Fang-Yi Su, Tzu-Hung Chang, Jung-Hsien Chiang |
| 2025 | Meta-Learning for Color-to-Infrared Cross-Modal Style Transfer. | Evelyn A. Stump, Francesco Luzi, Leslie M. Collins, Jordan M. Malof |
| 2025 | Balancing Shared and Task-Specific Representations: A Hybrid Approach to Depth-Aware Video Panoptic Segmentation. | Kurt H. W. Stolle |
| 2025 | TimberVision: A Multi-Task Dataset and Framework for Log-Component Segmentation and Tracking in Autonomous Forestry Operations. | Daniel Steininger, Julia Simon, Andreas Trondl, Markus Murschitz |
| 2025 | DiffFake: Exposing Deepfakes Using Differential Anomaly Detection. | Sotirios Stamnas, Victor Sanchez |
| 2025 | XPose: Towards Extreme Low Light Hand Pose Estimation. | Green Rosh K. S, Meghana Shankar, Prateek Kukreja, Anmol Namdev, B. H. Pawan Prasad |
| 2025 | REEDIT: Multimodal Exemplar-Based Image Editing. | Ashutosh Srivastava, Tarun Ram Menta, Abhinav Java, Avadhoot Jadhav, Silky Singh, Surgan Jandial, Balaji Krishnamurthy |
| 2025 | SAND: Enhancing Open-Set Neuron Descriptions through Spatial Awareness. | Anvita A. Srinivas, Tuomas P. Oikarinen, Divyansh Srivastava, Wei-Hung Weng, Tsui-Wei Weng |
| 2025 | UnDIVE: Generalized Underwater Video Enhancement Using Generative Priors. | Suhas Srinath, Aditya Chandrasekar, Hemang Jamadagni, Rajiv Soundararajan, Prathosh AP |
| 2025 | Delta-NAS: Difference of Architecture Encoding for Predictor-Based Evolutionary Neural Architecture Search. | Arjun Sridhar, Yiran Chen |
| 2025 | WiGNet: Windowed Vision Graph Neural Network. | Gabriele Spadaro, Marco Grangetto, Attilio Fiandrotti, Enzo Tartaglione, Jhony H. Giraldo |