| 2025 | Grouped Speculative Decoding for Autoregressive Image Generation. | Junhyuk So, Juncheol Shin, Hyunho Kook, Eunhyeok Park |
| 2025 | Weakly Supervised MaxN Estimation in Baited Remote Underwater Videos. | Amelia Sorrenti, Leonardo G. Russo, Sarinda Samarasinghe, Simone Palazzo, Concetto Spampinato |
| 2025 | B-Cos Networks as an Architectural Inductive Bias for Mitigating Catastrophic Forgetting. | Amelia Sorrenti, Giovanni Bellitto, Salvatore Calcagno, Rutger Hendrix, Concetto Spampinato, Simone Palazzo |
| 2025 | Efficient Self-Supervised Adaptation for Medical Image Analysis. | Moein Sorkhei, Emir Konuk, Jingyu Guo, Chanjuan Meng, Christos Matsoukas, Kevin Smith |
| 2025 | Foundation Versus Domain-Specific Models: Performance Comparison, Fusion, and Explainability in Face Recognition. | Redwan Sony, Parisa Farmanifard, Arun Ross, Anil K. Jain |
| 2025 | LoRAverse: A Submodular Framework to Retrieve Diverse Adapters for Diffusion Models. | Mert Sonmezer, Matthew Zheng, Pinar Yanardag |
| 2025 | MDP-Omni: Parameter-Free Multimodal Depth Prior-Based Sampling for Omnidirectional Stereo Matching. | Eunjin Son, HyungGi Jo, Wookyong Kwon, Sang Jun Lee |
| 2025 | LOCATEdit: Graph Laplacian Optimized Cross Attention for Localized Text-Guided Image Editing. | Achint Soni, Meet Soni, Sirisha Rambhatla |
| 2025 | DMesh++: An Efficient Differentiable Mesh for Complex Shapes. | Sanghyun Son, Matheus Gadelha, Yang Zhou, Matthew Fisher, Zexiang Xu, Yi-Ling Qiao, Ming C. Lin, Yi Zhou |
| 2025 | EYE | Yingde Song, Zongyuan Yang, Baolin Liu, Yongping Xiong, Sai Chen, Lan Yi, Zhaohe Zhang, Xunbo Yu |
| 2025 | Progressive Artwork Outpainting Via Latent Diffusion Models. | Dae-Young Song, Jung-Jae Yu, Donghyeon Cho |
| 2025 | Normal and Abnormal Pathology Knowledge-Augmented Vision-Language Model for Anomaly Detection in Pathology Images. | Jinsol Song, Jiamu Wang, Anh Tien Nguyen, Keunho Byeon, Sangjeong Ahn, Sung Hak Lee, Jin Tae Kwak |
| 2025 | CoDa-4DGS: Dynamic Gaussian Splatting with Context and Deformation Awareness for Autonomous Driving. | Rui Song, Chenwei Liang, Yan Xia, Walter Zimmer, Hu Cao, Holger Caesar, Andreas Festag, Alois Knoll |
| 2025 | DiffSim: Taming Diffusion Models for Evaluating Visual Similarity. | Yiren Song, Xiaokang Liu, Mike Zheng Shou |
| 2025 | Ock: Unsupervised Dynamic Video Prediction With Object-Centric Kinematics. | Yeon-Ji Song, Jaein Kim, Suhyung Choi, Jin-Hwa Kim, Byoung-Tak Zhang |
| 2025 | Riemannian-Geometric Fingerprints of Generative Models. | Hae Jin Song, Laurent Itti |
| 2025 | Video-MMLU: A Massive Multi-Discipline Lecture Understanding Benchmark. | Enxin Song, Wenhao Chai, Weili Xu, Jianwen Xie, Yuxuan Liu, Gaoang Wang |
| 2025 | LayerTracer: Cognitive-Aligned Layered SVG Synthesis via Diffusion Transformer. | Yiren Song, Danze Chen, Mike Zheng Shou |
| 2025 | Towards Robustness of Person Search Against Corruptions. | Woojung Son, Yoonki Cho, Guoyuan An, Chanmi Lee, Sung-Eui Yoon |
| 2025 | Explain with Confidence: Fusing Saliency Maps for Faithful and Interpretable Weakly-Supervised Model. | Ayush Somani, Arif Ahmed Sekh, Dilip K. Prasad |
| 2025 | Rethinking Explainer Trust: A Position on the Inconsistencies of Visual Explanations in Weakly Supervised Segmentation. | Ayush Somani, Dilip K. Prasad |
| 2025 | ResidualViT for Efficient Temporally Dense Video Encoding. | Mattia Soldan, Fabian Caba Heilbron, Bernard Ghanem, Josef Sivic, Bryan C. Russell |
| 2025 | Calibrating MLLM-as-a-judge via Multimodal Bayesian Prompt Ensembles. | Eric Slyman, Md. Mehrab Tanjim, Kushal Kafle, Stefan Lee |
| 2025 | MonoSOWA: Scalable Monocular 3D Object Detector Without Human Annotations. | Jan Skvrna, Luks Neumann |
| 2025 | Im2Haircut: Single-View Strand-Based Hair Reconstruction for Human Avatars. | Vanessa Sklyarova, Egor Zakharov, Malte Prinzler, Giorgio Becherini, Michael J. Black, Justus Thies |