| 2025 | DAViD: Data-Efficient and Accurate Vision Models from Synthetic Data DAViD also references Michelangelo's David - an iconic symbol of anatomical precision-and the David vs. Goliath story, reflecting our small yet powerful dataset and models. | Fatemeh Saleh, Sadegh Aliakbarian, Charlie Hewitt, Lohit Petikam, Xian Xiao, Antonio Criminisi, Thomas J. Cashman, Tadas Baltrusaitis |
| 2025 | MaskHand: Generative Masked Modeling for Robust Hand Mesh Reconstruction in the Wild. | Muhammad Usama Saleem, Ekkasit Pinyoanuntapong, Mayur Jagdishbhai Patel, Hongfei Xue, Ahmed Helmy, Srijan Das, Pu Wang |
| 2025 | Cabld: Contrast-Agnostic Brain Landmark Detection With Consistency-Based Regularization. | Soorena Salari, Arash Harirpoush, Hassan Rivaz, Yiming Xiao |
| 2025 | Application of Semantic Segmentation on SEM Images of Rubber Composites and Verification of Correlation with Material Properties. | Sho Sakamoto, Wakana Miyoshi, Kentaro Oishi, Ryuta Asami, Akira Kobayashi, Hiroki Iwana, Taichi Tokunaga, Yosuke Motohashi |
| 2025 | Long-Tailed Data Classification by Increasing and Decreasing Neurons During Training. | Taigo Sakai, Kazuhiro Hotta |
| 2025 | CaptionSmiths: Flexibly Controlling Language Pattern in Image Captioning. | Kuniaki Saito, Donghyun Kim, Kwanyong Park, Atsushi Hashimoto, Yoshitaka Ushiku |
| 2025 | Generate, Transduct, Adapt: Iterative Transduction with VLMs. | Oindrila Saha, Logan Lawrence, Grant Van Horn, Subhransu Maji |
| 2025 | PerFairX: Is There a Balance Between Fairness and Personality in Large Language Model Recommendations? | Chandan Kumar Sah |
| 2025 | AIM 2025 Challenge on Screen-Content Video Quality Assessment: Methods and Results. | Nikolay Safonov, Rakhmanov Mikhail, Dmitry Vatolin, Radu Timofte, Chunyu Wu, Kejing Wu, Kishor Kumar Patro, Pankaj Rathour, Sumohana S. Channappayya, Pravin Pardhi, Vipin Milind Kamble, Kishor Bhurchandi, Biao Liu, Jin Hu, Jinyang Xu, Yang Dayu, Chen Yihua |
| 2025 | GFR-CAM: Gram-Schmidt Feature Reduction for Hierarchical Class Activation Maps. | Kaveh Safavigerdini, Bahram Yaghooti, Amir Erfan Zareei Shams Abadi, Kannappan Palaniappan |
| 2025 | Automated Feature Tracking for Real-Time Kinematic Analysis and Shape Estimation of Carbon Nanotube Growth. | Kaveh Safavigerdini, Ramakrishna Surya, Jaired Collins, Prasad Calyam, Filiz Bunyak, Matthew R. Maschmann, Kannappan Palaniappan |
| 2025 | MultiADS: Defect-Aware Supervision for Multi-Type Anomaly Detection and Segmentation in Zero-Shot Learning. | Ylli Sadikaj, Hongkuan Zhou, Lavdim Halilaj, Stefan Schmid, Steffen Staab, Claudia Plant |
| 2025 | From Panels to Prose: Generating Literary Narratives from Comics. | Ragav Sachdeva, Andrew Zisserman |
| 2025 | Seal Your Backdoor with Variational Defense. | Ivan Sabolic, Matej Grcic, Sinisa Segvic |
| 2025 | How Would it Sound? Material-Controlled Multimodal Acoustic Profile Generation for Indoor Scenes. | Mahnoor Fatima Saad, Ziad Al-Halah |
| 2025 | Zero-Shot Multimodal Compound Expression Recognition Approach Using Off-the-Shelf Large Visual-Language Models. | Elena Ryumina, Maxim Markitantov, Alexandr Axyonov, Dmitry Ryumin, Mikhail Dolgushin, Alexey Karpov |
| 2025 | Leveraging Diffusion Models for Stylization Using Multiple Style Images. | Dan Ruta, Abdelaziz Djelouah, Raphael Ortiz, Christopher Schroers |
| 2025 | Proactive HIV Care: AI-Based Comorbidity Prediction from Routine EHR Data. | Solomon Russom, Dimitrios Kollias, Qianni Zhang |
| 2025 | Dopamine-Inspired Neuro-Modulated Radiomic Pipeline for Computed-Tomography-Driven Prediction of Immunotherapy Response in Metastatic Cancer Treatment. | Francesco Rundo, Massimo Orazio Spata, Carmelo Pino, Sebastiano Battiato |
| 2025 | CAD-Recode: Reverse Engineering CAD Code From Point Clouds. | Danila Rukhovich, Elona Dupont, Dimitrios Mallis, Kseniya Cherenkova, Anis Kacem, Djamila Aouada |
| 2025 | Magic Insert: Style-Aware Drag-And-Drop. | Nataniel Ruiz, Yuanzhen Li, Neal Wadhwa, Yael Pritch, Michael Rubinstein, David E. Jacobs, Shlomi Fruchter |
| 2025 | Magnol.AI Copilot: Multimodal LLMs for Natural, Accessible Data Interaction. | Guangchen Ruan, Hui Zhang, Hui Xiao, Jian Yang |
| 2025 | VLRMBench: A Comprehensive and Challenging Benchmark for Vision-Language Reward Models. | Jiacheng Ruan, Wenzhen Yuan, Xiqi Gao, Ye Guo, Daoxin Zhang, Zhe Xu, Yao Hu, Ting Liu, Yuzhuo Fu |
| 2025 | AdvDreamer Unveils: Are Vision-Language Models Truly Ready for Real-World 3D Variations? | Shouwei Ruan, Hanqing Liu, Yao Huang, Xiaoqi Wang, Caixin Kang, Hang Su, Yinpeng Dong, Xingxing Wei |
| 2025 | PRE-Mamba: A 4D State Space Model for Ultra-High-Frequent Event Camera Deraining. | Ciyu Ruan, Ruishan Guo, Zihang Gong, Jingao Xu, Wenhan Yang, Xinlei Chen |