| 2025 | PV-VTT: A Privacy-Centric Dataset for Mission-Specific Anomaly Detection and Natural Language Interpretation. | Ryozo Masukwa, Sanggeon Yun, Yoshiki Yamaguchi, Mohsen Imani |
| 2025 | SimuScope: Realistic Endoscopic Synthetic Dataset Generation Through Surgical Simulation and Diffusion Models. | Sabina Martyniak, Joanna Kaleta, Diego Dall'Alba, Michal Naskret, Szymon Plotka, Przemyslaw Korzeniowski |
| 2025 | DiffuseKronA: A Parameter Efficient Fine-tuning Method for Personalized Diffusion Models. | Shyam Marjit, Harshit Singh, Nityanand Mathur, Sayak Paul, Chia-Mu Yu, Pin-Yu Chen |
| 2025 | A 0-Shot Self-Attention Mechanism for Accelerated Diagonal Attention. | Viti Mario, Nadiya Shvai, Arcadi Llanza, Amir Nakib |
| 2025 | Disentangle Source and Target Knowledge for Continual Test-Time Adaptation. | Tianyi Ma, Maoying Qiao |
| 2025 | An Encoder-Agnostic Weakly Supervised Method For Describing Textures. | Shangbo Mao, Deepu Rajan |
| 2025 | Language-Guided Instance-Aware Domain-Adaptive Panoptic Segmentation. | Elham Amin Mansour, Ozan Unal, Suman Saha, Benjamn Bjar, Luc Van Gool |
| 2025 | Interpreting Face Recognition Templates Using Natural Language Descriptions. | Anastasija Manojlovska, Raghavendra Ramachandra, Georgios Spathoulas, Vitomir Struc, Klemen Grm |
| 2025 | Generation of Complex 3D Human Motion by Temporal and Spatial Composition of Diffusion Models. | Lorenzo Mandelli, Stefano Berretti |
| 2025 | CLASS: Conditional Latent Architecture for Search and Synthesis of Design Layouts. | Dipu Manandhar, Paul Guerrero, Zhaowen Wang, John P. Collomosse |
| 2025 | ReMix: Training Generalized Person Re-Identification on a Mixture of Data. | Timur Z. Mamedov, Anton Konushin, Vadim Konushin |
| 2025 | Decomposed Distribution Matching in Dataset Condensation. | Sahar Rahimi Malakshan, Mohammad Saeed Ebrahimi Saadabadi, Ali Dabouei, Nasser M. Nasrabadi |
| 2025 | Benchmarking VLMs' Reasoning About Persuasive Atypical Images. | Sina Malakouti, Aysan Aghazadeh, Ashmit Khandelwal, Adriana Kovashka |
| 2025 | Guess Future Anomalies from Normalcy: Forecasting Abnormal Behavior in Real-World Videos. | Snehashis Majhi, Mohammed Guermal, Antitza Dantcheva, Quan Kong, Lorenzo Garattoni, Gianpiero Francesca, Franois Brmond |
| 2025 | Ada-VE: Training-Free Consistent Video Editing Using Adaptive Motion Prior. | Tanvir Mahmud, Mustafa Munir, Radu Marculescu, Diana Marculescu |
| 2025 | BroadTrack: Broadcast Camera Tracking for Soccer. | Floriane Magera, Thomas Hoyoux, Olivier Barnich, Marc Van Droogenbroeck |
| 2025 | Towards a Training Free Approach for 3D Scene Editing. | Vivek Madhavaram, Shivangana Rawat, Chaitanya Devaguptapu, Charu Sharma, Manohar Kaul |
| 2025 | GANESH: Generalizable NeRF for Lensless Imaging. | Rakesh Raj Madavan, Akshat Kaimal, Badhrinarayanan K. V, Vinayak Gupta, Rohit Choudhary, Chandrakala Shanmuganathan, Kaushik Mitra |
| 2025 | MIP-GAF: A MLLM-Annotated Benchmark for Most Important Person Localization and Group Context Understanding. | Surbhi Madan, Shreya Ghosh, Lownish Rai Sookha, M. A. Ganaie, Ramanathan Subramanian, Abhinav Dhall, Tom Gedeon |
| 2025 | LQ-Adapter: ViT-Adapter with Learnable Queries for Gallbladder Cancer Detection from Ultrasound Images. | Chetan Madan, Mayuna Gupta, Soumen Basu, Pankaj Gupta, Chetan Arora |
| 2025 | MagicStick: Controllable Video Editing via Control Handle Transformations. | Yue Ma, Xiaodong Cun, Sen Liang, Jinbo Xing, Yingqing He, Chenyang Qi, Siran Chen, Qifeng Chen |
| 2025 | PCAD: A Real-World Dataset for 6D Pose Industrial Anomaly Detection. | Robert F. Maack, Lars Thun, Thomas Liang, Hasan Tercan, Tobias Meisen |
| 2025 | BeautyBank: Encoding Facial Makeup in Latent Space. | Qianwen Lu, Xingchao Yang, Takafumi Taketomi |
| 2025 | Boosting Diffusion Guidance via Learning Degradation-Aware Models for Blind Super Resolution. | Shao-Hao Lu, Ren Wang, Ching-Chun Huang, Wei-Chen Chiu |
| 2025 | From Visual Explanations to Counterfactual Explanations with Latent Diffusion. | Tung Luu, Nam Le, Duc Le, Bac Le |