| 2025 | Dual-Objective Adversarial Disentanglement for Protecting Speech Data used for Diagnosing Parkinson's Disease. | Mehtab Ur Rahman, Martha A. Larson, Louis ten Bosch, Cristian Tejedor Garca |
| 2025 | Text-Oriented Image Query Representation for Zero-Shot Composed Image Retrieval. | Pavan K. Rachabathuni, Andrea Ciamarra, Roberto Caldelli, Marco Bertini |
| 2025 | A Comparative Study of Conversational and Conventional Search Methods for Image Retrieval. | Anastasiia Potiagalova, Joemon J. Jose, Benjamin R. Cowan, Gareth J. F. Jones |
| 2025 | Historical Postcard Stamp Content Understanding. | Matthieu Pelingre, Salvatore Tabbone |
| 2025 | Evaluating the Recognisability of AI-Generated Familiar Images in a Closed Environment with a Gamified Approach. | Marc Gallofr Ocaa, Balzs Mosolyg, Bahareh Fatemi |
| 2025 | Media Search: A Multi-Stage Image Retrieval Framework with Enriched Image Captioning. | Ayse Vildan Nurdag, Mete Mert Birdal, Yusuf Yazici, Baris zcan, Erkut Arican |
| 2025 | Robust Multimedia Verification of Cheapfakes and Deepfakes via External Context Leveraging. | Minh-Nhat Nguyen, Trong-Nghia Tran, Minh-Triet Tran, Duc-Tien Dang-Nguyen, Trong-Le Do |
| 2025 | GenFlow: Interactive Modular System for Image Generation. | Duc-Hung Nguyen, Huu-Phuc Huynh, Minh-Triet Tran, Trung-Nghia Le |
| 2025 | FPN-Based Multi-Scale Feature Fusion for Robust 3D Pedestrian Detection in Crowded Scenes. | Kiyotaka Matsue, Kenta Umene, Nghia Dao, Hieu Nguyen, Manh Phan |
| 2025 | Melanoma Segmentation with SAM-Like Models: Assessing the Influence and Limits of Bounding Box Input. | Nicolas Martin, Philippe Mulhem, Jean-Pierre Chevallet |
| 2025 | Masked Spikformer: Gaussian based and Random Spike Masking for Energy-Efficient Spiking Transformers. | Oumaima Marsi, Sebastien Ambellouis, Jos Mennesson, Cyril Meurie, Anthony Fleury, Charles Tatkeu |
| 2025 | Exploring the Effect of Size, Architecture and Fine-Tuning Hyperparameters on Large Visual-Language Model Adaptation for Video Memorability Prediction. | David Luna-Garca, Ivn Martn-Fernndez, Sergio Esteban Romero, Manuel Gil-Martn, Fernando Fernndez Martnez |
| 2025 | Enhancing Vision-Language Model Pre-Training with Image-Text Pair Pruning Based on Word Frequency. | Mingliang Liang, Martha A. Larson |
| 2025 | A Survey of Information Disorder on Video-Sharing Platforms. | Meiyu Li, Wei Ai, Naeemul Hassan |
| 2025 | Vision Projector: Improving Zero-Shot Composed Image Retrieval at Inference. | Hoang-Bao Le, Allie Tran, Binh T. Nguyen, Liting Zhou, Cathal Gurrin |
| 2025 | Anonymisation of Visual Lifelogs using Diffusion Models and Large Language Models. | Minh-Quang Le, Graham Healy, Liting Zhou, Cathal Gurrin |
| 2025 | Personalizing Retrieval Using Joint Embeddings; or "the Return of Fluffy". | Bruno Korbar, Andrew Zisserman |
| 2025 | TSalV360: A Method and Dataset for Text-driven Saliency Detection in 360-Degrees Videos. | Ioannis Kontostathis, Evlampios Apostolidis, Vasileios Mezaris |
| 2025 | Examining Performance Disparities Between Expert and Novice Users in Interactive Video Retrieval. | Omar Shahbaz Khan, Ujjwal Sharma, Stevan Rudinac, Bjrn r Jnsson |
| 2025 | MultiHuSE: A Multimodal Dataset for Humour Styles and Emotions. | Mary Ogbuka Kenneth, Foaad Khosmood, Abbas Edalat |
| 2025 | Zero-Shot Vision-Language Model for Event Detection in Smart Surveillance. | Younes Kebour, Smal Niar, Nacim Ihaddadene, Abdelghani Bekrar, Hammouda Elbez |
| 2025 | Understanding Indoor Context in an Office Environment: An Empirical Study on Air Stuffiness Perception. | Johanna Kallio, Jussi Liikka, Satu-Marja Mkel, Atte Kinnula, Elena Vildjiounaite |
| 2025 | ReViewQwen: An Explainable Vision-Language Model for Discrepancy Detection in Multimodal E-Commerce Reviews. | Sandeep Kalari, Mohan Sunkara, Dominik Sos, Vikas Ashok, Ravi Mukkamala |
| 2025 | GTR: General Handwritten Lines Text Recognition Dataset. | Xu Ji, Haizhao Sun, Yu Ning, Ming Wu, Chuang Zhang |
| 2025 | TREB: Temporal Refinement of Egocentric Body Pose. | Bruno Henriques, Benjamin Allaert, Nicolas Sutton-Charani, Pierre R. L. Slangen, Jean-Philippe Vandeborre |