| 2025 | A Mixed-Methods Investigation of XR Security Warnings - Lessons Learned. | Junyi Zou, Riccardo Bovo, Ali Hamza, Georgios Loukas |
| 2025 | ELIP: Enhanced Visual-Language Foundation Models for Image Retrieval. | Guanqi Zhan, Yuanpei Liu, Kai Han, Weidi Xie, Andrew Zisserman |
| 2025 | DSI-3D: Differentiable Search Index for Point Clouds Retrieval. | Chahine-Nicolas Zede, Laurent Caraffa, Valrie Gouet-Brunet |
| 2025 | Fusion of Global and Local Features with Multi-Inverted Indices for Image Retrieval. | Li Weng, Xizhe Wang, Qianneng Wang, Bingya Wu |
| 2025 | Mitigating Shortcut Learning in Online Action Detection and Anticipation via Cross-Modal Semantic Alignment. | Sensen Wang, Yuehu Liu, Chi Zhang |
| 2025 | Semi-Supervised Approach to Detect Human Discontent from Real-Life Behaviour Data. | Elena Vildjiounaite, Vesa Kyllnen, Johanna Kallio, Pauli Rsnen |
| 2025 | Dialogue-AV: A Dialogue-Attended Audiovisual Dataset. | Lus Vilaa, Paula Viana, Yi Yu |
| 2025 | U-Cker: Initial Development of an Interactive Video Retrieval System for Novice Users. | Kazuya Ueki, Ryo Muto, Takuya Wada, Ryota Akaba, Genesis Faith Fernandez |
| 2025 | NN Watermarking for Face Segmentation Task. | Carl De Sousa Trias, Mihai Mitrea |
| 2025 | Multi-modal Context Reranking for Lifelog Question Answering. | Quang-Linh Tran, Ly-Duyen Tran, Binh T. Nguyen, Gareth J. F. Jones, Cathal Gurrin |
| 2025 | Lip Reading Across Languages: A Cross-Modal Framework Leveraging Foundation Models. | Ruxandra Tapu, Bogdan Mocanu |
| 2025 | SeqBench: Benchmarking Sequential Narrative Generation in Text-to-Video Models. | Zhengxu Tang, Zizheng Wang, Luning Wang, Zitao Shuai, Chenhao Zhang, Siyu Qian, Yirui Wu, Bohao Wang, Haosong Rao, Zhenyu Yang, Chenwei Wu |
| 2025 | Novice-Friendly Video Retrieval in Mixed Reality with Vitrivr- VR. | Florian Spiess, Heiko Schuldt |
| 2025 | Toward an Energy-Efficient and Explainable Neural Network Architecture for Detection of Breast Cancer in Mammography. | Alireza Siyavashi, Christian Herglotz |
| 2025 | EcoStream: A Resource Utilization and Power Consumption Dataset in Multimedia Streaming for Sustainability Analysis. | Tariq Al Shoura, Reza Razavi, Mohammad Moshirpour |
| 2025 | Rethinking Wine Tasting for Chinese Consumers: A Service Design Approach Enhanced by Multimodal Personalization. | Xinyang Shan, Yuanyuan Xu, Tian Xia, Yin-Shan Lin |
| 2025 | MMMS: Multi-Modal Multi-Surface Interactive Segmentation. | Robin Schn, Julian Lorenz, Katja Ludwig, Daniel Kienle, Rainer Lienhart |
| 2025 | Explanatory Interactive Machine Learning for Bias Mitigation in Visual Gender Classification. | Nathanya Queby Satriani, Djordje Slijepcevic, Markus Schedl, Matthias Zeppelzauer |
| 2025 | VoiceVision: AI-Powered Speaker-Aware Cropping and Content Indexing for Multi-Speaker Videos. | Mehdi Houshmand Sarkhoosh, Cise Midoglu, Saeed Shafiee Sabet, Tomas Kupka, Pl Halvorsen |
| 2025 | Hockey2D: A Keypoint-Based Framework for Ice Hockey Rink Localization and Object Mapping. | Mehdi Houshmand Sarkhoosh, Cise Midoglu, Saeed Shafiee Sabet, Tomas Kupka, Pl Halvorsen |
| 2025 | AgriPotential: A Novel Multi-Spectral and Multi-Temporal Remote Sensing Dataset for Agricultural Potentials. | Mohammad El Sakka, Caroline De Pourtales, Lotfi Chari, Josiane Mothe |
| 2025 | Predicting Moral Values in Lyrics Through Audio. | Charalampos Saitis, Ben Heyderman, Vjosa Preniqi, Kyriaki Kalimeri, Johan Pauwels |
| 2025 | Label-Efficient Skeleton-Based Recognition with Stable Graph Convnets. | Hichem Sahbi |
| 2025 | Towards Graph-Based Federated Learning: ModelNet - A ResNet-based Model Classification Dataset. | Abhisek Ray, Lukas Esterle |
| 2025 | Accelerating Vector Search at Scale: BAM-ANN with Batch-Aware Memory-Disk Hybrid Indexing. | M. M. Mahabubur Rahman, Jelena Tesic |