| 2026 | CEMG: Collaborative-Enhanced Multimodal Generative Recommendation. | Yuzhen Lin, Hongyi Chen, Xuanjing Chen, Shaowen Wang, Ivonne Xu, Dongming Jiang |
| 2026 | CSQDA: A Parameter-Efficient and Memory-Efficient Tuning Method for Medical Image Classification. | Yiqian Li, Andy J. Ma |
| 2026 | DAHM: A Dual-Stream Attention Fusion Model for Hate Content Detection. | Qingguan Li, Jiawei Cong, Kai Zhao |
| 2026 | Dual-Stream Attention Across Time-Frequency for Sound Event Detection. | Jiafeng Li, Xichang Cai, Menglong Wu |
| 2026 | Auditing M-LLMs for Privacy Risks: A Synthetic Benchmark and Evaluation Framework. | Junhao Li, Jiahao Chen, Zhou Feng, Chunyi Zhou |
| 2026 | MS-MRFNet: A Multi-scale and Multi-receptive Field Network for UAV Aerial Object Detection. | Hao Li, Zhenchao Cui |
| 2026 | FFMatch: A FilterFormer-Based Network for Accurate Multimodal Image Matching. | Yun Liao, Jiayi Lyu, Junhui Liu, Nan Chen, Zongxiao Hu, Qing Duan |
| 2026 | SeViMatch: A Detector-Based Image Matching Framework with Semantic-Visual Fusion. | Yun Liao, Nan Chen, Junhui Liu, Jiayi Lyu, Zongxiao Hu, Qing Duan |
| 2026 | DiSCo: Disrupting Semantic Consistency for Transferable Cross-Modal Adversarial Attacks. | Peirou Liang, Meng Yang, Zhiqian Wu, Peng Yuan Zhou, Yong Liao |
| 2026 | FIGROTD: A Friendly-to-Handle Dataset for Image Guided Retrieval with Optional Text. | Hoang-Bao Le, Allie Tran, Binh T. Nguyen, Liting Zhou, Cathal Gurrin |
| 2026 | Fusionista2.0: Efficiency Retrieval System for Large-Scale Datasets. | Huy M. Le, Dat Tien Nguyen, Phuc Binh Nguyen, Gia-Bao Le-Tran, Phu Truong Thien, Cuong Dinh, Minh Nguyen, Nga Nguyen, Thuy T. N. Nguyen, Huy Gia Ngo, Tan Nhat Nguyen, Binh T. Nguyen |
| 2026 | Exquisitor at the Video Browser Showdown 2026: Temporal Queries Revisited. | Omar Shahbaz Khan, Ujjwal Sharma, Gonalo Marcelino, Stevan Rudinac, Bjrn r Jnsson |
| 2026 | GAS: Geometry-Appearance Synergy for Consistent Video Customization. | Heng Jia, Na Zhao, Yunqiu Xu, Linchao Zhu, Yi Yang |
| 2026 | PraK V4 at the Video Browser Showdown 2026. | Bastian Jckl, Benjamin Verner, Michael Stroh, Vojtech Kloda, Ladislav Nagy, Oliver Deussen, Daniel A. Keim, Jakub Lokoc |
| 2026 | TapesVRy: Immersive Panoramic Exploration in Large-Scale Video Retrieval. | Viet-Tham Huynh, Nhut-Thanh Le-Hinh, Thang-Long Nguyen-Ho, Trong-Thuan Nguyen, Cathal Gurrin, Tam V. Nguyen, Minh-Triet Tran |
| 2026 | HFS: Hierarchical Fine-Tuning for Span Detection and Aspect-Based Sentiment Analysis in the Vietnamese Language. | Son T. Huynh, Tran Minh Huan, Tran Nguyen Minh Quang, Pham Phi Nhung, Binh T. Nguyen |
| 2026 | DPC-FCNet: A Dual-Channel Cross-Modality Person re-Identification Network with Enhanced Multi-Level Feature Correlation. | Guang Huo, Yue Wang |
| 2026 | From Expert Practices to Intelligent Agents: Autonomy in Interactive Video Retrieval. | Minh-Quan Ho-Le, Duy-Khang Ho, Van-Tu Ninh, Cathal Gurrin, Minh-Triet Tran |
| 2026 | DiffSynth-LVOS: Enhancing Language-Guided Video Object Segmentation via Diffusion-Based Synthetic Data Generation. | Chunjiang He, Gang Yang |
| 2026 | AI-Based Composition Tools for Composing A School Song with Student Participation. | Masatoshi Hamanaka |
| 2026 | AIT3D-DSR: An Adjustable Integration Targeted 3D Adversarial Attack Based on Differentiable Structured Rendering. | Yunong Guo, Jing Liu |
| 2026 | Backdoor-Based Protection Framework for Model Functional Services. | Yusheng Guo, Qiang Hao, Zhao Liu, Qingshuang Wu, Yanliang Lu, Ming Gu, Su Hu |
| 2026 | UCAMNet: HVI Color Space Based Unsupervised Low-Light Enhancement via Uncertainty Constraint and Attention Mechanism. | Jingshuo Guan, Na Qi, Qing Zhu, Liang Chen |
| 2026 | Extending vitrivr-engine with Emotion-Based Retrieval and a Modular User Interface. | Andrina Geller, Rahel Arnold, Raphael Waltenspl, Heiko Schuldt |
| 2026 | Prompt-Aware Adaptive Elastic Weight Consolidation for Continual Learning in Medical Vision-Language Models. | Ziyuan Gao, Philippe Morel |