| 2026 | Are All Marine Species Created Equal? Performance Disparities in Underwater Object Detection. | Melanie Wille, Tobias Fischer, Scarlett Raine |
| 2026 | The King(dom) is Naked: Lightweight Machine Learning for Hyperspectral Bare Soil Detection. | Agata M. Wijata, Bogdan Ruszczak, Lukasz Tulczyjew, Nicolas Longp, Jakub Nalepa |
| 2026 | Spectra without Spectra: Learning Spectral Reconstruction from Real-World RGB Data with Sparse Supervision. | Shira Werman, Genady Paikin, Roy Shaul, Evgeny Soloveichik |
| 2026 | M-ErasureBench: A Comprehensive Multimodal Evaluation Benchmark for Concept Erasure in Diffusion Models. | Ju-Hsuan Weng, Jia-Wei Liao, Cheng-Fu Chou, Jun-Cheng Chen |
| 2026 | 4D Multimodal Co-attention Fusion Network with Latent Contrastive Alignment for Alzheimer's Diagnosis. | Yuxiang Wei, Yanteng Zhang, Xi Xiao, Tianyang Wang, Xiao Wang, Vince D. Calhoun |
| 2026 | Logit-Adjusted Test-Time Adaptation under Partial Class Imbalance. | Thilina Weerasinghe, Ruwan B. Tennakoon, Weiqin Chuah, Alireza Bab-Hadiashar |
| 2026 | FIRE-VLM: A Vision-Language-Driven Reinforcement Learning Framework for UAV Wildfire Tracking in a Physics-Grounded Fire Digital Twin. | Chris Webb, Mobin Habibpour, Mayamin Hamid Raha, Ali Reza Tavakkoli, Janice Coen, Fatemeh Afghah |
| 2026 | Towards Facilitated Fairness Assessment of AI-Based Skin Lesion Classifiers Through GenAI-Based Image Synthesis. | Ko Watanabe, Stanislav Frolov, Aya Hassan, David Dembinsky, Adriano Lucieri, Andreas Dengel |
| 2026 | Multimodal Adversarial Defense for Vision-Language Models by Leveraging One-To-Many Relationships. | Futa Waseda, Antonio Tejero-de-Pablos, Isao Echizen |
| 2026 | EzBlender: Efficient 3D Editing with Plan-and-ReAct Agent. | Hao Wang, Wenhui Zhu, Shao Tang, Zhipeng Wang, Xuanzhao Dong, Xin Li, Xiwen Chen, Ashish Bastola, Xinhao Huang, Yalin Wang, Abolfazl Razi |
| 2026 | Inpaint360GS: Efficient Object-Aware 3D Inpainting via Gaussian Splatting for 360° Scenes. | Shaoxiang Wang, Shihong Zhang, Christen Millerdurai, Rdiger Westermann, Didier Stricker, Alain Pagani |
| 2026 | Rethinking Real Image Editing: Unleashing Diverse Editing Operators via Multi-Objective Optimization. | Siyuan Wang, Xi Yang, Zihao Zhou, Huiru Shao, Rui Zhang, Qiufeng Wang, Guangliang Cheng, Kaizhu Huang |
| 2026 | M4U: Evaluating Multilingual Understanding and Reasoning for Large Multimodal Models. | Hongyu Wang, Jiayu Xu, Senwei Xie, Ruiping Wang, Jialin Li, Zhaojie Xie, Bin Zhang, Chuyan Xiong, Xilin Chen |
| 2026 | Cott-ADNet: Lightweight Real-Time Cotton Boll and Flower Detection Under Field Conditions. | Rui-Feng Wang, Mingrui Xu, Matthew C. Bauer, Iago Beffart Schardong, Xiaowen Ma, Peng W. Chee, Kangning Cui |
| 2026 | Timestamp Query Transformer for Temporal Action Segmentation. | Tieqiao Wang, Sinisa Todorovic |
| 2026 | Learnable Query-Enhanced Pose Transformation. | Yi-Zhen Wang, Hong-Han Shuai |
| 2026 | Mitigating the Modality Gap: Few-Shot Out-of-Distribution Detection with Multi-modal Prototypes and Image Bias Estimation. | Yimu Wang, Evelien Riddell, Adrian Chow, Sean Sedwards, Krzysztof Czarnecki |
| 2026 | BiNAR: A Bi-Modal Framework for Non-Aligned RGB-IR 3D Reconstruction via Gaussian Splatting. | Zhongwen Wang, Han Ling, Weihao Zhang, Yinghui Sun, Quansen Sun |
| 2026 | CAMP-VQA: Caption-Embedded Multimodal Perception for No-Reference Quality Assessment of Compressed Video. | Xinyi Wang, Angeliki Katsenou, Junxiao Shen, David Bull |
| 2026 | When AI Watches the Dose: Can Vision-Language Models Perform TB Medication Adherence Assessments Like Clinicians? | Yanqiao Wang, Patrick Kaggwa, Heeya Jolly, Suchendra M. Bhandarkar, Juliet N. Sekandi, Jin Sun |
| 2026 | GateFusion: Hierarchical Gated Cross-Modal Fusion for Active Speaker Detection. | Yu Wang, Juhyung Ha, Frangil M. Ramirez, Yuchen Wang, David J. Crandall |
| 2026 | One-shot Portrait Stylization via Geometric Alignment. | Xinrui Wang, Zilin Guo, Zhuoru Li, Jinze Yu, Heng Zhang, Yusuke Iwasawa, Yutaka Matsuo, Jiaxian Guo |
| 2026 | Steering Instruction-Tuned Vision-Language Models for Multi-Label Landcover Classification. | Weijia Wang, Jichao Fang, Wei Luo |
| 2026 | TimeRefine: Temporal Grounding with Time Refining Video LLM. | Xizi Wang, Feng Cheng, Ziyang Wang, Huiyu Wang, Md Mohaiminul Islam, Lorenzo Torresani, Mohit Bansal, Gedas Bertasius, David Crandall |
| 2026 | VideoForge: Efficient Domain Adaptation for Video Generation Through Quality-Driven Rewards and Enhanced LoRA. | Xiaogang Wang, Bill Cai, Girish Dilip Patil, Yash Shah |