| 2026 | Beyond the Encoder: Joint Encoder-Decoder Contrastive Pre-Training Improves Dense Prediction. | Sbastien Quetin, Tapotosh Ghosh, Farhad Maleki |
| 2026 | 1LoRa: Summation Compression for Very Low-Rank Adaptation. | Alessio Quercia, Zhuo Cao, Arya Bangun, Richard D. Paul, Abigail Morrison, Ira Assent, Hanno Scharr |
| 2026 | Decomposition Sampling for Efficient Region Annotations in Active Learning. | Jingna Qiu, Frauke Wilm, Mathias ttl, Jonas Utz, Maja Schlereth, Moritz Schillinger, Marc Aubreville, Katharina Breininger |
| 2026 | UniGaze: Towards Universal Gaze Estimation via Large-scale Pre-Training. | Jiawei Qin, Xucong Zhang, Yusuke Sugano |
| 2026 | SmokeBench: Evaluating Multimodal Large Language Models for Wildfire Smoke Detection. | Tianye Qi, Weihao Li, Nick Barnes |
| 2026 | Zero-Shot Domain Generalisation via Prompt-Driven Feature Refinement. | Tingrui Qiao, Di Zhao, Caroline Walker, Chris Cunningham, Yun Sing Koh |
| 2026 | Self-Supervised Compression and Artifact Correction for Streaming Underwater Imaging Sonar. | Rongsheng Qian, Chi Xu, Xiaoqiang Ma, Hao Fang, Yili Jin, William I. Atlas, Jiangchuan Liu |
| 2026 | A Universal Self-Attention Enhancement for Bridging Low-bit Quantization and Vision Transformers. | Jiahe Qian, Peisong Wang, Zhengyang Zhuge, Qinghao Hu, Jian Cheng |
| 2026 | MAFM | Mohammad Areeb Qazi, Munachiso S. Nwadike, Ibrahim Almakky, Mohammad Yaqub, Numan Saeed |
| 2026 | Rethinking Semantics for Complex-Scene Thermal Image Generation. | Tayeba Qazi, Ayush Maheshwari, Prerana Mukherjee, Brejesh Lall |
| 2026 | A Lightweight Temporal Detection Framework for Illegal Waste Dumping in Real Surveillance Footage. | Lorenzo Putzu, Rita Delussu, Mauro Fadda |
| 2026 | Show Me: Unifying Instructional Image and Video Generation with Diffusion Models. | Yujiang Pu, Zhanbo Huang, Vishnu Boddeti, Yu Kong |
| 2026 | Streaming Real-Time Trajectory Prediction Using Endpoint-Aware Modeling. | Alexander Prutsch, David Schinagl, Horst Possegger |
| 2026 | Hierarchical Instance Tracking to Balance Privacy Preservation with Accessible Information. | Neelima Prasad, Jarek Reynolds, Neel Karsanbhai, Tanusree Sharma, Lotus Zhang, Abigale Stangl, Yang Wang, Leah Findlater, Danna Gurari |
| 2026 | DARB-Splatting: Generalizing Splatting with Decaying Anisotropic Radial Basis Functions. | Hashiru Pramuditha, Vinasirajan Viruthshaan, Vishagar Arunan, Saeedha Nazar, Sameera Ramasinghe, Simon Lucey, Ranga Rodrigo |
| 2026 | D2Mamba: Dual Domain Guided Informed Search in State Space Model for Underwater Image Enhancement. | Alik Pramanick, Soumajit Roy, Arijit Sur |
| 2026 | FLASH-SAR: Fast Learning Self-Supervised Hierarchical Architecture for SAR. | Sai Shruti Prakhya, Uttam Kumar |
| 2026 | Pyramidal Spectrum: Frequency-based Hierarchically Vector Quantized VAE for Videos. | Tushar Prakash, Onkar Susladkar, Inderjit S. Dhillon, Sparsh Mittal |
| 2026 | Being Positive about Negative Queries: Exclusion Aware Multimodal Retrieval using Disentangled Representations. | Prachi, Sumit Bhatia, Srikanta Bedathur |
| 2026 | OpenCowID: Zero-Shot Visual Identification of Dairy Cows. | Omkar Prabhune, Younghyun Kim |
| 2026 | Improving Out-of-Distribution Detection using Segmented Images and Cross-View Attention Fusion. | Alexander Politowicz, Sahisnu Mazumder, Bing Liu |
| 2026 | FALCONEye: Finding Answers and Localizing Content in ONE-hour-long videos with multi-modal LLMs. | Carlos Plou, Cesar Borja, Ruben Martinez-Cantin, Ana C. Murillo |
| 2026 | Unconditional Priors Matter! Improving Conditional Generation of Fine-Tuned Diffusion Models. | Prin Phunyaphibarn, Phillip Y. Lee, Jaihoon Kim, Minhyuk Sung |
| 2026 | CineVerse: Consistent Keyframe Synthesis for Cinematic Scene Composition. | Quynh Phung, Long Mai, Fabian David Caba Heilbron, Feng Liu, Jia-Bin Huang, Cusuh Ham |
| 2026 | Motion-Aware Graph Fusion Network for 3D Human Pose Estimation. | Yen Pham, Xiaohui Yuan, Chengyuan Zhuang |