| 2026 | From Filters to VLMs: Benchmarking Defogging Methods Through Object Detection and Segmentation Performance. | Ardalan Aryashad, Parsa Razmara, Amin Mahjoub, Seyedarmin Azizi, Mahdi Salmani, Arad Firouzkouhi |
| 2026 | Distilling What and Why: Enhancing Driver Intention Prediction with MLLMs. | Sainithin Artham, Avijit Dasgupta, Shankar Gangisetty, C. V. Jawahar |
| 2026 | Video and Language Alignment in 2D Systems for 3D Multi-object Scenes with Multi-Information Derivative-Free Control. | Jason Armitage, Rico Sennrich |
| 2026 | The Perceptual Observatory Characterizing Robustness and Grounding in MLLMs. | Tejas Anvekar, Fenil Denish Bardoliya, Pavan K. Turaga, Chitta Baral, Vivek Gupta |
| 2026 | A-V Representation Learning via Audio Shift Prediction for Multimodal Deepfake Detection and Temporal Localization. | Ashutosh Anshul, Eng Siong Chng, Deepu Rajan |
| 2026 | FastPose-ViT: A Vision Transformer for Real-Time Spacecraft Pose Estimation. | Pierre Ancey, Andrew Lawrence Price, Saqib Javed, Mathieu Salzmann |
| 2026 | AFRAgent : An Adaptive Feature Renormalization Based High Resolution Aware GUI agent. | Neeraj Anand, Rishabh Jain, Sohan Patnaik, Balaji Krishnamurthy, Mausoom Sarkar |
| 2026 | High-Rate Mixout: Revisiting Mixout for Robust Domain Generalization. | Masih Aminbeidokhti, Heitor Rapela Medeiros, Srikanth Muralidharan, Eric Granger, Marco Pedersoli |
| 2026 | Hierarchical Adaptive networks with Task vectors for Test-Time Adaptation. | Sameer Ambekar, Marta Hasny, Laura Daza, Daniel Lang, Julia A. Schnabel |
| 2026 | Beyond Paired Data: Self-Supervised UAV Geo-Localization from Reference Imagery Alone. | Tristan Amadei, Enric Meinhardt-Llopis, Benedicte Bascle, Corentin Abgrall, Gabriele Facciolo |
| 2026 | 2COOOL: An Evaluation Benchmark for Generating Incident Reports on Out-of-Distribution Hazards in Autonomous Driving. | Ali K. AlShami, Ryan Rabinowitz, Terrance E. Boult, Jugal Kalita |
| 2026 | GATEPose: A Graph Attention Transformer Enhanced with Pose and Orientation Angles for Pedestrian Crossing Intention Prediction. | Ali K. AlShami, Terrance E. Boult, Jugal Kalita |
| 2026 | X3D-based Illegal Waste Dumping Detection with Temporal Localization. | Sajed Almorsy, Marwan Torki |
| 2026 | An Efficient Multi-Rater Setup Towards Personalized and Diversified Medical Image Segmentation. | Sajed Almorsy, Ayman Khalafallah, Marwan Torki |
| 2026 | Feature Inversion as a Lens on Vision Encoders. | Eduard Allakhverdov, Dmitrii Tarasov, Elizaveta Goncharova, Andrey Kuznetsov |
| 2026 | Towards Fine-Grained Adaptation of CLIP via a Self-Trained Alignment Score. | Eman Ali, Sathira Silva, Chetan Arora, Muhammad Haris Khan |
| 2026 | CasTex: Cascaded Text-to-Texture Synthesis via Explicit Texture Maps and Physically-Based Shading. | Mishan Aliev, Dmitry Baranchuk, Kirill Struminsky |
| 2026 | SD-CSFL: A Synthetic Data-Driven Conformity Scoring Framework for Robust Federated Learning. | Ebtisaam Alharbi, Abdulrahman Kerim, Leandro Soriano Marcolino, Qiang Ni |
| 2026 | SiamTrackCaps: A Siamese-Based Single Object Tracker Using Capsule Networks. | Abdullah M. Algamdi, Victor Sanchez, Chang-Tsun Li |
| 2026 | PHYSPLAT: A Framework for Photorealistic Hybrid Simulation of Real and Synthetic Elements using 3D Gaussian Splatting. | Mario Alfonso-Arsuaga, Henar Dominguez-Elvira, Jorge Casas-Guerrero, Andrea Castiella-Aguirrezabala, Lorenzo Costabile-Dominguez, Jorge Garca-Gonzlez, Maria Naranjo-Almeida, Marc Comino-Trinidad, Jorge Lopez-Moreno |
| 2026 | MixER: From Cross-Modal to Mixed-Modal Visible-Infrared Re-Identification. | Mahdi Alehdaghi, Rajarshi Bhattacharya, Pourya Shamsolmoali, Rafael M. O. Cruz, Eric Granger |
| 2026 | Analysis of Text Accuracy and Visual Alignment in Vision-Language Models for Artistic Text Generation. | Fatima Alderazi, Motaz Alfarraj |
| 2026 | ASC: Learning Augmentation Severity-Consistent Representations Improves Generalization via Augmentation Search. | Amirhossein Alamdar, Hossein Jafarinia, Mahdi Noori, Mohammad Hossein Rohban |
| 2026 | LENVIZ: A High-Resolution Low-Exposure Night Vision Benchmark Dataset. | Manjushree B. Aithal, Rosaura G. VidalMata, Manikandtan Kartha, Gong Chen, Eashan Adhikarla, Lucas N. Kristen, Zhicheng Fu, Nikhil A. Madusudhana, Joe Nasti |
| 2026 | Generalization of Real World Video Deblurring by Image-to-image Translation. | Kassymzhomart Aitbek, Seungjoon Yang |