| 2026 | Detecting Object Tracking Failure via Sequential Hypothesis Testing. | Alejandro Monroy Muoz, Rajeev Verma, Alexander Timans |
| 2026 | SmoothDiffusion-VE: Real-time Generative Video Editing Using Adaptive Feature Cache. | Mustafa Munir, Sophia Zalewski, Shiqiu Liu, David Tarjan, Sushmitha Belede, Anjul Patney, Radu Marculescu |
| 2026 | AdaptViG: Adaptive Vision GNN with Exponential Decay Gating. | Mustafa Munir, Md Mostafijur Rahman, Radu Marculescu |
| 2026 | AEON: Adaptive Embedding Optimized Noise for Robust Watermarking in Diffusion Models. | Muhammad Shahid Muneer, Simon S. Woo |
| 2026 | MIST: Multilingual Incidental Dataset for Scene Text Detection. | Saumya Mundra, Ajoy Mondal, C. V. Jawahar |
| 2026 | Orthogonal Projection Steering for Bias Mitigation and ICAO Compliance in Diffusion Transformers. | Raghavendra Mudgalgundurao, Aryan Khurana, Patrick Schuch, Raghavendra Ramachandra, Kiran B. Raja |
| 2026 | Towards Egocentric 3D Hand Pose Estimation in Unseen Domains. | Wiktor Mucha, Michael Wray, Martin Kampel |
| 2026 | Do generative video models understand physical principles? | Saman Motamed, Laura Culp, Kevin Swersky, Priyank Jaini, Robert Geirhos |
| 2026 | Revisiting Retentive Networks for Fast Range-View 3D LiDAR Semantic Segmentation. | Simone Mosco, Daniel Fusaro, Wanmeng Li, Alberto Pretto |
| 2026 | OPFormer: Object Pose Estimation leveraging foundation model with geometric encoding. | Artem Moroz, Vt Zeman, Martin Miksk, Elizaveta Isianova, Miroslav David, Pavel Burget, Varun Burde |
| 2026 | Crafting Descriptive Information for a Zero-shot Method to Improve Knowledge-Based Visual Question Answering Performance. | Mohammad Mahdi Moradi, Sudhir Mudur |
| 2026 | FCC: Fully Connected Correlation for One-Shot Segmentation. | Seonghyeon Moon, Haein Kong, Muhammad Haris Khan, Mubbasir Kapadia, Yuewei Lin |
| 2026 | NavMapFusion: Diffusion-based Fusion of Navigation Maps for Online Vectorized HD Map Construction. | Thomas Monninger, Zihan Zhang, Steffen Staab, Sihao Ding |
| 2026 | AugMapNet: Improving Spatial Latent Structure via BEV Grid Augmentation for Enhanced Vectorized Online HD Map Construction. | Thomas Monninger, Md Zafar Anwar, Stanislaw Antol, Steffen Staab, Sihao Ding |
| 2026 | mmWEAVER: Environment-Specific mmWave Signal Synthesis from a Photo and Activity Description. | Mahathir Monjur, Shahriar Nirjon |
| 2026 | UniTabBank: A Large Scale Multi-Lingual, Multi-Layout, Multi-Type, Multi-Format Dataset for Table Detection. | Ajoy Mondal, Saumya Mundra, Avijit Dasgupta, C. V. Jawahar |
| 2026 | DiRe: Diversity-promoting Regularization for Dataset Condensation. | Saumyaranjan Mohanty, Aravind Reddy, Konda Reddy Mopuri |
| 2026 | Cosine Similarity is Almost All You Need (for Prototypical-Part Models). | Luke Moffett, Frank Willard, Maximillian Machado, Emmanuel Mokel, Jon Donnelly, Zhicheng Guo, Adam Costarino, Julia Yang, Giyoung Kim, Alina Jade Barnett, Cynthia Rudin |
| 2026 | Robust Multimodal Emotion Recognition from Incomplete Modalities via Query-Based Unimodal and Cross-Modal Learning. | Ryo Miyoshi, Mayu Otani, Yuki Okafuji |
| 2026 | OpenLVLM-MIA: A Controlled Benchmark Revealing the Limits of Membership Inference Attacks on Large Vision-Language Models. | Ryoto Miyamoto, Xin Fan, Fuyuko Kido, Tsuneo Matsumoto, Hayato Yamana |
| 2026 | Model-free Domain Adaptation for Concealed Multimodal Large-Language Models. | Yu Mitsuzumi, Akisato Kimura, Hisashi Kashima |
| 2026 | Learning Beyond Labels: Self-Supervised Handwritten Text Recognition. | Shree Mitra, Ajoy Mondal, C. V. Jawahar |
| 2026 | When Humans Judge Irises: Pupil Size Normalization as an Aid and Synthetic Irises as a Challenge. | Mahsa Mitcheff, Adam Czajka |
| 2026 | Improvise, Adapt, Overcome - Telescopic Adapters for Efficient Fine-tuning of Vision Language Models in Medical Imaging. | Ujjwal Mishra, Vinita Shukla, Praful Hambarde, Amit Shukla |
| 2026 | IMKD: Intensity-Aware Multi-Level Knowledge Distillation for Camera-Radar Fusion. | Shashank Mishra, Karan Patil, Didier Stricker, Jason R. Rambach |