| 2026 | Efficient Text-Guided Convolutional Adapter for the Diffusion Model. | Aryan Das, Koushik Biswas, Swalpa Kumar Roy, Badri Narayana Patro, Vinay Kumar Verma |
| 2026 | On the Evaluation of Multimodal Large Language Models for Agricultural Image Classification Across Diverse Tasks. | Anindya Bijoy Das, Shibbir Ahmed, Shahnewaz Karim Sakib |
| 2026 | SuperRivolution: Fine-Scale Rivers from Coarse Temporal Satellite Imagery. | Rangel Daroya, Subhransu Maji |
| 2026 | SegMo: Segment-aligned Text to 3D Human Motion Generation. | Bowen Dang, Lin Wu, Xiaohang Yang, Zheng Yuan, Zhixiang Chen |
| 2026 | Q-Former Autoencoder: A Modern Framework for Medical Anomaly Detection. | Francesco Dalmonte, Emirhan Bayar, Emre Akbas, Mariana-Iuliana Georgescu |
| 2026 | DenseBEV: Transforming BEV Grid Cells into 3D Objects. | Marius Dhling, Sebastian Krebs, J. Marius Zllner |
| 2026 | CalibBEV: LiDAR-Camera Calibration via BEV Alignment. | Filippo D'Addeo, Lorenzo Cipelli, Adriano Cardace, Emanuele Ghelfi, Andrea Zinelli, Massimo Bertozzi |
| 2026 | Co-STAR: Collaborative Curriculum Self-Training with Adaptive Regularization for Source-Free Video Domain Adaptation. | Amirhossein Dadashzadeh, Parsa Esmati, Majid Mirmehdi |
| 2026 | RAT4D: Rig and Animate Objects without Surface Templates in 4D. | Mosam Dabhi, Simon Lucey, Lszl A. Jeni |
| 2026 | SasMamba: A Lightweight Structure-Aware Stride State Space Model for 3D Human Pose Estimation. | Hu Cui, Wenqiang Hua, Renjing Huang, Shurui Jia, Tessai Hayama |
| 2026 | "ScatSpotter" - A Dog Poop Detection Dataset. | Jonathan Crall |
| 2026 | Understanding Generative AI Capabilities in Everyday Image Editing Tasks. | Brandon Collins, Mohammad Reza Taesiri, Logan Bolton, Viet Dac Lai, Franck Dernoncourt, Trung Bui, Anh Totti Nguyen |
| 2026 | Decoupling Shape and Texture in SAM-2 via Controlled Texture Replacement. | Inbal Cohen, Boaz Meivar, Peihan Tu, Shai Avidan, Gal Oren |
| 2026 | Few-Shot LoRA Adaptation of a Flow-Matching Foundation Model for Cross-Spectral Object Detection. | Maxim Clouser, Kia Khezeli, John Kalantari |
| 2026 | Segment Anything but Farms: Comparing Segmentation Paradigms for Rural UAV Captured Ultra-High-Resolution Imagery. | Snehalraj Chugh, Dharmendra Singh Chaudhary, Subash Sigdel, Shubham Thapa, Lalit BC, Nishan Ghimire, Bipendra Basnyat, Nirmalya Roy |
| 2026 | MooTrack360: A Novel Fisheye Camera Dataset for Robust Multi Dairy Cow Detection and Tracking. | Rasmus G. K. Christiansen, Toan Van Nguyen, Lasse Rose Malskr, Leon Bodenhagen, Dirk Kraft |
| 2026 | From Bands to Depth: Understanding Bathymetry Decisions on Sentinel-2. | Satyaki Roy Chowdhury, Aswathnarayan Radhakrishnan, Hari Subramoni |
| 2026 | X-JEPA: A Novel Joint Learning Cross-Modal Predictive Alignment Framework for Remote Sensing Image Retrieval. | Shabnam Choudhury, Yash Salunkhe, Vaibhav Rajan, Subhasis Chaudhuri, Biplab Banerjee |
| 2026 | Test-Time Consistency in Vision Language Models. | Shih-Han Chou, Shivam Chandhok, James J. Little, Leonid Sigal |
| 2026 | MUSE: Model-based Uncertainty-aware Similarity Estimation for zero-shot 2D Object Detection and Segmentation. | Sungmin Cho, Sungbum Park, Insoo Oh |
| 2026 | Revisiting an Old Perspective Projection for Monocular 3D Morphable Models Regression. | Toby Chong, Ryota Nakajima |
| 2026 | Style-Friendly SNR Sampler for Style-Driven Generation. | Jooyoung Choi, Chaehun Shin, Yeongtak Oh, Heeseung Kim, Jungbeom Lee, Sungroh Yoon |
| 2026 | Better Safe Than Sorry? Overreaction Problem of Vision Language Models in Visual Emergency Recognition. | Dasol Choi, Seunghyun Lee, Youngsook Song |
| 2026 | Patch-wise Retrieval: A Bag of Practical Techniques for Instance-level Matching. | Won-Seok Choi, Sohwi Lim, Nam Hyeon-Woo, Moon Ye-Bin, Dong-Ju Jeong, Jinyoung Hwang, Tae-Hyun Oh |
| 2026 | Hybrid State Representation for Video Procedure Planning. | Woo Suk Choi, Youwon Jang, Minsu Lee, Byoung-Tak Zhang |