| 2024 | Open-Vocabulary Temporal Action Localization using Multimodal Guidance. | Akshita Gupta, Aditya Arora, Sanath Narayan, Salman Khan, Fahad Shahbaz Khan, Graham W. Taylor |
| 2024 | On Partial Prototype Collapse in the DINO Family of Self-Supervised Methods. | Hariprasath Govindarajan, Per Sidn, Jacob Roll, Fredrik Lindsten |
| 2024 | When Text and Images Don't Mix: Bias-Correcting Language-Image Similarity Scores for Anomaly Detection. | Adam Goodge, Bryan Hooi, Wee Siong Ng |
| 2024 | A Super-pixel-based Approach to the Stable Interpretation of Neural Networks. | Shizhan Gong, Jingwei Zhang, Qi Dou, Farzan Farnia |
| 2024 | Prompting Diffusion Representations for Cross-Domain Semantic Segmentation. | Rui Gong, Martin Danelljan, Han Sun, Julio Delgado Mangas, Nikolay Marin, Luc Van Gool |
| 2024 | Explaining Multi-modal Large Language Models by Analyzing their Vision Perception. | Loris Giulivi, Giacomo Boracchi |
| 2024 | Enhancing Cardiovascular Disease Prediction through Multi-Modal Self-Supervised Learning. | Francesco Girlanda, Olga V. Demler, Bjoern H. Menze, Neda Davoudi |
| 2024 | AutoDOM: Automated Dimension Overlay for Enhanced Measurement-Guidance. | Pushpendu Ghosh, Aniket Joshi, Soumyajit Chowdhury, Promod Yenigalla |
| 2024 | Efficient Data Source Relevance Quantification for Multi-Source Neural Networks. | Jakob Gawlikowski, Nina Maria Gottschling |
| 2024 | Revitalizing Legacy Video Content: Deinterlacing with Bidirectional Information Propagation. | Zhaowei Gao, Mingyang Song, Christopher Schroers, Yang Zhang |
| 2024 | Effective Message Hiding with Order-Preserving Mechanisms. | Yu Gao, Xuchong Qiu, Zihan Ye |
| 2024 | Learning to Segment Publicly Accessible Green Spaces with Visual and Semantic Data. | Jian Gao, Niall McLaughlin, Joanna Sara Valson, Neil Anderson, Ruth F. Hunter |
| 2024 | Towards Better Zero-Shot Anomaly Detection under Distribution Shift with CLIP. | Jiyao Gao, Chengxin He, Lei Duan, Jie Zuo |
| 2024 | GLPI: A Global Layered Prompt Integration approach for Explicit Visual Prompt. | Yufei Gao, Bin Fu, Lei Shi, Chengming Liu, Yucheng Shi |
| 2024 | D³Nav: Data-Driven Driving Agents for Autonomous Vehicles in Unstructured Traffic. | Aditya Nalgunda Ganesh, Gowri Srinivasa |
| 2024 | SCAM: Systematic Classification and Analysis of Misinformation. | Iyyakutti Iyappan Ganapathi, Syed Sadaf Ali, Maregu Assefa, Sajid Javed, Naoufel Werghi |
| 2024 | Blocks as Probes: Dissecting Categorization Ability of Large Multimodal Models. | Bin Fu, Qiyang Wan, Jialin Li, Ruiping Wang, Xilin Chen |
| 2024 | Erasing Concepts from Text-to-Image Diffusion Models with Few-shot Unlearning. | Masane Fuchi, Tomohiro Takagi |
| 2024 | Vision-Language Guidance for LiDAR-based Unsupervised 3D Object Detection. | Christian Fruhwirth-Reisinger, Wei Lin, Dusan Malic, Horst Bischof, Horst Possegger |
| 2024 | CLIP with Generative Latent Replay: a Strong Baseline for Incremental Learning. | Emanuele Frascaroli, Aniello Panariello, Pietro Buzzega, Lorenzo Bonicelli, Angelo Porrello, Simone Calderara |
| 2024 | Text-Guided Mixup Towards Long-Tailed Image Categorization. | Richard Franklin, Jiawei Yao, Deyang Zhong, Qi Qian, Juhua Hu |
| 2024 | SAE: Single Architecture Ensemble Neural Networks. | Martin Ferianc, Hongxiang Fan, Miguel R. D. Rodrigues |
| 2024 | Toward Highly Efficient Semantic-Guided Machine Vision for Low-Light Object Detection. | Xin Feng, Junxian Zeng, Siping Wang, Zhenwei He |
| 2024 | Annotation by Clicks: A Point-Supervised Contrastive Variance Method for Medical Semantic Segmentation. | Qing En, Yuhong Guo |
| 2024 | Learning conditionally untangled latent spaces using Fixed Point Iteration. | Victor Enescu, Hichem Sahbi |