| 2025 | Splat-LOAM: Gaussian Splatting LiDAR Odometry and Mapping. | Emanuele Giacomini, Luca Di Giammarino, Lorenzo De Rebotti, Giorgio Grisetti, Martin R. Oswald |
| 2025 | ROADWork: A Dataset and Benchmark for Learning to Recognize, Observe, Analyze and Drive Through Work Zones. | Anurag Ghosh, Shen Zheng, Robert Tamburo, Khiem Vuong, Juan R. Alvarez-Padilla, Hailiang Zhu, Michael Cardei, Nicholas Dunn, Christoph Mertz, Srinivasa G. Narasimhan |
| 2025 | Decoder-Aware Self-Supervised Continual Pretraining and Uncertainty-Guided Pseudo-Labeling for Wheat Organ Segmentation. | Tapotosh Ghosh, Md Jaber Al Nahian, Farnaz Sheikhi, Farhad Maleki |
| 2025 | Streamlining Image Editing with Layered Diffusion Brushes. | Peyman Gholami, Robert Xiao |
| 2025 | WP-CLIP: Leveraging CLIP to Predict Wlfflin's Principles in Visual Art. | Abhijay Ghildyal, Li-Yun Wang, Feng Liu |
| 2025 | PathFinder: A Multi-Modal Multi-Agent System for Medical Diagnostic Decision-Making Applied to Histopathology. | Fatemeh Ghezloo, Mehmet Saygin Seyfioglu, Rustin Soraki, Wisdom Oluchi Ikezogwo, Beibin Li, Tejoram Vivekanandan, Joann G. Elmore, Ranjay Krishna, Linda G. Shapiro |
| 2025 | DiViD: Disentangled Video Diffusion for Static-Dynamic Factorization. | Marzieh Gheisari, Auguste Genovesio |
| 2025 | MPromer: A Unified Diffusion-Based Framework for Scalable and Generalizable Multi-Modal Medical Image Segmentation. | Wafa Al Ghallabi, Akshay Dudhane, Syed Waqas Zamir, Salman H. Khan, Fahad Shahbaz Khan |
| 2025 | CLIP-Adapted Region-to-Text Learning for Generative Open-Vocabulary Semantic Segmentation. | Jiannan Ge, Lingxi Xie, Hongtao Xie, Pandeng Li, Sun-Ao Liu, Xiaopeng Zhang, Qi Tian, Yongdong Zhang |
| 2025 | Enhancing Domain Diversity in Synthetic Data Face Recognition with Dataset Fusion. | Anjith George, Sbastien Marcel |
| 2025 | Textual Semantics Matters: Unsupervised Representation Disentanglement in Realistic Scenarios with Language Inductive Bias. | Junhao Geng, Lexiang Lv, Jianxin Lin |
| 2025 | SAUCE: Selective Concept Unlearning in Vision-Language Models with Sparse Autoencoders. | Jiahui Geng, Qing Li |
| 2025 | Neural Object Detection for 4D-STEM: High-Throughput Sub-Pixel Electron Diffraction Pattern Recognition. | Arda Genc, Ravit Silverstein |
| 2025 | PRM: Photometric Stereo Based Large Reconstruction Model. | Wenhang Ge, Jiantao Lin, Guibao Shen, Jiawei Feng, Tao Hu, Xinli Xu, Ying-Cong Chen |
| 2025 | Iris: Breaking GUI Complexity with Adaptive Focus and Self-Refining. | Zhiqi Ge, Juncheng Li, Xinglei Pang, Minghe Gao, Kaihang Pan, Wang Lin, Hao Fei, Wenqiao Zhang, Siliang Tang, Yueting Zhuang |
| 2025 | Unraveling the Effects of Synthetic Data on End-to-End Autonomous Driving. | Junhao Ge, Zuhong Liu, Longteng Fan, Yifan Jiang, Jiaqi Su, Yiming Li, Zhejun Zhang, Siheng Chen |
| 2025 | V2PE: Improving Multimodal Long-Context Capability of Vision-Language Models with Variable Visual Position Encoding. | Junqi Ge, Ziyi Chen, Jintao Lin, Jinguo Zhu, Xihui Liu, Jifeng Dai, Xizhou Zhu |
| 2025 | Bayesian-Inspired Space-Time Superpixels. | Kent Gauen, Stanley H. Chan |
| 2025 | VOccl3D: A Video Benchmark Dataset for 3D Human Pose and Shape Estimation Under Real Occlusions. | Yash Garg, Saketh Bachu, Arindam Dutta, Rohit Lal, Sarosij Bose, Calvin-Khang Ta, M. Salman Asif, Amit K. Roy-Chowdhury |
| 2025 | Mapillary Vistas Validation for Fine-Grained Traffic Signs: A Benchmark Revealing Vision-Language Model Limitations. | Sparsh Garg, Abhishek Aich |
| 2025 | Bridging Domain Gaps for Fine-Grained Moth Classification Through Expert-Informed Adaptation and Foundation Model Priors. | Ross Gardiner, Guillaume Mougeot, Sareh Rowlands, Benno I. Simmons, Flemming Helsing, Toke Thomas Hye |
| 2025 | Scanned Documents Forensics: Detecting Inserted Characters Through Noise and Chromatic Artifacts. | Marina Gardella, Julieta Umpierrez, Antoine Tadros, Seginus Mowlavi, Natalia Bottaioli, Diego Belzarena, Gabriele Facciolo, Roy Y. He, Jean-Michel Morel, Rafael Grompone von Gioi |
| 2025 | Superpowering Open-Vocabulary Object Detectors for X-ray Vision. | Pablo Garcia-Fernandez, Lorenzo Vaquero, Mingxuan Liu, Feng Xue, Daniel Cores, Nicu Sebe, Manuel Mucientes, Elisa Ricci |
| 2025 | Epipolar Consistent Attention Aggregation Network for Unsupervised Light Field Disparity Estimation. | Chen Gao, Shuo Zhang, Youfang Lin |
| 2025 | Self-Supervised Learning of Hybrid Part-Aware 3D Representations of 2D Gaussians and Superquadrics. | Zhirui Gao, Renjiao Yi, Yuhang Huang, Wei Chen, Chenyang Zhu, Kai Xu |