| 2025 | VideoRFSplat: Direct Scene-Level Text-to-3D Gaussian Splatting Generation with Flexible Pose and Multi-View Joint Modeling. | Hyojun Go, Byeongjun Park, Hyelin Nam, Byung-Hoon Kim, Hyungjin Chung, Changick Kim |
| 2025 | SAFER: Sharpness Aware Layer-Selective Finetuning for Enhanced Robustness in Vision Transformers. | Bhavna Gopal, Huanrui Yang, Mark Horton, Yiran Chen |
| 2025 | InstantEdit: Text-Guided Few-Step Image Editing with Piecewise Rectified Flow. | Yiming Gong, Zhen Zhu, Minjia Zhang |
| 2025 | TemCoCo: Temporally Consistent Multi-Modal Video Fusion with Visual-Semantic Collaboration. | Meiqi Gong, Hao Zhang, Xunpeng Yi, Linfeng Tang, Jiayi Ma |
| 2025 | SA-LUT: Spatial Adaptive 4D Look-Up Table for Photorealistic Style Transfer. | Zerui Gong, Zhonghua Wu, Qingyi Tao, Qinyue Li, Chen Change Loy |
| 2025 | Motion-Refined DINOSAUR for Unsupervised Multi-Object Discovery. | Xinrui Gong, Oliver Hahn, Christoph Reich, Krishnakant Singh, Simone Schaub-Meyer, Daniel Cremers, Stefan Roth |
| 2025 | CECT-Mamba: A Hierarchical Contrast-Enhanced-Aware Model for Pancreatic Tumor Subtyping from Multi-Phase CECT. | Zhifang Gong, Shuo Gao, Ben Zhao, Yingjing Xu, Yijun Yang, Shenghong Ju, Guangquan Zhou |
| 2025 | ZeroKey: Point-Level Reasoning and Zero-Shot 3D Keypoint Detection from Large Language Models. | Bingchen Gong, Diego Gomez, Abdullah Hamdi, Abdelrahman Eldesokey, Ahmed Abdelreheem, Peter Wonka, Maks Ovsjanikov |
| 2025 | CARP: Visuomotor Policy Learning via Coarse-to-Fine Autoregressive Prediction. | Zhefei Gong, Pengxiang Ding, Shangke Lyu, Siteng Huang, Mingyang Sun, Wei Zhao, Zhaoxin Fan, Donglin Wang |
| 2025 | FlowStyler: Artistic Video Stylization Via Transformation Fields Transports. | Yuning Gong, Jiaming Chen, Xiaohua Ren, Yuanjun Liao, Yanci Zhang |
| 2025 | FE-CLIP: Frequency Enhanced CLIP Model for Zero-Shot Anomaly Detection and Segmentation. | Tao Gong, Qi Chu, Bin Liu, Wei Zhou, Nenghai Yu |
| 2025 | MEH: A Multi-Style Dataset and Toolkit for Advancing Egyptian Hieroglyph Recognition. | Maksim Golyadkin, Valeria Rubanova, Aleksandr Utkov, Dmitry Nikolotov, Ilya Makarov |
| 2025 | RoMo: Robust Motion Segmentation Improves Structure from Motion. | Lily Goli, Sara Sabour, Mark J. Matthews, Marcus A. Brubaker, Dmitry Lagun, Alec Jacobson, David J. Fleet, Saurabh Saxena, Andrea Tagliasacchi |
| 2025 | Understanding what Vision-Language Models See in Traffic: PixelSHAP for Object-Level Attribution in Autonomous Driving. | Roni Goldshmidt |
| 2025 | Evaluating Performance of Reinforcement Learning Agents to Control Buildings Efficiently. | Judah Goldfeder, Gabriel Guerra Trigo, Philippe Martin Wyder, Neil Kachappilly, Hod Lipson |
| 2025 | Skeleton Motion Words for Unsupervised Skeleton-Based Temporal Action Segmentation. | Uzay Gkay, Federico Spurio, Dominik R. Bach, Juergen Gall |
| 2025 | Prediction Degeneracy in Medical Vision-Language Models: Implications for Robustness and Interpretability. | Martin Goetze, Dennis Eschweiler, Brendan Huang, Gustav Mller-Franzes, Carolina Ramirez, Madeline Hess, Lavinia Goldermann, Sharmila Majumdar, Daniel Truhn |
| 2025 | Drama-X: A Fine-Grained Intent Prediction and Risk Reasoning Benchmark for Driving. | Mihir Godbole, Xiangbo Gao, Zhengzhong Tu |
| 2025 | Inclusive Sign Language AI: Towards Authentic Accessibility Through Community Collaboration. | Abraham Glasser |
| 2025 | Pruning by Block Benefit: Exploring the Properties of Vision Transformer Blocks During Domain Adaptation. | Patrick Glandorf, Bodo Rosenhahn |
| 2025 | LOTS of Fashion! Multi-Conditioning for Image Generation via Sketch-Text Pairing. | Federico Girella, Davide Talon, Ziyue Liu, Zanxi Ruan, Yiming Wang, Marco Cristani |
| 2025 | A Survey on Reading Order, Table of Contents, and Structure Extraction in Document Analysis. | Simone Giovannini, Simone Marinai |
| 2025 | A Large-Scale Benchmark of Cross-Modal Learning for Histology and Gene Expression in Spatial Transcriptomics. | Rushin H. Gindra, Giovanni Palla, Mathias Nguyen, Sophia J. Wagner, Manuel Tran, Fabian J. Theis, Dieter Saur, Lorin Crawford, Tingying Peng |
| 2025 | Efficient and Distortion-Aware Fisheye Object Detection for Edge Devices. | Bao Tran Gia, Tuong Bui Cong Khanh, Tam Le Thi Thanh, Hien Ho Trong, Tien Do, Thanh Duc Ngo, Duy-Dinh Le, Shin'ichi Satoh |
| 2025 | SAGI: Semantically Aligned and Uncertainty Guided AI Image Inpainting. | Paschalis Giakoumoglou, Dimitrios Karageorgiou, Symeon Papadopoulos, Panagiotis C. Petrantonakis |