| 2025 | VMAs: Video-to-Music Generation via Semantic Alignment in Web Music Videos. | Yan-Bo Lin, Yu Tian, Linjie Yang, Gedas Bertasius, Heng Wang |
| 2025 | Enhancing Remote Sensing Representations Through Mixed-Modality Masked Autoencoding. | Ori Linial, George Leifman, Yochai Blau, Nadav Sherman, Yotam Gigi, Wojciech Sirko, Genady Beryozkin |
| 2025 | Joint Audio-Visual Idling Vehicle Detection with Streamlined Input Dependencies. | Xiwen Li, Rehman Mohammed, Tristalee Mangin, Surojit Saha, Kerry E. Kelly, Ross T. Whitaker, Tolga Tasdizen |
| 2025 | Texture, Shape and Order Matter: A New Transformer Design for Sequential DeepFake Detection. | Yunfei Li, Yuezun Li, Xin Wang, Baoyuan Wu, Jiaran Zhou, Junyu Dong |
| 2025 | Multi-Modal Large Language Model with RAG Strategies in Soccer Commentary Generation. | Xiang Li, Yangfan He, Shuaishuai Zu, Zhengyang Li, Tianyu Shi, Yiting Xie, Kevin Zhang |
| 2025 | OmniGS: Fast Radiance Field Reconstruction Using Omnidirectional Gaussian Splatting. | Longwei Li, Huajian Huang, Sai-Kit Yeung, Hui Cheng |
| 2025 | DiaMond: Dementia Diagnosis with Multi-Modal Vision Transformers Using MRI and PET. | Yitong Li, Morteza Ghahremani, Youssef Wally, Christian Wachinger |
| 2025 | Evaluation of Spatio-Temporal Small Object Detection in Real-World Adverse Weather Conditions. | Michel van Lier, Martin Van Leeuwen, Bastian Van Manen, Leo Kampmeijer, Nicolas Boehrer |
| 2025 | Wavelength- and Depth-Aware Deep Image Prior for Blind Hyperspectral Imagery Deblurring with Coarse Depth Guidance. | Jiahuan Li, Xiaoyu Dong, Wei He, Naoto Yokoya |
| 2025 | TrackDiffusion: Tracklet-Conditioned Video Generation via Diffusion Models. | Pengxiang Li, Kai Chen, Zhili Liu, Ruiyuan Gao, Lanqing Hong, Dit-Yan Yeung, Huchuan Lu, Xu Jia |
| 2025 | Multi-Spectral Image Color Reproduction. | Jiacheng Li, Chang Chen, Xue Hu, Fenglong Song, Youliang Yan, Zhiwei Xiong |
| 2025 | DiffQRCoder: Diffusion-Based Aesthetic QR Code Generation with Scanning Robustness Guided Iterative Refinement. | Jia-Wei Liao, Winston Wang, Tzu-Sian Wang, Li-Xuan Peng, Ju-Hsuan Weng, Cheng-Fu Chou, Jun-Cheng Chen |
| 2025 | Disentangling Spatio-Temporal Knowledge for Weakly Supervised Object Detection and Segmentation in Surgical Video. | Guiqiu Liao, Matjaz Jogan, Sai Koushik, Eric Eaton, Daniel A. Hashimoto |
| 2025 | GauFRe: Gaussian Deformation Fields for Real-Time Dynamic Novel View Synthesis. | Yiqing Liang, Numair Khan, Zhengqin Li, Thu Nguyen-Phuoc, Douglas Lanman, James Tompkin, Lei Xiao |
| 2025 | RopeTP: Global Human Motion Recovery via Integrating Robust Pose Estimation with Diffusion Trajectory Prior. | Mingjiang Liang, Yongkang Cheng, Hualin Liang, Shaoli Huang, Wei Liu |
| 2025 | ARF-Plus: Controlling Perceptual Factors in Artistic Radiance Fields for 3D Scene Stylization. | Wenzhao Li, Tianhao Wu, Fangcheng Zhong, Cengiz ztireli |
| 2025 | Towards High-fidelity Head Blending with Chroma Keying for Industrial Applications. | Hah Min Lew, Sahng-Min Yoo, Hyunwoo Kang, Gyeong-Moon Park |
| 2025 | FOR: Finetuning for Object Level Open Vocabulary Image Retrieval. | Hila Levi, Guy Heller, Dan Levi |
| 2025 | CamoFA: A Learnable Fourier-Based Augmentation for Camouflage Segmentation. | Minh-Quan Le, Minh-Triet Tran, Trung-Nghia Le, Tam V. Nguyen, Thanh-Toan Do |
| 2025 | Self-Supervised Incremental Learning of Object Representations from Arbitrary Image Sets. | George Leotescu, Alin-Ionut Popa, Diana Grigore, Daniel Voinea, Pietro Perona |
| 2025 | Stratified Domain Adaptation: A Progressive Self-Training Approach for Scene Text Recognition. | Kha Nhat Le, Hoang-Tuan Nguyen, Hung Tien Tran, Thanh Duc Ngo |
| 2025 | SynDroneVision: A Synthetic Dataset for Image-Based Drone Detection. | Tamara Regina Lenhard, Andreas Weinmann, Kai Franke, Tobias Koch |
| 2025 | Improving Human Pose-Conditioned Generation: Fine-Tuning ControlNet Models with Reinforcement Learning. | Jeonghwan Lee, Heywon Yun, Jimin Kim, Homa Fashandi |
| 2025 | Now you see Me: Context-Aware Automatic Audio Description. | Seon-Ho Lee, Jue Wang, David Fan, Zhikang Zhang, Linda Liu, Xiang Hao, Vimal Bhat, Xinyu Li |
| 2025 | uLayout: Unified Room Layout Estimation for Perspective and Panoramic Images. | Jonathan Lee, Bolivar Solarte, Chin-Hsuan Wu, Jin-Cheng Jhang, Fu-En Wang, Yi-Hsuan Tsai, Min Sun |