| 2025 | Federated Active Learning for Target Domain Generalisation. | Razvan Caramalau, Binod Bhattarai, Danail Stoyanov |
| 2025 | Unlocking Constraints: Source-Free Occlusion-Aware Seamless Segmentation. | Yihong Cao, Jiaming Zhang, Xu Zheng, Hao Shi, Kunyu Peng, Hang Liu, Kailun Yang, Hui Zhang |
| 2025 | IRGPT: Understanding Real-World Infrared Image with Bi-Cross-Modal Curriculum on Large-Scale Benchmark. | Zhe Cao, Jin Zhang, Ruiheng Zhang |
| 2025 | CogNav: Cognitive Process Modeling for Object Goal Navigation with LLMs. | Yihan Cao, Jiazhao Zhang, Zhinan Yu, Shuzhen Liu, Zheng Qin, Qin Zou, Bo Du, Kai Xu |
| 2025 | MotionCtrl: A Real-Time Controllable Vision-Language-Motion Model. | Bin Cao, Sipeng Zheng, Ye Wang, Lujie Xia, Qianshan Wei, Qin Jin, Jing Liu, Zongqing Lu |
| 2025 | MMAIF: Multi-Task and Multi-Degradation All-in-One for Image Fusion with Language Guidance. | Zihan Cao, Yu Zhong, Ziqi Wang, Liang-Jian Deng |
| 2025 | Boosting Vision Semantic Density with Anatomy Normality Modeling for Medical Vision-Language Pre-Training. | Weiwei Cao, Jianpeng Zhang, Zhongyi Shui, Sinuo Wang, Zeli Chen, Xi Li, Le Lu, Xianghua Ye, Tingbo Liang, Qi Zhang, Ling Zhang |
| 2025 | Enhancing Mamba Decoder with Bidirectional Interaction in Multi-Task Dense Prediction. | Mang Cao, Sanping Zhou, Yizhe Li, Ye Deng, Wenli Huang, Le Wang |
| 2025 | Taming Flow Matching With Unbalanced Optimal Transport Into Fast Pansharpening. | Zihan Cao, Yu Zhong, Liang-Jian Deng |
| 2025 | Refer to Any Segmentation Mask Group with Vision-Language Prompts. | Shengcao Cao, Zijun Wei, Jason Kuen, Kangning Liu, Lingzhi Zhang, Jiuxiang Gu, Hyunjoon Jung, Liang-Yan Gui, Yu-Xiong Wang |
| 2025 | UniVerse: Unleashing the Scene Prior of Video Diffusion Models for Robust Radiance Field Reconstruction. | Jin Cao, Hongrui Wu, Ziyong Feng, Hujun Bao, Xiaowei Zhou, Sida Peng |
| 2025 | Visual Relation Diffusion for Human-Object Interaction Detection. | Ping Cao, Yepeng Tang, Chunjie Zhang, Xiaolong Zheng, Chao Liang, Yunchao Wei, Yao Zhao |
| 2025 | TPG-INR: Target Prior-Guided Implicit 3D CT Reconstruction for Enhanced Sparse-View Imaging. | Qinglei Cao, Ziyao Tang, Xiaoqin Tang |
| 2025 | Neural Multi-View Self-Calibrated Photometric Stereo without Photometric Stereo Cues. | Xu Cao, Takafumi Taketomi |
| 2025 | FreeMorph: Tuning-Free Generalized Image Morphing with Diffusion Model. | Yukang Cao, Chenyang Si, Jinghao Wang, Ziwei Liu |
| 2025 | Exploiting Frequency Dynamics for Enhanced Multimodal Event-Based Action Recognition. | Meiqi Cao, Xiangbo Shu, Xin Jiang, Rui Yan, Yazhou Yao, Jinhui Tang |
| 2025 | ViT-EnsembleAttack: Augmenting Ensemble Models for Stronger Adversarial Transferability in Vision Transformers. | Hanwen Cao, Haobo Lu, Xiaosen Wang, Kun He |
| 2025 | First Place Solution to the MLCAS 2025 GWFSS Challenge: The Devil is in the Detail and Minority. | Songliang Cao, Tianqi Hu, Hao Lu |
| 2025 | VideoMiner: Iteratively Grounding Key Frames of Hour-Long Videos via Tree-Based Group Relative Policy Optimization. | Xinye Cao, Hongcan Guo, Jiawen Qian, Guoshun Nan, Chao Wang, Yuqi Pan, Tianhao Hou, Xiaojuan Wang, Yutong Gao |
| 2025 | ALLGCD: Leveraging All Unlabeled Data for Generalized Category Discovery. | Xinzi Cao, Ke Chen, Feidiao Yang, Xiawu Zheng, Yonghong Tian, Yutong Lu |
| 2025 | Is JPEG AI Going to Change Image Forensics? | Edoardo Daniele Cannas, Sara Mandelli, Natasa Popovic, Ayman Alkhateeb, Alessandro Gnutti, Paolo Bestagini, Stefano Tubaro |
| 2025 | Gain-MLP: Improving HDR Gain Map Encoding via a Lightweight MLP. | Trevor D. Canham, SaiKiran Kumar Tedla, Michael J. Murdoch, Michael S. Brown |
| 2025 | NegFaceDiff: The Power of Negative Context in Identity-Conditioned Diffusion for Synthetic Face Generation. | Eduarda Caldeira, Naser Damer, Fadi Boutros |
| 2025 | Baking Gaussian Splatting Into Diffusion Denoiser for Fast and Scalable Single-Stage Image-to-3D Generation and Reconstruction. | Yuanhao Cai, He Zhang, Kai Zhang, Yixun Liang, Mengwei Ren, Fujun Luan, Qing Liu, Soo Ye Kim, Jianming Zhang, Zhifei Zhang, Yuqian Zhou, Yulun Zhang, Xiaokang Yang, Zhe Lin, Alan L. Yuille |
| 2025 | LLaVA-KD: A Framework of Distilling Multimodal Large Language Models. | Yuxuan Cai, Jiangning Zhang, Haoyang He, Xinwei He, Ao Tong, Zhenye Gan, Chengjie Wang, Zhucun Xue, Yong Liu, Xiang Bai |