| 2025 | Anomize: Better Open Vocabulary Video Anomaly Detection. | Fei Li, Wenxuan Liu, Jingjing Chen, Ruixu Zhang, Yuran Wang, Xian Zhong, Zheng Wang |
| 2025 | Unbiased Video Scene Graph Generation via Visual and Semantic Dual Debiasing. | Yanjun Li, Zhaoyang Li, Honghui Chen, Lizhi Xu |
| 2025 | SegEarth-OV: Towards Training-Free Open-Vocabulary Segmentation for Remote Sensing Images. | Kaiyu Li, Ruixun Liu, Xiangyong Cao, Xueru Bai, Feng Zhou, Deyu Meng, Zhi Wang |
| 2025 | ShiftwiseConv: Small Convolutional Kernel with Large Kernel Effect. | Dachong Li, Li Li, Zhuangzhuang Chen, Jianqiang Li |
| 2025 | Enhancing Vision-Language Compositional Understanding with Multimodal Synthetic Data. | Haoxin Li, Boyang Li |
| 2025 | Lifting Motion to the 3D World via 2D Diffusion. | Jiaman Li, C. Karen Liu, Jiajun Wu |
| 2025 | OmniFlow: Any-to-Any Generation with Multi-Modal Rectified Flows. | Shufan Li, Konstantinos Kallidromitis, Akash Gokul, Zichun Liao, Yusuke Kato, Kazuki Kozuka, Aditya Grover |
| 2025 | Beyond Clean Training Data: A Versatile and Model-Agnostic Framework for Out-of-Distribution Detection with Contaminated Training Data. | Yuchuan Li, Jae-Mo Kang, Il-Min Kim |
| 2025 | Towards RAW Object Detection in Diverse Conditions. | Zhongyu Li, Xin Jin, Bo-Yuan Sun, Chun-Le Guo, Ming-Ming Cheng |
| 2025 | Noise Modeling in One Hour: Minimizing Preparation Efforts for Self-supervised Low-Light RAW Image Denoising. | Feiran Li, Haiyang Jiang, Daisuke Iso |
| 2025 | VidHalluc: Evaluating Temporal Hallucinations in Multimodal Large Language Models for Video Understanding. | Chaoyu Li, Eun Woo Im, Pooyan Fazli |
| 2025 | OccMamba: Semantic Occupancy Prediction with State Space Models. | Heng Li, Yuenan Hou, Xiaohan Xing, Yuexin Ma, Xiao Sun, Yanyong Zhang |
| 2025 | High-quality Point Cloud Oriented Normal Estimation via Hybrid Angular and Euclidean Distance Encoding. | Yuanqi Li, Jingcheng Huang, Hongshen Wang, Peiyuan Lv, Yansong Liu, Jiuming Zheng, Jie Guo, Yanwen Guo |
| 2025 | MBQ: Modality-Balanced Quantization for Large Vision-Language Models. | Shiyao Li, Yingchun Hu, Xuefei Ning, Xihui Liu, Ke Hong, Xiaotao Jia, Xiuhong Li, Yaqi Yan, Pei Ran, Guohao Dai, Shengen Yan, Huazhong Yang, Yu Wang |
| 2025 | Learning with Noisy Triplet Correspondence for Composed Image Retrieval. | Shuxian Li, Changhao He, Xiting Liu, Joey Tianyi Zhou, Xi Peng, Peng Hu |
| 2025 | MCCD: Multi-Agent Collaboration-based Compositional Diffusion for Complex Text-to-Image Generation. | Mingcheng Li, Xiaolu Hou, Ziyang Liu, Dingkang Yang, Ziyun Qian, Jiawei Chen, Jinjie Wei, Yue Jiang, Qingyao Xu, Lihua Zhang |
| 2025 | CLIP-driven Coarse-to-fine Semantic Guidance for Fine-grained Open-set Semi-supervised Learning. | Xiaokun Li, Yaping Huang, Qingji Guan |
| 2025 | Enhancing Adversarial Transferability with Checkpoints of a Single Model's Training. | Shixin Li, Chaoxiang He, Xiaojing Ma, Bin Benjamin Zhu, Shuo Wang, Hongsheng Hu, Dongmei Zhang, Linchen Yu |
| 2025 | LION-FS: Fast & Slow Video-Language Thinker as Online Video Assistant. | Wei Li, Bing Hu, Rui Shao, Leyang Shen, Liqiang Nie |
| 2025 | UniPose: A Unified Multimodal Framework for Human Pose Comprehension, Generation and Editing. | Yiheng Li, Ruibing Hou, Hong Chang, Shiguang Shan, Xilin Chen |
| 2025 | UniScene: Unified Occupancy-centric Driving Scene Generation. | Bohan Li, Jiazhe Guo, Hongsi Liu, Yingshuang Zou, Yikang Ding, Xiwu Chen, Hu Zhu, Feiyang Tan, Chi Zhang, Tiancai Wang, Shuchang Zhou, Li Zhang, Xiaojuan Qi, Hao Zhao, Mu Yang, Wenjun Zeng, Xin Jin |
| 2025 | Robotic Visual Instruction. | Yanbang Li, Ziyang Gong, Haoyang Li, Xiaoqi Huang, Haolan Kang, Guangping Bai, Xianzheng Ma |
| 2025 | DPU: Dynamic Prototype Updating for Multimodal Out-of-Distribution Detection. | Shawn Li, Huixian Gong, Hao Dong, Tiankai Yang, Zhengzhong Tu, Yue Zhao |
| 2025 | Towards Visual Discrimination and Reasoning of Real-World Physical Dynamics: Physics-Grounded Anomaly Detection. | Wenqiao Li, Yao Gu, Xintao Chen, Xiaohao Xu, Ming Hu, Xiaonan Huang, Yingna Wu |
| 2025 | DTGBrepGen: A Novel B-rep Generative Model through Decoupling Topology and Geometry. | Jing Li, Yihang Fu, Falai Chen |