| 2025 | NVILA: Efficient Frontier Visual Language Models. | Zhijian Liu, Ligeng Zhu, Baifeng Shi, Zhuoyang Zhang, Yuming Lou, Shang Yang, Haocheng Xi, Shiyi Cao, Yuxian Gu, Dacheng Li, Xiuyu Li, Haotian Tang, Yunhao Fang, Yukang Chen, Cheng-Yu Hsieh, De-An Huang, An-Chieh Cheng, Jinyi Hu, Sifei Liu, Ranjay Krishna, Pavlo Molchanov, Jan Kautz, Hongxu Yin, Song Han, Yao Lu |
| 2025 | Multi-focal Conditioned Latent Diffusion for Person Image Synthesis. | Jiaqi Liu, Jichao Zhang, Paolo Rota, Nicu Sebe |
| 2025 | DCEvo: Discriminative Cross-Dimensional Evolutionary Learning for Infrared and Visible Image Fusion. | Jinyuan Liu, Bowei Zhang, Qingyun Mei, Xingyuan Li, Yang Zou, Zhiying Jiang, Long Ma, Risheng Liu, Xin Fan |
| 2025 | Hybrid Concept Bottleneck Models. | Yang Liu, Tianwei Zhang, Shi Gu |
| 2025 | H2ST: Hierarchical Two-Sample Tests for Continual Out-of-Distribution Detection. | Yuhang Liu, Wenjie Zhao, Yunhui Guo |
| 2025 | Erase Diffusion: Empowering Object Removal Through Calibrating Diffusion Pathways. | Yi Liu, Hao Zhou, Benlei Cui, Wenxiang Shang, Ran Lin |
| 2025 | LamRA: Large Multimodal Model as Your Advanced Retrieval Assistant. | Yikun Liu, Yajie Zhang, Jiayin Cai, Xiaolong Jiang, Yao Hu, Jiangchao Yao, Yanfeng Wang, Weidi Xie |
| 2025 | Stealthy Backdoor Attack in Self-Supervised Learning Vision Encoders for Large Vision Language Models. | Zhaoyi Liu, Huan Zhang |
| 2025 | FlexUOD: The Answer to Real-world Unsupervised Image Outlier Detection. | Zhonghang Liu, Kun Zhou, Changshuo Wang, Wen-Yan Lin, Jiangbo Lu |
| 2025 | Acc3D: Accelerating Single Image to 3D Diffusion Models via Edge Consistency Guided Score Distillation. | Kendong Liu, Zhiyu Zhu, Hui Liu, Junhui Hou |
| 2025 | The Devil is in Low-Level Features for Cross-Domain Few-Shot Segmentation. | Yuhan Liu, Yixiong Zou, Yuhua Li, Ruixuan Li |
| 2025 | MVBoost: Boost 3D Reconstruction with Multi-View Refinement. | Xiangyu Liu, Xiaomei Zhang, Zhiyuan Ma, Xiangyu Zhu, Zhen Lei |
| 2025 | CSRN: Cross-Sensor Robust Recognition Network for Multi-modal Aerial View Object Classification. | Hongli Liu, Wang Yu, Shengjie Zhao |
| 2025 | Uncertainty-Instructed Structure Injection for Generalizable HD Map Construction. | Xiaolu Liu, Ruizi Yang, Song Wang, Wentong Li, Junbo Chen, Jianke Zhu |
| 2025 | MagicQuill: An Intelligent Interactive Image Editing System. | Zichen Liu, Yue Yu, Hao Ouyang, Qiuyu Wang, Ka Leong Cheng, Wen Wang, Zhiheng Liu, Qifeng Chen, Yujun Shen |
| 2025 | Dynamic Derivation and Elimination: Audio Visual Segmentation with Enhanced Audio Semantics. | Chen Liu, Liying Yang, Peike Li, Dadong Wang, Lincheng Li, Xin Yu |
| 2025 | Enhancing Online Continual Learning with Plug-and-Play State Space Model and Class-Conditional Mixture of Discretization. | Sihao Liu, Yibo Yang, Xiaojie Li, David A. Clifton, Bernard Ghanem |
| 2025 | Unleashing the Potential of Multi-modal Foundation Models and Video Diffusion for 4D Dynamic Physical Scene Simulation. | Zhuoman Liu, Weicai Ye, Yan Luximon, Pengfei Wan, Di Zhang |
| 2025 | SEC-Prompt: SEmantic Complementary Prompting for Few-Shot Class-Incremental Learning. | Ye Liu, Meng Yang |
| 2025 | When the Future Becomes the Past: Taming Temporal Correspondence for Self-supervised Video Representation Learning. | Yang Liu, Qianqian Xu, Peisong Wen, Siran Dai, Qingming Huang |
| 2025 | STOP: Integrated Spatial-Temporal Dynamic Prompting for Video Understanding. | Zichen Liu, Kunlun Xu, Bing Su, Xu Zou, Yuxin Peng, Jiahuan Zhou |
| 2025 | Hybrid-Level Instruction Injection for Video Token Compression in Multi-modal Large Language Models. | Zhihang Liu, Chen-Wei Xie, Pandeng Li, Liming Zhao, Longxiang Tang, Yun Zheng, Chuanbin Liu, Hongtao Xie |
| 2025 | DeclutterNeRF: Generative-Free 3D Scene Recovery for Occlusion Removal. | Wanzhou Liu, Zhexiao Xiong, Xinyu Li, Nathan Jacobs |
| 2025 | TimeTracker: Event-based Continuous Point Tracking for Video Frame Interpolation with Non-linear Motion. | Haoyue Liu, Jinghan Xu, Yi Chang, Hanyu Zhou, Haozhi Zhao, Lin Wang, Luxin Yan |
| 2025 | SaMam: Style-aware State Space Model for Arbitrary Image Style Transfer. | Hongda Liu, Longguang Wang, Ye Zhang, Ziru Yu, Yulan Guo |