| 2025 | Blind Video Super-Resolution Based on Implicit Kernels. | Qiang Zhu, Yuxuan Jiang, Shuyuan Zhu, Fan Zhang, David Bull, Bing Zeng |
| 2025 | Towards Automated Assembly Quality Inspection with Synthetic Data and Domain Randomization. | Xiaomeng Zhu, Jacob Henningsson, Duruo Li, Pr Mrtensson, Lars Hanson, Mrten Bjrkman, Atsuto Maki |
| 2025 | BokehDiff: Neural Lens Blur with One-Step Diffusion. | Chengxuan Zhu, Qingnan Fan, Qi Zhang, Jinwei Chen, Huaqi Zhang, Chao Xu, Boxin Shi |
| 2025 | WaveMamba: Wavelet-Driven Mamba Fusion for RGB-Infrared Object Detection. | Haodong Zhu, Wenhao Dong, Linlin Yang, Hong Li, Yuguang Yang, Yangyang Ren, Qingcheng Zhu, Zichao Feng, Changbai Li, Shaohui Lin, Runqi Wang, Xiaoyan Luo, Baochang Zhang |
| 2025 | CompSlider: Compositional Slider for Disentangled Multiple-Attribute Image Generation. | Zixin Zhu, Kevin Duarte, Mamshad Nayeem Rizve, Chengyuan Xu, Ratheesh Kalarot, Junsong Yuan |
| 2025 | SegmentDreamer: Towards High-Fidelity Text-to-3D Synthesis with Segmented Consistency Trajectory Distillation. | Jiahao Zhu, Zixuan Chen, Guangcong Wang, Xiaohua Xie, Yi Zhou |
| 2025 | Separation for Better Integration: Disentangling Edge and Motion in Event-Based Deblurring. | Yufei Zhu, Hao Chen, Yongjian Deng, Wei You |
| 2025 | CMAD: Correlation-Aware and Modalities-Aware Distillation for Multimodal Sentiment Analysis with Missing Modalities. | Yan Zhuang, Minhao Liu, Wei Bai, Yanru Zhang, Xiaoyue Zhang, Jiawen Deng, Fuji Ren |
| 2025 | PossLoss: A Reliable and Sensitive Facial Landmark Detection Loss Function. | Qikui Zhu |
| 2025 | Multimodal LLMs as Customized Reward Models for Text-to-Image Generation. | Shijie Zhou, Ruiyi Zhang, Huaisheng Zhu, Branislav Kveton, Yufan Zhou, Jiuxiang Gu, Jian Chen, Changyou Chen |
| 2025 | Are They the Same? Exploring Visual Correspondence Shortcomings of Multimodal LLMs. | Yikang Zhou, Tao Zhang, Shilin Xu, Shihao Chen, Qianyu Zhou, Yunhai Tong, Shunping Ji, Jiangning Zhang, Lu Qi, Xiangtai Li |
| 2025 | PanoLlama: Generating Endless and Coherent Panoramas with Next-Token-Prediction LLMs. | Teng Zhou, Xiaoyu Zhang, Yongchuan Tang |
| 2025 | Dynamic Monitoring of Crop Canopies Using Time-Series Point Clouds: Insights into Phenotypic Variation and Leaf-Level Photosynthetic Performance. | Jiaren Zhou, Mengqi Zhang, Shulin Sun, Man Zhang, Minjuan Wang |
| 2025 | TurboTrain: Towards Efficient and Balanced Multi-Task Learning for Multi-Agent Perception and Prediction. | Zewei Zhou, Seth Z. Zhao, Tianhui Cai, Zhiyu Huang, Bolei Zhou, Jiaqi Ma |
| 2025 | M-SpecGene: Generalized Foundation Model for RGBT Multispectral Vision. | Kailai Zhou, Fuqiang Yang, Shixian Wang, Bihan Wen, Chongde Zi, Linsen Chen, Qiu Shen, Xun Cao |
| 2025 | Decoupled Diffusion Sparks Adaptive Scene Generation. | Yunsong Zhou, Naisheng Ye, William Ljungbergh, Tianyu Li, Jiazhi Yang, Zetong Yang, Hongzi Zhu, Christoffer Petersson, Hongyang Li |
| 2025 | Polarimetric Neural Field via Unified Complex-Valued Wave Representation. | Chu Zhou, Yixin Yang, Junda Liao, Heng Guo, Boxin Shi, Imari Sato |
| 2025 | UniRes: Universal Image Restoration for Complex Degradations. | Mo Zhou, Keren Ye, Mauricio Delbracio, Peyman Milanfar, Vishal M. Patel, Hossein Talebi |
| 2025 | V2XPnP: Vehicle-to-Everything Spatio-Temporal Fusion for Multi-Agent Perception and Prediction. | Zewei Zhou, Hao Xiang, Zhaoliang Zheng, Seth Z. Zhao, Mingyue Lei, Yun Zhang, Tianhui Cai, Xinyi Liu, Johnson Liu, Maheswari Bajji, Xin Xia, Zhiyu Huang, Bolei Zhou, Jiaqi Ma |
| 2025 | Adaptive Hyper-Graph Convolution Network for Skeleton-Based Human Action Recognition with Virtual Connections. | Youwei Zhou, Tianyang Xu, Cong Wu, Xiao-jun Wu, Josef Kittler |
| 2025 | Towards Effective Foundation Model Adaptation for Extreme Cross-Domain Few-Shot Learning. | Fei Zhou, Peng Wang, Lei Zhang, Wei Wei, Chen Ding, Guosheng Lin, Yanning Zhang |
| 2025 | Scale Your Instructions: Enhance the Instruction-Following Fidelity of Unified Image Generation Model by Self-Adaptive Attention Scaling. | Chao Zhou, Tianyi Wei, Nenghai Yu |
| 2025 | AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting. | Xiaoyu Zhou, Jingqi Wang, Yongtao Wang, Yufei Wei, Nan Dong, Ming-Hsuan Yang |
| 2025 | LIRA: Reasoning Reconstruction via Multimodal Large Language Models. | Zhen Zhou, Tong Wang, Yunkai Ma, Xiao Tan, Fengshui Jing |
| 2025 | TopoTTA: Topology-Enhanced Test-Time Adaptation for Tubular Structure Segmentation. | Jiale Zhou, Wenhan Wang, Shikun Li, Xiaolei Qu, Xin Guo, Yizhong Liu, Wenzhong Tang, Xun Lin, Yefeng Zheng |