| 2025 | CoSpace: Benchmarking Continuous Space Perception Ability for Vision-Language Models. | Yiqi Zhu, Ziyue Wang, Can Zhang, Peng Li, Yang Liu |
| 2025 | VoxelSplat: Dynamic Gaussian Splatting as an Effective Loss for Occupancy and Flow Prediction. | Ziyue Zhu, Shenlong Wang, Jin Xie, Jiang-jiang Liu, Jingdong Wang, Jian Yang |
| 2025 | Self-Learning Hyperspectral and Multispectral Image Fusion via Adaptive Residual Guided Subspace Diffusion Model. | Jian Zhu, He Wang, Yang Xu, Zebin Wu, Zhihui Wei |
| 2025 | Continual SFT Matches Multimodal RLHF with Negative Supervision. | Ke Zhu, Yu Wang, Yanpeng Sun, Qiang Chen, Jiangjiang Liu, Gang Zhang, Jingdong Wang |
| 2025 | FADE: Frequency-Aware Diffusion Model Factorization for Video Editing. | Yixuan Zhu, Haolin Wang, Shilin Ma, Wenliang Zhao, Yansong Tang, Lei Chen, Jie Zhou |
| 2025 | SegAgent: Exploring Pixel Understanding Capabilities in MLLMs by Imitating Human Annotator Trajectories. | Muzhi Zhu, Yuzhuo Tian, Hao Chen, Chunluan Zhou, Qingpei Guo, Yang Liu, Ming Yang, Chunhua Shen |
| 2025 | Rethinking Query-based Transformer for Continual Image Segmentation. | Yuchen Zhu, Cheng Shi, Dingyou Wang, Jiajin Tang, Zhengxuan Wei, Yu Wu, Guanbin Li, Sibei Yang |
| 2025 | Denoising Functional Maps: Diffusion Models for Shape Correspondence. | Aleksei Zhuravlev, Zorah Lhner, Vladislav Golyanik |
| 2025 | Generative Inbetweening through Frame-wise Conditions-Driven Video Generation. | Tianyi Zhu, Dongwei Ren, Qilong Wang, Xiaohe Wu, Wangmeng Zuo |
| 2025 | Rethinking End-to-End 2D to 3D Scene Segmentation in Gaussian Splatting. | Runsong Zhu, Shi Qiu, Zhengzhe Liu, Ka-Hei Hui, Qianyi Wu, Pheng-Ann Heng, Chi-Wing Fu |
| 2025 | A Simple yet Effective Layout Token in Large Language Models for Document Understanding. | Zhaoqing Zhu, Chuwei Luo, Zirui Shao, Feiyu Gao, Hangdi Xing, Qi Zheng, Ji Zhang |
| 2025 | PassionSR: Post-Training Quantization with Adaptive Scale in One-Step Diffusion based Image Super-Resolution. | Libo Zhu, Jianze Li, Haotong Qin, Wenbo Li, Yulun Zhang, Yong Guo, Xiaokang Yang |
| 2025 | Stabilizing and Accelerating Autofocus with Expert Trajectory Regularized Deep Reinforcement Learning. | Shouhang Zhu, Chenglin Li, Yuankun Jiang, Li Wei, Nuowen Kan, Ziyang Zheng, Wenrui Dai, Junni Zou, Hongkai Xiong |
| 2025 | SkySense-O: Towards Open-World Remote Sensing Interpretation with Vision-Centric Visual-Language Modeling. | Qi Zhu, Jiangwei Lao, Deyi Ji, Junwei Luo, Kang Wu, Yingying Zhang, Lixiang Ru, Jian Wang, Jingdong Chen, Ming Yang, Dong Liu, Feng Zhao |
| 2025 | FedMIA: An Effective Membership Inference Attack Exploiting "All for One" Principle in Federated Learning. | Gongxi Zhu, Donghao Li, Hanlin Gu, Yuan Yao, Lixin Fan, Yuxing Han |
| 2025 | Grounding 3D Object Affordance with Language Instructions, Visual Observations and Interactions. | He Zhu, Quyu Kong, Kechun Xu, Xunlong Xia, Bing Deng, Jieping Ye, Rong Xiong, Yue Wang |
| 2025 | IBD: Alleviating Hallucinations in Large Vision-Language Models via Image-Biased Decoding. | Lanyun Zhu, Deyi Ji, Tianrun Chen, Peng Xu, Jieping Ye, Jun Liu |
| 2025 | Revisiting Source-Free Domain Adaptation: Insights into Representativeness, Generalization, and Variety. | Ronghang Zhu, Mengxuan Hu, Weiming Zhuang, Lingjuan Lyu, Xiang Yu, Sheng Li |
| 2025 | Learning Class Prototypes for Unified Sparse-Supervised 3D Object Detection. | Yun Zhu, Le Hui, Hang Yang, Jianjun Qian, Jin Xie, Jian Yang |
| 2025 | DiG: Scalable and Efficient Diffusion Models with Gated Linear Attention. | Lianghui Zhu, Zilong Huang, Bencheng Liao, Jun Hao Liew, Hanshu Yan, Jiashi Feng, Xinggang Wang |
| 2025 | Change3D: Revisiting Change Detection and Captioning from A Video Modeling Perspective. | Duowang Zhu, Xiaohu Huang, Haiyan Huang, Hao Zhou, Zhenfeng Shao |
| 2025 | ASIGN: An Anatomy-aware Spatial Imputation Graphic Network for 3D Spatial Transcriptomics. | Junchao Zhu, Ruining Deng, Tianyuan Yao, Juming Xiong, Chongyu Qu, Junlin Guo, Siqi Lu, Mengmeng Yin, Yu Wang, Shilin Zhao, Haichun Yang, Yuankai Huo |
| 2025 | SeaLion: Semantic Part-Aware Latent Point Diffusion Models for 3D Generation. | Dekai Zhu, Yan Di, Stefan Gavranovic, Slobodan Ilic |
| 2025 | Project-Probe-Aggregate: Efficient Fine-Tuning for Group Robustness. | Beier Zhu, Jiequan Cui, Hanwang Zhang, Chi Zhang |
| 2025 | POPEN: Preference-Based Optimization and Ensemble for LVLM-Based Reasoning Segmentation. | Lanyun Zhu, Tianrun Chen, Qianxiong Xu, Xuanyi Liu, Deyi Ji, Haiyang Wu, De Wen Soh, Jun Liu |