| 2025 | TAR3D: Creating High-Quality 3D Assets Via Next-Part Prediction. | Xuying Zhang, Yutong Liu, Yangguang Li, Renrui Zhang, Yufei Liu, Kai Wang, Wanli Ouyang, Zhiwei Xiong, Peng Gao, Qibin Hou, Ming-Ming Cheng |
| 2025 | GUAVA: Generalizable Upper Body 3D Gaussian Avatar. | Dongbin Zhang, Yunfei Liu, Lijian Lin, Ye Zhu, Yang Li, Minghan Qin, Yu Li, Haoqian Wang |
| 2025 | Towards Comprehensive Lecture Slides Understanding: Large-Scale Dataset and Effective Method. | Enming Zhang, Yuzhe Li, Yuliang Liu, Yingying Zhu, Xiang Bai |
| 2025 | Scaling Omni-Modal Pretraining with Multimodal Context: Advancing Universal Representation Learning Across Modalities. | Yiyuan Zhang, Handong Li, Jing Liu, Xiangyu Yue |
| 2025 | EGVD: Event-Guided Video Diffusion Model for Physically Realistic Large-Motion Frame Interpolation. | Ziran Zhang, Xiaohui Li, Yihao Liu, Yujin Wang, Yueting Chen, Tianfan Xue, Shi Guo |
| 2025 | StableCodec: Taming One-Step Diffusion for Extreme Image Compression. | Tianyu Zhang, Xin Luo, Li Li, Dong Liu |
| 2025 | Hybrid-Grained Feature Aggregation with Coarse-to-Fine Language Guidance for Self-Supervised Monocular Depth Estimation. | Wenyao Zhang, Hongsi Liu, Bohan Li, Jiawei He, Zekun Qi, Yunnan Wang, Shengyang Zhao, Xinqiang Yu, Wenjun Zeng, Xin Jin |
| 2025 | CWNet: Causal Wavelet Network for Low-Light Image Enhancement. | Tongshun Zhang, Pingping Liu, Yubing Lu, Mengen Cai, Zijian Zhang, Zhe Zhang, Qiuzhan Zhou |
| 2025 | Layer-Wise Vision Injection With Disentangled Attention for Efficient LVLMs. | Xuange Zhang, Dengjie Li, Bo Liu, Zenghao Bao, Yao Zhou, Baisong Yang, Zhongying Liu, Yujie Zhong, Tongtong Yuan |
| 2025 | SemiVisBooster: Boosting Semi-Supervised Learning for Fine-Grained Classification through Pseudo-Label Semantic Guidance. | Wenjin Zhang, Xinyu Li, Chenyang Gao, Ivan Marsic |
| 2025 | PolarAnything: Diffusion-based Polarimetric Image Synthesis. | Kailong Zhang, Youwei Lyu, Heng Guo, Si Li, Zhanyu Ma, Boxin Shi |
| 2025 | KinMo: Kinematic-Aware Human Motion Understanding and Generation. | Pengfei Zhang, Pinxin Liu, Pablo Garrido, Hyeongwoo Kim, Bindita Chaudhuri |
| 2025 | Weakly Supervised Visible-Infrared Person Re-Identification via Heterogeneous Expert Collaborative Consistency Learning. | Yafei Zhang, Lingqi Kong, Huafeng Li, Jie Wen |
| 2025 | Tracking Tiny Drones Against Clutter: Large-Scale Infrared Benchmark with Motion-Centric Adaptive Algorithm. | Jiahao Zhang, Zongli Jiang, Jinli Zhang, Yixin Wei, Liang Li, Yizheng Wang, Gang Wang |
| 2025 | DiffPCI: Large Motion Point Cloud Frame Interpolation with Diffusion Model. | Tianyu Zhang, Haobo Jiang, Jian Yang, Jin Xie |
| 2025 | Detect Anything 3D in the Wild. | Hanxue Zhang, Haoran Jiang, Qingsong Yao, Yanan Sun, Renrui Zhang, Hao Zhao, Hongyang Li, Hongzi Zhu, Zetong Yang |
| 2025 | Learning Beyond Still Frames: Scaling Vision-Language Models with Video. | Yiyuan Zhang, Handong Jing, Jing Liu, Xiangyu Yue |
| 2025 | Environment-Agnostic Pose: Generating Environment-Independent Object Representations for 6D Pose Estimation. | Shaobo Zhang, Yuhang Huang, Wanqing Zhao, Wei Zhao, Ziyu Guan, Jinye Peng |
| 2025 | SU-RGS: Relightable 3D Gaussian Splatting from Sparse Views Under Unconstrained Illuminations. | Qi Zhang, Chi Huang, Qian Zhang, Nan Li, Wei Feng |
| 2025 | R1-VL: Learning to Reason with Multimodal Large Language Models via Step-Wise Group Relative Policy Optimization. | Jingyi Zhang, Jiaxing Huang, Huanjin Yao, Shunyu Liu, Xikun Zhang, Shijian Lu, Dacheng Tao |
| 2025 | Enhancing the Reliability of Auto-Prompting SAM for Medical Image Segmentation with Uncertainty Estimation and Rectification. | Yichi Zhang, Shiyao Hu, Le Xue, Sijie Ren, Zixin Hu, Yuan Cheng, Yuan Qi |
| 2025 | CreatiLayout: Siamese Multimodal Diffusion Transformer for Creative Layout-to-Image Generation. | Hui Zhang, Dexiang Hong, Yitong Wang, Jie Shao, Xinglong Wu, Zuxuan Wu, Yu-Gang Jiang |
| 2025 | Learning Implicit Features with Flow-Infused Transformations for Realistic Virtual Try-On. | Delong Zhang, Qiwei Huang, Yang Sun, Yuanliu Liu, Wei-Shi Zheng, Pengfei Xiong, Wei Zhang |
| 2025 | Progressive Test Time Energy Adaptation for Medical Image Segmentation. | Xiaoran Zhang, Byung-Woo Hong, Hyoungseob Park, Daniel H. Pak, Anne-Marie Rickmann, Lawrence H. Staib, James S. Duncan, Alex Wong |
| 2025 | Quadratic Gaussian Splatting: High Quality Surface Reconstruction with Second-Order Geometric Primitives. | Ziyu Zhang, Binbin Huang, Hanqing Jiang, Liyang Zhou, Xiaojun Xiang, Shuhan Shen |