| 2025 | Trade-Offs in Image Generation: How Do Different Dimensions Interact? | Sicheng Zhang, Binzhu Xie, Zhonghao Yan, Yuli Zhang, Donghao Zhou, Xiaofei Chen, Shi Qiu, Jiaqi Liu, Guoyang Xie, Zhichao Lu |
| 2025 | Gaussian Variation Field Diffusion for High-Fidelity Video-to-4D Synthesis. | Bowen Zhang, Sicheng Xu, Chuxin Wang, Jiaolong Yang, Feng Zhao, Dong Chen, Baining Guo |
| 2025 | RoBridge: A Hierarchical Architecture Bridging Cognition and Execution for General Robotic Manipulation. | Kaidong Zhang, Rongtao Xu, Pengzhen Ren, Junfan Lin, Hefeng Wu, Liang Lin, Xiaodan Liang |
| 2025 | VLABench: A Large-Scale Benchmark for Language-Conditioned Robotics Manipulation with Long-Horizon Reasoning Tasks. | Shiduo Zhang, Zhe Xu, Peiju Liu, Xiaopeng Yu, Yuan Li, Qinghui Gao, Zhaoye Fei, Zhangyue Yin, Zuxuan Wu, Yu-Gang Jiang, Xipeng Qiu |
| 2025 | SpatialCrafter: Unleashing the Imagination of Video Diffusion Models for Scene Reconstruction from Limited Observations. | Songchun Zhang, Huiyao Xu, Sitong Guo, Zhongwei Xie, Hujun Bao, Weiwei Xu, Changqing Zou |
| 2025 | PhysRig: Differentiable Physics-Based Skinning and Rigging Framework for Realistic Articulated Object Modeling. | Hao Zhang, Haolan Xu, Chun Feng, Varun Jampani, Narendra Ahuja |
| 2025 | E-SAM: Training-Free Segment Every Entity Model. | Weiming Zhang, Dingwen Xiao, Lei Chen, Lin Wang |
| 2025 | VRM: Knowledge Distillation via Virtual Relation Matching. | Weijia Zhang, Fei Xie, Tom Weidong Cai, Chao Ma |
| 2025 | FreeCus: Free Lunch Subject-Driven Customization in Diffusion Transformers. | Yanbing Zhang, Zhe Wang, Qin Zhou, Mengping Yang |
| 2025 | Overcoming Dual Drift for Continual Long-Tailed Visual Question Answering. | Feifei Zhang, Zhihao Wang, Xi Zhang, Changsheng Xu |
| 2025 | UPRE: Zero-Shot Domain Adaptation for Object Detection via Unified Prompt and Representation Enhancement. | Xiao Zhang, Fei Wei, Yong Wang, Wenda Zhao, Feiyi Li, Xiangxiang Chu |
| 2025 | Adaptive Articulated Object Manipulation on the Fly with Foundation Model Reasoning and Part Grounding. | Xiaojie Zhang, Yuanfei Wang, Ruihai Wu, Kunqi Xu, Yu Li, Liuyu Xiang, Hao Dong, Zhaofeng He |
| 2025 | GenDoP: Auto-regressive Camera Trajectory Generation as a Director of Photography. | Mengchen Zhang, Tong Wu, Jing Tan, Ziwei Liu, Gordon Wetzstein, Dahua Lin |
| 2025 | Flash-Vstream: Efficient Real-Time Understanding for Long Video Streams. | Haoji Zhang, Yiqin Wang, Yansong Tang, Yong Liu, Jiashi Feng, Xiaojie Jin |
| 2025 | An Information-Theoretic Regularizer for Lossy Neural Image Compression. | Yingwen Zhang, Meng Wang, Xihua Sheng, Peilin Chen, Junru Li, Li Zhang, Shiqi Wang |
| 2025 | Towards Adversarial Robustness via Debiased High-Confidence Logit Alignment. | Kejia Zhang, Juanjuan Weng, Shaozi Li, Zhiming Luo |
| 2025 | Beyond Low-Rank Tuning: Model Prior-Guided Rank Allocation for Effective Transfer in Low-Data and Large-Gap Regimes. | Chuyan Zhang, Kefan Wang, Yun Gu |
| 2025 | Improving Viewpoint Consistency in 3D Generation via Structure Feature and CLIP Guidance. | Qing Zhang, Jinguang Tong, Jing Zhang, Jie Hong, Xuesong Li |
| 2025 | Epona: Autoregressive Diffusion World Model for Autonomous Driving. | Kaiwen Zhang, Zhenyu Tang, Xiaotao Hu, Xingang Pan, Xiaoyang Guo, Yuan Liu, Jingwei Huang, Li Yuan, Qian Zhang, Xiao-Xiao Long, Xun Cao, Wei Yin |
| 2025 | Low-Rank Prompt Adaptation for Open-Vocabulary Object Detection. | Zekun Zhang, Vu Quang Truong, Minh Hoai |
| 2025 | Rethinking Key-Frame-Based Micro-Expression Recognition: a Robust and Accurate Framework Against Key-Frame Errors. | Zheyuan Zhang, Weihao Tang, Hong Chen |
| 2025 | Dual-S3D: Hierarchical Dual-Path Selective SSM-CNN for High-Fidelity Implicit Reconstruction. | Luoxi Zhang, Pragyan Shrestha, Yu Zhou, Chun Xie, Itaru Kitahara |
| 2025 | Adaptive Prompt Learning via Gaussian Outlier Synthesis for Out-Of-Distribution Detection. | Yongkang Zhang, Dongyu She, Zhong Zhou |
| 2025 | DiTFastAttnV2: Head-Wise Attention Compression for Multi-Modality Diffusion Transformers. | Hanling Zhang, Rundong Su, Zhihang Yuan, Pengtao Chen, Mingzhu Shen, Yibo Fan, Shengen Yan, Guohao Dai, Yu Wang |
| 2025 | FedAGC: Federated Continual Learning with Asymmetric Gradient Correction. | Chengchao Zhang, Fanhua Shang, Hongyin Liu, Liang Wan, Wei Feng |