| 2025 | I2V3D: Controllable Image-to-Video Generation with 3D Guidance. | Zhiyuan Zhang, Dongdong Chen, Jing Liao |
| 2025 | Diffusion-Based 3D Hand Motion Recovery with Intuitive Physics. | Yufei Zhang, Zijun Cui, Jeffrey O. Kephart, Qiang Ji |
| 2025 | Quantifying and Narrowing the Unknown: Interactive Text-to-Video Retrieval Via Uncertainty Minimization. | Bingqing Zhang, Zhuo Cao, Heming Du, Yang Li, Xue Li, Jiajun Liu, Sen Wang |
| 2025 | Towards Video Thinking Test: A Holistic Benchmark for Advanced Video Reasoning and Understanding. | Yuanhan Zhang, Yunice Chew, Yuhao Dong, Aria Leo, Bo Hu, Ziwei Liu |
| 2025 | Adversarial Training for Probabilistic Robustness. | Yi Zhang, Yuhang Chen, Zhen Chen, Wenjie Ruan, Xiaowei Huang, Siddartha Khastgir, Xingyu Zhao |
| 2025 | LEGO-Maker: A Semantic-Driven Algorithm for Text-to-3D Generation. | Yifei Zhang, Lei Chen |
| 2025 | Focal Plane Visual Feature Generation and Matching on a Pixel Processor Array. | Hongyi Zhang, Laurie Bose, Jianing Chen, Piotr Dudek, Walterio W. Mayol-Cuevas |
| 2025 | The Escalator Problem: Identifying Implicit Motion Blindness in AI for Accessibility. | Xiantao Zhang |
| 2025 | Preservation vs. Fabrication: An Ethical Framework of Consent, Transparency, and Integrity for Posthumous AI Art. | Xiantao Zhang |
| 2025 | Implicit Counterfactual Learning for Audio-Visual Segmentation. | Mingfeng Zha, Tianyu Li, Guoyin Wang, Peng Wang, Yangyang Wu, Yang Yang, Heng Tao Shen |
| 2025 | Text2Outfit: Controllable Outfit Generation With Multimodal Language Models. | Yuanhao Zhai, Yen-Liang Lin, Minxu Peng, Larry S. Davis, Ashwin Chandramouli, Junsong Yuan, David S. Doermann |
| 2025 | Efficient Input-Level Backdoor Defense on Text-to-Image Synthesis via Neuron Activation Variation. | Shengfang Zhai, Jiajun Li, Yue Liu, Huanran Chen, Zhihua Tian, Wenjie Qu, Qingni Shen, Ruoxi Jia, Yinpeng Dong, Jiaheng Zhang |
| 2025 | YOLO-Count: Differentiable Object Counting for Text-to-Image Generation. | Guanning Zeng, Xiang Zhang, Zirui Wang, Haiyang Xu, Zeyuan Chen, Bingnan Li, Zhuowen Tu |
| 2025 | GaussianUpdate: Continual 3D Gaussian Splatting Update for Changing Environments. | Lin Zeng, Boming Zhao, Jiarui Hu, Xujie Shen, Ziqiang Dang, Hujun Bao, Zhaopeng Cui |
| 2025 | AVAM: A Universal Training-Free Adaptive Visual Anchoring Embedded into Multimodal Large Language Model for Multi-Image Question Answering. | Kang Zeng, Guojin Zhong, Jintao Cheng, Jin Yuan, Zhiyong Li |
| 2025 | From Objects to Events: Unlocking Complex Visual Understanding in Object Detectors Via LLM-guided Symbolic Reasoning. | Yuhui Zeng, Haoxiang Wu, Wenjie Nie, Guangyao Chen, Xiawu Zheng, Yunhang Shen, Jun Peng, Yonghong Tian, Rongrong Ji |
| 2025 | Instant Gaussianimage: A Generalizable and Self-Adaptive Image Representation via 2D Gaussian Splatting. | Zhaojie Zeng, Yuesong Wang, Tao Guan, Chao Yang, Lili Ju |
| 2025 | Agreement Aware and Dissimilarity Oriented GLOM. | Ru Zeng, Yan Song, Yang Zhang, Yanling Hu, Hui Yu |
| 2025 | OVG-HQ: Online Video Grounding with Hybrid-Modal Queries. | Runhao Zeng, Jiaqi Mao, Minghao Lai, Minh Hieu Phan, Yanjie Dong, Wei Wang, Qi Chen, Xiping Hu |
| 2025 | An Efficient Hybrid Vision Transformer for Tinyml Applications. | Fanhong Zeng, Huanan Li, Juntao Guan, Rui Fan, Tong Wu, Xilong Wang, Rui Lai |
| 2025 | DisTime: Distribution-Based Time Representation for Video Large Language Models. | Yingsen Zeng, Zepeng Huang, Yujie Zhong, Chengjian Feng, Jie Hu, Lin Ma, Yang Liu |
| 2025 | Skip-Vision: Efficient and Scalable Acceleration of Vision-Language Models Via Adaptive Token Skipping. | Weili Zeng, Ziyuan Huang, Kaixiang Ji, Yichao Yan |
| 2025 | Visual-Oriented Fine-Grained Knowledge Editing for MultiModal Large Language Models. | Zhen Zeng, Leijiang Gu, Xun Yang, Zhangling Duan, Zenglin Shi, Meng Wang |
| 2025 | Factorized Learning for Temporally Grounded Video-Language Models. | Wenzheng Zeng, Difei Gao, Mike Zheng Shou, Hwee Tou Ng |
| 2025 | Syncalize - Precise Automatic Timecodes for Video and Audio Devices Using Consumer Hardware. | Oliver Zendel, Matthias Schrghuber, Clemens Hofbauer |