| 2025 | STD-GS: Exploring Frame-Event Interaction for SpatioTemporal-Disentangled Gaussian Splatting to Reconstruct High-Dynamic Scene. | Hanyu Zhou, Haonan Wang, Haoyue Liu, Yuxing Duan, Luxin Yan, Gim Hee Lee |
| 2025 | The Devil Is in the Spurious Correlations: Boosting Moment Retrieval With Dynamic Learning. | Xinyang Zhou, Fanyue Wei, Lixin Duan, Angela Yao, Wen Li |
| 2025 | VLM4D: Towards Spatiotemporal Awareness in Vision Language Models. | Shijie Zhou, Alexander Vilesov, Xuehai He, Ziyu Wan, Shuwang Zhang, Aditya Nagachandra, Di Chang, Dongdong Chen, Xin Eric Wang, Achuta Kadambi |
| 2025 | Where, What, Why: Towards Explainable Driver Attention Prediction. | Yuchen Zhou, Jiayu Tang, Xiaoyan Xiao, Yueyao Lin, Linkai Liu, Zipeng Guo, Hao Fei, Xiaobo Xia, Chao Gou |
| 2025 | Task-Decoupled Bzier Surface Constraint for Uneven Low-Light Image Enhancement. | Xingxiang Zhou, Xiangdong Su, Haoran Zhang, Wei Chen, Guanglai Gao |
| 2025 | Golden Noise for Diffusion Models: A Learning Framework. | Zikai Zhou, Shitong Shao, Lichen Bai, Shufei Zhang, Zhiqiang Xu, Bo Han, Zeke Xie |
| 2025 | HyPiDecoder: Hybrid Pixel Decoder for Efficient Segmentation and Detection. | Fengzhe Zhou, Humphrey Shi |
| 2025 | Strefer: Empowering Video LLMs with Space-Time Referring and Reasoning via Synthetic Instruction Data. | Honglu Zhou, Xiangyu Peng, Shrikant Kendre, Michael S. Ryoo, Silvio Savarese, Caiming Xiong, Juan Carlos Niebles |
| 2025 | Rethinking Detecting Salient and Camouflaged Objects in Unconstrained Scenes. | Zhangjun Zhou, Yiping Li, Chunlin Zhong, Jianuo Huang, Jialun Pei, Hua Li, He Tang |
| 2025 | DreamRenderer: Taming Multi-Instance Attribute Control in Large-Scale Text-to-Image Models. | Dewei Zhou, Mingwei Li, Zongxin Yang, Yi Yang |
| 2025 | Aigi-Holmes: Towards Explainable and Generalizable AI-Generated Image Detection via Multimodal Large Language Models. | Ziyin Zhou, Yunpeng Luo, Yuanchen Wu, Ke Sun, Jiayi Ji, Ke Yan, Shouhong Ding, Xiaoshuai Sun, Yunsheng Wu, Rongrong Ji |
| 2025 | HERMES: A Unified Self-Driving World Model for Simultaneous 3D Scene Understanding and Generation. | Xin Zhou, Dingkang Liang, Sifan Tu, Xiwu Chen, Yikang Ding, Dingyuan Zhang, Feiyang Tan, Hengshuang Zhao, Xiang Bai |
| 2025 | Leveraging Spatial Invariance to Boost Adversarial Transferability. | Zihan Zhou, Li Li, Yanli Ren, Chuan Qin, Guorui Feng |
| 2025 | Devil is in the Uniformity: Exploring Diverse Learners Within Transformer for Image Restoration. | Shihao Zhou, Dayu Li, Jinshan Pan, Juncheng Zhou, Jinglei Shi, Jufeng Yang |
| 2025 | External Knowledge Injection for CLIP-Based Class-Incremental Learning. | Da-Wei Zhou, Kai-Wen Li, Jingyi Ning, Han-Jia Ye, Lijun Zhang, De-Chuan Zhan |
| 2025 | When Pixel Difference Patterns Meet ViT: PiDiViT for Few-Shot Object Detection. | Hongliang Zhou, Yongxiang Liu, Canyu Mo, Weijie Li, Bowen Peng, Li Liu |
| 2025 | Learnable Retrieval Enhanced Visual-Text Alignment and Fusion for Radiology Report Generation. | Qin Zhou, Guoyan Liang, Xindi Li, Jingyuan Chen, Zhe Wang, Chang Yao, Sai Wu |
| 2025 | LLaFEA: Frame-Event Complementary Fusion for Fine-Grained Spatiotemporal Understanding in LMMs. | Hanyu Zhou, Gim Hee Lee |
| 2025 | SAME: Learning Generic Language-Guided Visual Navigation with State-Adaptive Mixture of Experts. | Gengze Zhou, Yicong Hong, Zun Wang, Chongyang Zhao, Mohit Bansal, Qi Wu |
| 2025 | OV3D-CG: Open-Vocabulary 3D Instance Segmentation with Contextual Guidance. | Mingquan Zhou, Chen He, Ruiping Wang, Xilin Chen |
| 2025 | MGSR: 2D/3D Mutual-boosted Gaussian Splatting for High-fidelity Surface Reconstruction Under Various Light Conditions. | Qingyuan Zhou, Yuehu Gong, Weidong Yang, Jiaze Li, Yeqi Luo, Baixin Xu, Shuhao Li, Ben Fei, Ying He |
| 2025 | Monomobility: Zero-Shot 3D Mobility Analysis From Monocular Videos. | Hongyi Zhou, Yulan Guo, Xiaogang Wang, Kai Xu |
| 2025 | Stable Virtual Camera: Generative View Synthesis with Diffusion Models. | Jensen Zhou, Hang Gao, Vikram Voleti, Aaryaman Vasishta, Chun-Han Yao, Mark Boss, Philip Torr, Christian Rupprecht, Varun Jampani |
| 2025 | Hints of Prompt: Enhancing Visual Representation for Multimodal LLMs in Autonomous Driving. | Hao Zhou, Zhanning Gao, Zhili Chen, Maosheng Ye, Qifeng Chen, Tongyi Cao, Honggang Qi |
| 2025 | Event-Based Visual Vibrometry. | Xinyu Zhou, Peiqi Duan, Yeliduosi Xiaokaiti, Chao Xu, Boxin Shi |