| 2024 | An Investigation on The Position Encoding in Vision-Based Dynamics Prediction. | Jiageng Zhu, Hanchen Xie, Jiazhi Li, Mahyar Khayatkhoei, Wael AbdAlmageed |
| 2024 | RPBG: Towards Robust Neural Point-Based Graphics in the Wild. | Qingtian Zhu, Zizhuang Wei, Zhongtian Zheng, Yifan Zhan, Zhuyu Yao, Jiawang Zhang, Kejian Wu, Yinqiang Zheng |
| 2024 | ScanReason: Empowering 3D Visual Grounding with Reasoning Capabilities. | Chenming Zhu, Tai Wang, Wenwei Zhang, Kai Chen, Xihui Liu |
| 2024 | nuCraft: Crafting High Resolution 3D Semantic Occupancy for Unified 3D Scene Understanding. | Benjin Zhu, Zhe Wang, Hongsheng Li |
| 2024 | Deep Companion Learning: Enhancing Generalization Through Historical Consistency. | Ruizhao Zhu, Saligrama R. Venkatesh |
| 2024 | AVSal: Enhancing Video Saliency Prediction Through Audio-Visual Fusion and Temporal Aggregation. | Yuxin Zhu, Yinan Sun, Huiyu Duan, Yuqin Cao, Ziheng Jia, Qiang Hu, Xiongkuo Min, Guangtao Zhai |
| 2024 | RoScenes: A Large-Scale Multi-view 3D Dataset for Roadside Perception. | Xiaosu Zhu, Hualian Sheng, Sijia Cai, Bing Deng, Shaopeng Yang, Qiao Liang, Ken Chen, Lianli Gao, Jingkuan Song, Jieping Ye |
| 2024 | PCF-Lift: Panoptic Lifting by Probabilistic Contrastive Fusion. | Runsong Zhu, Shi Qiu, Qianyi Wu, Ka-Hei Hui, Pheng-Ann Heng, Chi-Wing Fu |
| 2024 | VividDreamer: Invariant Score Distillation for Hyper-Realistic Text-to-3D Generation. | Wenjie Zhuo, Fan Ma, Hehe Fan, Yi Yang |
| 2024 | SlimFlow: Training Smaller One-Step Diffusion Models with Rectified Flow. | Yuanzhi Zhu, Xingchao Liu, Qiang Liu |
| 2024 | Visual Text Generation in the Wild. | Yuanzhi Zhu, Jiawei Liu, Feiyu Gao, Wenyu Liu, Xinggang Wang, Peng Wang, Fei Huang, Cong Yao, Zhibo Yang |
| 2024 | Revisit Self-supervised Depth Estimation with Local Structure-from-Motion. | Shengjie Zhu, Xiaoming Liu |
| 2024 | Reshaping the Online Data Buffering and Organizing Mechanism for Continual Test-Time Adaptation. | Zhilin Zhu, Xiaopeng Hong, Zhiheng Ma, Weijun Zhuang, Yaohui Ma, Yong Dai, Yaowei Wang |
| 2024 | ELSE: Efficient Deep Neural Network Inference Through Line-Based Sparsity Exploration. | Zeqi Zhu, Alberto Garca-Ortiz, Luc Waeijen, Egor Bondarev, Arash Pourtaherian, Orlando Moreira |
| 2024 | RePLAy: Remove Projective LiDAR Depthmap Artifacts via Exploiting Epipolar Geometry. | Shengjie Zhu, Girish Chandar Ganesan, Abhinav Kumar, Xiaoming Liu |
| 2024 | Anytime Continual Learning for Open Vocabulary Classification. | Zhen Zhu, Yiming Gong, Derek Hoiem |
| 2024 | Rectify the Regression Bias in Long-Tailed Object Detection. | Ke Zhu, Minghao Fu, Jie Shao, Tianyu Liu, Jianxin Wu |
| 2024 | FSGS: Real-Time Few-Shot View Synthesis Using Gaussian Splatting. | Zehao Zhu, Zhiwen Fan, Yifan Jiang, Zhangyang Wang |
| 2024 | Video Editing for Video Retrieval. | Bin Zhu, Kevin Flanagan, Adriano Fragomeni, Michael Wray, Dima Damen |
| 2024 | Exploring Pre-trained Text-to-Video Diffusion Models for Referring Video Object Segmentation. | Zixin Zhu, Xuelu Feng, Dongdong Chen, Junsong Yuan, Chunming Qiao, Gang Hua |
| 2024 | CaesarNeRF: Calibrated Semantic Representation for Few-Shot Generalizable Neural Rendering. | Haidong Zhu, Tianyu Ding, Tianyi Chen, Ilya Zharkov, Ram Nevatia, Luming Liang |
| 2024 | LogoSticker: Inserting Logos Into Diffusion Models for Customized Generation. | Mingkang Zhu, Xi Chen, Zhongdao Wang, Hengshuang Zhao, Jiaya Jia |
| 2024 | DGR-MIL: Exploring Diverse Global Representation in Multiple Instance Learning for Whole Slide Image Classification. | Wenhui Zhu, Xiwen Chen, Peijie Qiu, Aristeidis Sotiras, Abolfazl Razi, Yalin Wang |
| 2024 | Champ: Controllable and Consistent Human Image Animation with 3D Parametric Guidance. | Shenhao Zhu, Junming Leo Chen, Zuozhuo Dai, Zilong Dong, Yinghui Xu, Xun Cao, Yao Yao, Hao Zhu, Siyu Zhu |
| 2024 | A Task Is Worth One Word: Learning with Task Prompts for High-Quality Versatile Image Inpainting. | Junhao Zhuang, Yanhong Zeng, Wenran Liu, Chun Yuan, Kai Chen |