| 2024 | Labeled Data Selection for Category Discovery. | Bingchen Zhao, Nico Lang, Serge J. Belongie, Oisin Mac Aodha |
| 2024 | UDiffText: A Unified Framework for High-Quality Text Synthesis in Arbitrary Images via Character-Aware Diffusion Models. | Yiming Zhao, Zhouhui Lian |
| 2024 | Bridging Different Language Models and Generative Vision Models for Text-to-Image Generation. | Shihao Zhao, Shaozhe Hao, Bojia Zi, Huaizhe Xu, Kwan-Yee K. Wong |
| 2024 | Open-Vocabulary RGB-Thermal Semantic Segmentation. | Guoqiang Zhao, Junjie Huang, Xiaoyun Yan, Zhaojing Wang, Junwei Tang, Yangjun Ou, Xinrong Hu, Tao Peng |
| 2024 | MotionDirector: Motion Customization of Text-to-Video Diffusion Models. | Rui Zhao, Yuchao Gu, Jay Zhangjie Wu, David Junhao Zhang, Jia-Wei Liu, Weijia Wu, Jussi Keppo, Mike Zheng Shou |
| 2024 | Lost in Translation: Latent Concept Misalignment in Text-to-Image Diffusion Models. | Juntu Zhao, Junyu Deng, Yixin Ye, Chongxuan Li, Zhijie Deng, Dequan Wang |
| 2024 | Loop Mining Large-Scale Unlabeled Data for Corner Case Detection in Autonomous Driving. | Jiawei Zhao, Yiting Duan, Jinming Su, Wangwang Yang, Tingyi Guo, Xingyue Chen, Junfeng Luo |
| 2024 | LTRL: Boosting Long-Tail Recognition via Reflective Learning. | Qihao Zhao, Yalun Dai, Shen Lin, Wei Hu, Fan Zhang, Jun Liu |
| 2024 | See and Think: Embodied Agent in Virtual Environment. | Zhonghan Zhao, Wenhao Chai, Xuan Wang, Boyi Li, Shengyu Hao, Shidong Cao, Tian Ye, Gaoang Wang |
| 2024 | CipherDM: Secure Three-Party Inference for Diffusion Model Sampling. | Xin Zhao, Xiaojun Chen, Xudong Chen, He Li, Tingyu Fan, Zhendong Zhao |
| 2024 | AnomalyFactory: Regard Anomaly Generation as Unsupervised Anomaly Localization. | Ying Zhao |
| 2024 | Griffon: Spelling Out All Object Locations at Any Granularity with Large Language Models. | Yufei Zhan, Yousong Zhu, Zhiyang Chen, Fan Yang, Ming Tang, Jinqiao Wang |
| 2024 | KFD-NeRF: Rethinking Dynamic NeRF with Kalman Filter. | Yifan Zhan, Zhuoxiao Li, Muyao Niu, Zhihang Zhong, Shohei Nobuhara, Ko Nishino, Yinqiang Zheng |
| 2024 | CSOT: Cross-scan Object Transfer for Semi-Supervised LiDAR Object Detection. | Jinglin Zhan, Tiejun Liu, Rengang Li, Zhaoxiang Zhang, Yuntao Chen |
| 2024 | Approaching Outside: Scaling Unsupervised 3D Object Detection from 2D Scene. | Ruiyang Zhang, Hu Zhang, Hang Yu, Zhedong Zheng |
| 2024 | HiT-SR: Hierarchical Transformer for Efficient Image Super-Resolution. | Xiang Zhang, Yulun Zhang, Fisher Yu |
| 2024 | Training A Small Emotional Vision Language Model for Visual Art Comprehension. | Jing Zhang, Liang Zheng, Meng Wang, Dan Guo |
| 2024 | Correspondence-Free SE(3) Point Cloud Registration in RKHS via Unsupervised Equivariant Learning. | Ray Zhang, Zheming Zhou, Min Sun, Omid Ghasemalizadeh, Cheng-Hao Kuo, Ryan M. Eustice, Maani Ghaffari, Arnie Sen |
| 2024 | Learning Camouflaged Object Detection from Noisy Pseudo Label. | Jin Zhang, Ruiheng Zhang, Yanjiao Shi, Zhe Cao, Nian Liu, Fahad Shahbaz Khan |
| 2024 | Generalizable Facial Expression Recognition. | Yuhang Zhang, Xiuqi Zheng, Chenyi Liang, Jiani Hu, Weihong Deng |
| 2024 | Binomial Self-Compensation for Motion Error in Dynamic 3D Scanning. | Geyou Zhang, Ce Zhu, Kai Liu |
| 2024 | When Pedestrian Detection Meets Multi-modal Learning: Generalist Model and Benchmark Dataset. | Yi Zhang, Wang Zeng, Sheng Jin, Chen Qian, Ping Luo, Wentao Liu |
| 2024 | LAPT: Label-Driven Automated Prompt Tuning for OOD Detection with Vision-Language Models. | Yabin Zhang, Wenjie Zhu, Chenhang He, Lei Zhang |
| 2024 | Long-CLIP: Unlocking the Long-Text Capability of CLIP. | Beichen Zhang, Pan Zhang, Xiaoyi Dong, Yuhang Zang, Jiaqi Wang |
| 2024 | Online Vectorized HD Map Construction Using Geometry. | Zhixin Zhang, Yiyuan Zhang, Xiaohan Ding, Fusheng Jin, Xiangyu Yue |