| 2023 | PEANUT: Predicting and Navigating to Unseen Targets. | Albert J. Zhai, Shenlong Wang |
| 2023 | Stabilizing Visual Reinforcement Learning via Asymmetric Interactive Cooperation. | Yunpeng Zhai, Peixi Peng, Yifan Zhao, Yangru Huang, Yonghong Tian |
| 2023 | HopFIR: Hop-wise GraphFormer with Intragroup Joint Refinement for 3D Human Pose Estimation. | Kai Zhai, Qiang Nie, Bo Ouyang, Xiang Li, Shanlin Yang |
| 2023 | Sigmoid Loss for Language Image Pre-Training. | Xiaohua Zhai, Basil Mustafa, Alexander Kolesnikov, Lucas Beyer |
| 2023 | Masked Autoencoders are Efficient Class Incremental Learners. | Jiang-Tian Zhai, Xialei Liu, Andrew D. Bagdanov, Ke Li, Ming-Ming Cheng |
| 2023 | Parameterized Cost Volume for Stereo Matching. | Jiaxi Zeng, Chengtang Yao, Lidong Yu, Yuwei Wu, Yunde Jia |
| 2023 | Global Balanced Experts for Federated Long-Tailed Learning. | Yaopei Zeng, Lei Liu, Li Liu, Li Shen, Shaoguo Liu, Baoyuan Wu |
| 2023 | MPCViT: Searching for Accurate and Efficient MPC-Friendly Vision Transformer with Heterogeneous Attention. | Wenxuan Zeng, Meng Li, Wenjie Xiong, Tong Tong, Wen-Jie Lu, Jin Tan, Runsheng Wang, Ru Huang |
| 2023 | Stochastic Segmentation with Conditional Categorical Diffusion Models. | Lukas Zbinden, Lars Doorenbos, Theodoros Pissas, Adrian Thomas Huber, Raphael Sznitman, Pablo Mrquez-Neila |
| 2023 | The Unreasonable Effectiveness of Large Language-Vision Models for Source-free Video Domain Adaptation. | Giacomo Zara, Alessandro Conti, Subhankar Roy, Stphane Lathuilire, Paolo Rota, Elisa Ricci |
| 2023 | Boosting Novel Category Discovery Over Domains with Soft Contrastive Learning and All in One Classifier. | Zelin Zang, Lei Shang, Senqiao Yang, Fei Wang, Baigui Sun, Xuansong Xie, Stan Z. Li |
| 2023 | GLA-GCN: Global-local Adaptive Graph Convolutional Network for 3D Human Pose Estimation from Monocular Video. | Bruce X. B. Yu, Zhi Zhang, Yongxu Liu, Sheng-Hua Zhong, Yan Liu, Chang Wen Chen |
| 2023 | Talking Head Generation with Probabilistic Audio-to-Visual Diffusion Priors. | Zhentao Yu, Zixin Yin, Deyu Zhou, Duomin Wang, Finn Wong, Baoyuan Wang |
| 2023 | FreeDoM: Training-Free Energy-Guided Conditional Diffusion Model. | Jiwen Yu, Yinhuai Wang, Chen Zhao, Bernard Ghanem, Jian Zhang |
| 2023 | LaPE: Layer-adaptive Position Embedding for Vision Transformers with Independent Layer Normalization. | Runyi Yu, Zhennan Wang, Yinhuai Wang, Kehan Li, Chang Liu, Haoyi Duan, Xiangyang Ji, Jie Chen |
| 2023 | Chinese Text Recognition with A Pre-Trained CLIP-Like Model Through Image-IDS Aligning. | Haiyang Yu, Xiaocong Wang, Bin Li, Xiangyang Xue |
| 2023 | Aggregating Feature Point Cloud for Depth Completion. | Zhu Yu, Zehua Sheng, Zili Zhou, Lun Luo, Si-Yuan Cao, Hong Gu, Huaqi Zhang, Hui-Liang Shen |
| 2023 | Enhancing Non-line-of-sight Imaging via Learnable Inverse Kernel and Attention Mechanisms. | Yanhua Yu, Siyuan Shen, Zi Wang, Binbin Huang, Yuehan Wang, Xingyue Peng, Suan Xia, Ping Liu, Ruiqian Li, Shiying Li |
| 2023 | HAL3D: Hierarchical Active Learning for Fine-Grained 3D Part Labeling. | Fenggen Yu, Yiming Qian, Francisca Gil-Ureta, Brian Jackson, Eric P. Bennett, Hao Zhang |
| 2023 | Bidirectionally Deformable Motion Modulation For Video-based Human Pose Transfer. | Wing Yin Yu, Lai-Man Po, Ray C. C. Cheung, Yuzhi Zhao, Yu Xue, Kun Li |
| 2023 | SPANet: Frequency-balancing Token Mixer using Spectral Pooling Aggregation Modulation. | Guhnoo Yun, Juhan Yoo, Kijung Kim, Jeongho Lee, Dong Hwan Kim |
| 2023 | EGformer: Equirectangular Geometry-biased Transformer for 360 Depth Estimation. | Ilwi Yun, Chanyong Shin, Hyunku Lee, Hyuk-Jae Lee, Chae-Eun Rhee |
| 2023 | Dense 2D-3D Indoor Prediction with Sound via Aligned Cross-Modal Distillation. | Heeseung Yun, Joonil Na, Gunhee Kim |
| 2023 | Achievement-based Training Progress Balancing for Multi-Task Learning. | Hayoung Yun, Hanjoo Cho |
| 2023 | Video State-Changing Object Segmentation. | Jiangwei Yu, Xiang Li, Xinran Zhao, Hongming Zhang, Yu-Xiong Wang |