| 2022 | VSA: Learning Varied-Size Window Attention in Vision Transformers. | Qiming Zhang, Yufei Xu, Jing Zhang, Dacheng Tao |
| 2022 | Spatio-Temporal Deformable Attention Network for Video Deblurring. | Huicong Zhang, Haozhe Xie, Hongxun Yao |
| 2022 | Learning Algebraic Representation for Systematic Generalization in Abstract Reasoning. | Chi Zhang, Sirui Xie, Baoxiong Jia, Ying Nian Wu, Song-Chun Zhu, Yixin Zhu |
| 2022 | Self-supervised Learning for Real-World Super-Resolution from Dual Zoomed Observations. | Zhilu Zhang, Ruohao Wang, Hongzhi Zhang, Yunjin Chen, Wangmeng Zuo |
| 2022 | Robust Multi-object Tracking by Marginal Inference. | Yifu Zhang, Chunyu Wang, Xinggang Wang, Wenjun Zeng, Wenyu Liu |
| 2022 | Distinctive Image Captioning via CLIP Guided Group Optimization. | Youyuan Zhang, Jiuniu Wang, Hao Wu, Wenjia Xu |
| 2022 | Learn from All: Erasing Attention Consistency for Noisy Label Facial Expression Recognition. | Yuhang Zhang, Chengrui Wang, Xu Ling, Weihong Deng |
| 2022 | ActionFormer: Localizing Moments of Actions with Transformers. | Chen-Lin Zhang, Jianxin Wu, Yin Li |
| 2022 | D2-TPred: Discontinuous Dependency for Trajectory Prediction Under Traffic Lights. | Yuzhen Zhang, Wentong Wang, Weizhi Guo, Pei Lv, Mingliang Xu, Wei Chen, Dinesh Manocha |
| 2022 | Video Extrapolation in Space and Time. | Yunzhi Zhang, Jiajun Wu |
| 2022 | Spike Transformer: Monocular Depth Estimation for Spiking Camera. | Jiyuan Zhang, Lulu Tang, Zhaofei Yu, Jiwen Lu, Tie-Jun Huang |
| 2022 | Stereo Depth Estimation with Echoes. | Chenghao Zhang, Kun Tian, Bolin Ni, Gaofeng Meng, Bin Fan, Zhaoxiang Zhang, Chunhong Pan |
| 2022 | Connecting Compression Spaces with Transformer for Approximate Nearest Neighbor Search. | Haokui Zhang, Buzhou Tang, Wenze Hu, Xiaoyu Wang |
| 2022 | Towards Robust Face Recognition with Comprehensive Search. | Manyuan Zhang, Guanglu Song, Yu Liu, Hongsheng Li |
| 2022 | ByteTrack: Multi-object Tracking by Associating Every Detection Box. | Yifu Zhang, Peize Sun, Yi Jiang, Dongdong Yu, Fucheng Weng, Zehuan Yuan, Ping Luo, Wenyu Liu, Xinggang Wang |
| 2022 | 3D-Aware Semantic-Guided Generative Model for Human Synthesis. | Jichao Zhang, Enver Sangineto, Hao Tang, Aliaksandr Siarohin, Zhun Zhong, Nicu Sebe, Wei Wang |
| 2022 | RelPose: Predicting Probabilistic Relative Rotation for Single Objects in the Wild. | Jason Y. Zhang, Deva Ramanan, Shubham Tulsiani |
| 2022 | Monocular 3D Object Reconstruction with GAN Inversion. | Junzhe Zhang, Daxuan Ren, Zhongang Cai, Chai Kiat Yeo, Bo Dai, Chen Change Loy |
| 2022 | Learning to Drive by Watching YouTube Videos: Action-Conditioned Contrastive Policy Pretraining. | Qihang Zhang, Zhenghao Peng, Bolei Zhou |
| 2022 | Dense Siamese Network for Dense Unsupervised Learning. | Wenwei Zhang, Jiangmiao Pang, Kai Chen, Chen Change Loy |
| 2022 | TransNet: Category-Level Transparent Object Pose Estimation. | Huijie Zhang, Anthony Opipari, Xiaotong Chen, Jiyue Zhu, Zeren Yu, Odest Chadwicke Jenkins |
| 2022 | Human-Centric Image Cropping with Partition-Aware and Content-Preserving Features. | Bo Zhang, Li Niu, Xing Zhao, Liqing Zhang |
| 2022 | EgoBody: Human Body Shape and Motion of Interacting People from Head-Mounted Devices. | Siwei Zhang, Qianli Ma, Yan Zhang, Zhiyin Qian, Taein Kwon, Marc Pollefeys, Federica Bogo, Siyu Tang |
| 2022 | Time-rEversed DiffusioN tEnsor Transformer: A New TENET of Few-Shot Object Detection. | Shan Zhang, Naila Murray, Lei Wang, Piotr Koniusz |
| 2022 | MorphMLP: An Efficient MLP-Like Backbone for Spatial-Temporal Representation Learning. | David Junhao Zhang, Kunchang Li, Yali Wang, Yunpeng Chen, Shashwat Chandra, Yu Qiao, Luoqi Liu, Mike Zheng Shou |