| 2021 | 3D Object Tracking with Transformer. | Yubo Cui, Zheng Fang, Jiayao Shan, Zuoxu Gu, Sifan Zhou |
| 2021 | Two Heads are Better than One: Geometric-Latent Attention for Point Cloud Classification and Segmentation. | Hanz Cuevas-Velasquez, Antonio Javier Gallego, Robert B. Fisher |
| 2021 | PropMix: Hard Sample Filtering and Proportional MixUp for Learning with Noisy Labels. | Filipe Rolim Cordeiro, Vasileios Belagiannis, Ian Reid, Gustavo Carneiro |
| 2021 | Deep Video Decaptioning. | Pengpeng Chu, Weize Quan, Tong Wang, Pan Wang, Peiran Ren, Dong-Ming Yan |
| 2021 | HairFIT: Pose-invariant Hairstyle Transfer via Flow-based Hair Alignment and Semantic-region-aware Inpainting. | Chaeyeon Chung, Taewoo Kim, Hyelin Nam, Seunghwan Choi, Gyojung Gu, Sunghyun Park, Jaegul Choo |
| 2021 | Multi-Class Novelty Detection with Generated Hard Novel Features. | Wei-Ta Chu, Wei-Ting Cao |
| 2021 | Noisy Differentiable Architecture Search. | Xiangxiang Chu, Bo Zhang |
| 2021 | Grounded Situation Recognition with Transformers. | Junhyeong Cho, Youngseok Yoon, Hyeonjun Lee, Suha Kwak |
| 2021 | AudViSum: Self-Supervised Deep Reinforcement Learning for Diverse Audio-Visual Summary Generation. | Sanjoy Chowdhury, Aditya Patra, Subhrajyoti Dasgupta, Ujjwal Bhattacharya |
| 2021 | The Curious Layperson: Fine-Grained Image Recognition without Expert Labels. | Subhabrata Choudhury, Iro Laina, Christian Rupprecht, Andrea Vedaldi |
| 2021 | Wide and Narrow: Video Prediction from Context and Motion. | Jaehoon Cho, Jiyoung Lee, Changjae Oh, Wonil Song, Kwanghoon Sohn |
| 2021 | Self-Supervised Real-time Video Stabilization. | Jinsoo Choi, Jaesik Park, In So Kweon |
| 2021 | Variance-stationary Differentiable NAS. | Hyeokjun Choe, Byunggook Na, Jisoo Mok, Sungroh Yoon |
| 2021 | Rethinking local and global feature representation for semantic segmentation. | Mohan Chen, Xinxuan Zhao, Bingfei Fu, Li Zhang, Xiangyang Xue |
| 2021 | Attention to Action: Leveraging Attention for Object Navigation. | Shi Chen, Qi Zhao |
| 2021 | MVT: Multi-view Vision Transformer for 3D Object Recognition. | Shuo Chen, Tan Yu, Ping Li |
| 2021 | LSTA-Net: Long short-term Spatio-Temporal Aggregation Network for Skeleton-based Action Recognition. | Tailin Chen, Shidong Wang, Desen Zhou, Yu Guan |
| 2021 | ContourletNet: A Generalized Rain Removal Architecture Using Multi-Direction Representation and Hierarchical Decomposition. | Wei-Ting Chen, Cheng-Che Tsai, Hao-Yu Fang, I-Hsiang Chen, Jian-Jiun Ding, Sy-Yen Kuo |
| 2021 | A Design of Contractive Appearance Flow for Photometric Stereo. | Lixiong Chen, Victor Adrian Prisacariu |
| 2021 | Adaptive Distillation: Aggregating Knowledge from Multiple Paths for Efficient Distillation. | Sumanth Chennupati, Mohammad Mahdi Kamani, Zhongwei Cheng, Lin Chen |
| 2021 | Talking Head Generation with Audio and Speech Related Facial Action Units. | Sen Chen, Zhilei Liu, Jiaxing Liu, Zhengxiang Yan, Longbiao Wang |
| 2021 | Multimodal Semi-Supervised Learning for 3D Objects. | Zhimin Chen, Longlong Jing, Yang Liang, Yingli Tian, Bing Li |
| 2021 | Deep Image Matting with Flexible Guidance Input. | Hang Cheng, Shugong Xu, Xiufeng Jiang, Rongrong Wang |
| 2021 | 3D Flow Field Estimation around a Vehicle Using Convolutional Neural Networks. | Fangge Chen, Kei Akasaka |
| 2021 | AniFormer: Data-driven 3D Animation with Transformer. | Haoyu Chen, Hao Tang, Nicu Sebe, Guoying Zhao |