| 2022 | IronDepth: Iterative Refinement of Single-View Depth using Surface Normal and its Uncertainty. | Gwangbin Bae, Ignas Budvytis, Roberto Cipolla |
| 2022 | Centered Symmetric Quantization for Hardware-Efficient Low-Bit Neural Networks. | Faaiz Asim, Jaewoo Park, Azat Azamat, Jongeun Lee |
| 2022 | Bootstrapping Human Optical Flow and Pose. | Aritro Roy Arko, Jim Little, Kwang Moo Yi |
| 2022 | Handling Class-Imbalance for Improved Zero-Shot Domain Generalization. | Ahmad Arfeen, Titir Dutta, Soma Biswas |
| 2022 | VID-Trans-ReID: Enhanced Video Transformers for Person Re-identification. | Aishah Alsehaim, Toby P. Breckon |
| 2022 | Global Proxy-based Hard Mining for Visual Place Recognition. | Amar Ali-bey, Brahim Chaib-draa, Philippe Gigure |
| 2022 | XDGAN: Multi-Modal 3D Shape Generation in 2D Space. | Hassan Abu Alhaija, Alara Dirik, Andr Knrig, Sanja Fidler, Maria Shugrina |
| 2022 | MAC: Mask-Augmentation for Motion-Aware Video Representation Learning. | Arif Akar, Ufuk Umut Senturk, Nazli Ikizler-Cinbis |
| 2022 | Revisiting Deep Fisher Vectors: Using Fisher Information to Improve Object Classification. | Sarah Ahmed, Tayyaba Azim, Joseph Early, Sarvapali D. Ramchurn |
| 2022 | Compressing Video Calls using Synthetic Talking Heads. | Madhav Agarwal, Anchit Gupta, Rudrabha Mukhopadhyay, Vinay P. Namboodiri, C. V. Jawahar |
| 2022 | Hierarchical Residual Learning Based Vector Quantized Variational Autoencoder for Image Reconstruction and Generation. | Mohammad Adiban, Kalin Stefanov, Sabato Marco Siniscalchi, Giampiero Salvi |
| 2022 | G2Net: Generic Game-Theoretic Network for Partial-Label Image Classification. | Rabab Abdelfattah, Xin Zhang, Mostafa M. Fouda, Xiaofeng Wang, Song Wang |
| 2022 | TAG: Boosting Text-VQA via Text-aware Visual Question-answer Generation. | Jun Wang, Mingfei Gao, Yuqian Hu, Ramprasaath R. Selvaraju, Chetan Ramaiah, Ran Xu, Joseph F. JJ, Larry Davis |
| 2022 | CNeRV: Content-adaptive Neural Representation for Visual Data. | Hao Chen, Matthew Gwilliam, Bo He, Ser-Nam Lim, Abhinav Shrivastava |
| 2022 | Few-shot Semantic Segmentation with Support-induced Graph Convolutional Network. | Jie Liu, Yanqi Bao, Wenzhe Yin, Haochen Wang, Yang Gao, Jan-Jakob Sonke, Efstratios Gavves |
| 2022 | Beyond the CLS Token: Image Reranking using Pretrained Vision Transformers. | Chao Zhang, Stephan Liwicki, Roberto Cipolla |
| 2022 | Anatomical prior-inspired label refinement for weakly supervised liver tumor segmentation with volume-level labels. | Fei Lyu, Andy J. Ma, Pong Chi Yuen |
| 2022 | Structured Spatial Reasoning for Human Pose Estimation. | Ying Huang, Shanfeng Hu, Zi-Ke Zhang |
| 2022 | Task Generalizable Spatial and Texture Aware Image Downsizing Network. | Lin Ma, Weiming Li, Hongsheng Li, Qiang Wang, Ji-Yeon Kim |
| 2022 | Memory-Driven Text-to-Image Generation. | Bowen Li, Philip H. S. Torr, Thomas Lukasiewicz |
| 2022 | Image-to-Image Translation with Text Guidance. | Bowen Li, Philip H. S. Torr, Thomas Lukasiewicz |
| 2022 | Mutual Conditional Probability for Self-Supervised Learning. | Takumi Kobayashi |
| 2021 | Few-shot Action Recognition with Prototype-centered Attentive Learning. | Xiatian Zhu, Antoine Toisoul, Juan-Manuel Prez-Ra, Li Zhang, Brais Martnez, Tao Xiang |
| 2021 | AMICO: Amodal Instance Composition. | Peiye Zhuang, Denis Demandolx, Ayush Saraf, Xuejian Rong, Changil Kim, Jia-Bin Huang |
| 2021 | A Closer Look at Few-Shot Video Classification: A New Baseline and Benchmark. | Zhenxi Zhu, Limin Wang, Sheng Guo, Gangshan Wu |