| 2020 | Do We Need Sound for Sound Source Localization? | Takashi Oya, Shohei Iwase, Ryota Natsume, Takahiro Itazuri, Shugo Yamaguchi, Shigeo Morishima |
| 2020 | Dynamic Depth Fusion and Transformation for Monocular 3D Object Detection. | Erli Ouyang, Li Zhang, Mohan Chen, Anurag Arnab, Yanwei Fu |
| 2020 | Road Obstacle Detection Method Based on an Autoencoder with Semantic Segmentation. | Toshiaki Ohgushi, Kenji Horiguchi, Masao Yamanaka |
| 2020 | Bidirectional Pyramid Networks for Semantic Segmentation. | Dong Nie, Jia Xue, Xiaofeng Ren |
| 2020 | Attended-Auxiliary Supervision Representation for Face Anti-spoofing. | Son Minh Nguyen, Tran Duy Linh, Masayuki Arai |
| 2020 | Sequential View Synthesis with Transformer. | Phong Nguyen-Ha, Lam Huynh, Esa Rahtu, Janne Heikkil |
| 2020 | Unified Application of Style Transfer for Face Swapping and Reenactment. | L Minh Ng, Christian aan de Wiel, Sezer Karaoglu, Theo Gevers |
| 2020 | V2A - Vision to Action: Learning Robotic Arm Actions Based on Vision and Language. | Michal Nazarczuk, Krystian Mikolajczyk |
| 2020 | Image Inpainting with Onion Convolutions. | Shant Navasardyan, Marianna Ohanyan |
| 2020 | Towards Robust Fine-Grained Recognition by Maximal Separation of Discriminative Features. | Krishna Kanth Nakka, Mathieu Salzmann |
| 2020 | Iterative Self-distillation for Precise Facial Landmark Localization. | Shigenori Nagae, Yamato Takeuchi |
| 2020 | Learning Local Feature Descriptors for Multiple Object Tracking. | Dmytro Mykheievskyi, Dmytro Borysenko, Viktor Porokhonskyy |
| 2020 | Watch, Read and Lookup: Learning to Spot Signs from Multiple Supervisors. | Liliane Momeni, Gl Varol, Samuel Albanie, Triantafyllos Afouras, Andrew Zisserman |
| 2020 | Frequency Attention Network: Blind Noise Removal for Real Images. | Hongcheng Mo, Jianfei Jiang, Qin Wang, Dong Yin, Pengyu Dong, Jingjun Tian |
| 2020 | CloTH-VTON: Clothing Three-Dimensional Reconstruction for Hybrid Image-Based Virtual Try-ON. | Matiur Rahman Minar, Heejune Ahn |
| 2020 | Knowledge Transfer Graph for Deep Collaborative Learning. | Soma Minami, Tsubasa Hirakawa, Takayoshi Yamashita, Hironobu Fujiyoshi |
| 2020 | Leveraging Tacit Information Embedded in CNN Layers for Visual Tracking. | Kourosh Meshgi, Maryam Sadat Mirzaei, Shigeyuki Oba |
| 2020 | Adversarial Semi-supervised Multi-domain Tracking. | Kourosh Meshgi, Maryam Sadat Mirzaei |
| 2020 | COMET: Context-Aware IoU-Guided Network for Small Object Tracking. | Seyed Mojtaba Marvasti-Zadeh, Javad Khaghani, Hossein Ghanei-Yakhdan, Shohreh Kasaei, Li Cheng |
| 2020 | Semantics Through Time: Semi-supervised Segmentation of Aerial Videos with Iterative Label Propagation. | Alina Marcu, Vlad Licaret, Dragos Costea, Marius Leordeanu |
| 2020 | Contextual Semantic Interpretability. | Diego Marcos, Ruth Fong, Sylvain Lobry, Rmi Flamary, Nicolas Courty, Devis Tuia |
| 2020 | Interpreting Video Features: A Comparison of 3D Convolutional Networks and Convolutional LSTM Networks. | Joonatan Mnttri, Sofia Broom, John Folkesson, Hedvig Kjellstrm |
| 2020 | A Day on Campus - An Anomaly Detection Dataset for Events in a Single Camera. | Pranav Mantini, Zhenggang Li, Shishir K. Shah |
| 2020 | Accurate and Efficient Single Image Super-Resolution with Matrix Channel Attention Network. | Hailong Ma, Xiangxiang Chu, Bo Zhang |
| 2020 | Human Motion Deblurring Using Localized Body Prior. | Jonathan Samuel Lumentut, Joshua Santoso, In Kyu Park |