| 2020 | Instrument Recognition in Laparoscopy for Technical Skill Assessment. | Sabrina Kletz, Klaus Schoeffmann, Andreas Leibetseder, Jenny Benois-Pineau, Heinrich Husslein |
| 2020 | Deep Learning-Based Video Retrieval Using Object Relationships and Associated Audio Classes. | Byoungjun Kim, Ji Yea Shim, Minho Park, Yong Man Ro |
| 2020 | A CNN-Based Multi-scale Super-Resolution Architecture on FPGA for 4K/8K UHD Applications. | Yongwoo Kim, Jae-Seok Choi, Jaehyup Lee, Munchurl Kim |
| 2020 | More-Natural Mimetic Words Generation for Fine-Grained Gait Description. | Hirotaka Kato, Takatsugu Hirayama, Ichiro Ide, Keisuke Doman, Yasutomo Kawanishi, Daisuke Deguchi, Hiroshi Murase |
| 2020 | An Extensible Framework for Interactive Real-Time Visualizations of Large-Scale Heterogeneous Multimedia Information from Online Sources. | Aikaterini Katmada, George Kalpakis, Theodora Tsikrika, Stelios Andreadis, Stefanos Vrochidis, Ioannis Kompatsiaris |
| 2020 | Browsing Visual Sentiment Datasets Using Psycholinguistic Groundings. | Marc A. Kastner, Ichiro Ide, Yasutomo Kawanishi, Takatsugu Hirayama, Daisuke Deguchi, Hiroshi Murase |
| 2020 | Context-Aware Residual Network with Promotion Gates for Single Image Super-Resolution. | Xiaozhong Ji, Yirui Wu, Tong Lu |
| 2020 | Light Field Reconstruction Using Dynamically Generated Filters. | Xiuxiu Jing, Yike Ma, Qiang Zhao, Ke Lyu, Feng Dai |
| 2020 | Cross Fusion for Egocentric Interactive Action Recognition. | Haiyu Jiang, Yan Song, Jiang He, Xiangbo Shu |
| 2020 | Kvasir-SEG: A Segmented Polyp Dataset. | Debesh Jha, Pia H. Smedsrud, Michael A. Riegler, Pl Halvorsen, Thomas de Lange, Dag Johansen, Hvard D. Johansen |
| 2020 | Multi-step Coding Structure of Spatial Audio Object Coding. | Chenhao Hu, Ruimin Hu, Xiaochen Wang, Tingzhao Wu, Dengshi Li |
| 2020 | An Efficient Algorithm of Facial Expression Recognition by TSG-RNN Network. | Kai Huang, Jianjun Li, Shichao Cheng, Jie Yu, Wanyong Tian, Lulu Zhao, Junfeng Hu, Chin-Chen Chang |
| 2020 | Efficient HEVC Downscale Transcoding Based on Coding Unit Information Mapping. | Zhijie Huang, Yunchang Li, Jun Sun |
| 2020 | Generate Images with Obfuscated Attributes for Private Image Classification. | Wei Hou, Dakui Wang, Xiaojun Chen |
| 2020 | Rethinking the Test Collection Methodology for Personal Self-tracking Data. | Frank Hopfgartner, Cathal Gurrin, Hideo Joho |
| 2020 | Face Tells Detailed Expression: Generating Comprehensive Facial Expression Sentence Through Facial Action Units. | Joanna Hong, Hong Joo Lee, Yelin Kim, Yong Man Ro |
| 2020 | Down-Sampling Based Video Coding with Degradation-Aware Restoration-Reconstruction Deep Neural Network. | Minh-Man Ho, Gang He, Zheng Wang, Jinjia Zhou |
| 2020 | Efficient Edge Caching for High-Quality 360-Degree Video Delivery. | Dongbiao He, Jinlei Jiang, Cdric Westphal, Guangwen Yang |
| 2020 | Experiences and Insights from the Collection of a Novel Multimedia EEG Dataset. | Graham Healy, Zhengwei Wang, Toms Ward, Alan F. Smeaton, Cathal Gurrin |
| 2020 | Multi-scale Spatial Location Preference for Semantic Segmentation. | Qiuyuan Han, Jin Zheng |
| 2020 | Global Affective Video Content Regression Based on Complementary Audio-Visual Features. | Xiaona Guo, Wei Zhong, Long Ye, Li Fang, Yan Heng, Qin Zhang |
| 2020 | Speaker-Aware Speech Emotion Recognition by Fusing Amplitude and Phase Information. | Lili Guo, Longbiao Wang, Jianwu Dang, Zhilei Liu, Haotian Guan |
| 2020 | Enhanced Gaze Following via Object Detection and Human Pose Estimation. | Jian Guan, Liming Yin, Jianguo Sun, Shuhan Qi, Xuan Wang, Qing Liao |
| 2020 | Perceptual Localization of Virtual Sound Source Based on Loudspeaker Triplet. | Duanzheng Guan, Dengshi Li, Xuebei Cai, Xiaochen Wang, Ruimin Hu |
| 2020 | Interactive Search and Exploration in Discussion Forums Using Multimodal Embeddings. | Iva Gornishka, Stevan Rudinac, Marcel Worring |