| 2023 | EventPoint: Self-Supervised Interest Point Detection and Description for Event-based Camera. | Ze Huang, Li Sun, Cheng Zhao, Song Li, Songzhi Su |
| 2023 | Self-Supervised Pyramid Representation Learning for Multi-Label Visual Analysis and Beyond. | Cheng-Yen Hsieh, Chih-Jung Chang, Fu-En Yang, Yu-Chiang Frank Wang |
| 2023 | Aggregating Bilateral Attention for Few-Shot Instance Localization. | He-Yen Hsieh, Ding-Jie Chen, Cheng-Wei Chang, Tyng-Luh Liu |
| 2023 | Heatmap-based Out-of-Distribution Detection. | Julia Hornauer, Vasileios Belagiannis |
| 2023 | Switching to Discriminative Image Captioning by Relieving a Bottleneck of Reinforcement Learning. | Ukyo Honda, Taro Watanabe, Yuji Matsumoto |
| 2023 | Neural Implicit Representations for Physical Parameter Inference from a Single Video. | Florian Hofherr, Lukas Koestler, Florian Bernard, Daniel Cremers |
| 2023 | HyperPosePDF Hypernetworks Predicting the Probability Distribution on SO(3). | Timon Hfer, Benjamin Kiefer, Martin Messmer, Andreas Zell |
| 2023 | Masked Autoencoder for Self-Supervised Pre-training on Lidar Point Clouds. | Georg Hess, Johan Jaxing, Elias Svensson, David Hagerman, Christoffer Petersson, Lennart Svensson |
| 2023 | Synthehicle: Multi-Vehicle Multi-Camera Tracking in Virtual Cities. | Fabian Herzog, Junpeng Chen, Torben Teepe, Johannes Gilg, Stefan Hrmann, Gerhard Rigoll |
| 2023 | CORL: Compositional Representation Learning for Few-Shot Classification. | Ju He, Adam Kortylewski, Alan L. Yuille |
| 2023 | SD-Conv: Towards the Parameter-Efficiency of Dynamic Convolution. | Shwai He, Chenbo Jiang, Daize Dong, Liang Ding |
| 2023 | Concept Correlation and Its Effects on Concept-Based Models. | Lena Heidemann, Maureen Monnet, Karsten Roscher |
| 2023 | HiFormer: Hierarchical Multi-scale Representations Using Transformers for Medical Image Segmentation. | Moein Heidari, Amirhossein Kazerouni, Milad Soltany Kadarvish, Reza Azad, Ehsan Khodapanah Aghdam, Julien Cohen-Adad, Dorit Merhof |
| 2023 | BoxMask: Revisiting Bounding Box Supervision for Video Object Detection. | Khurram Azeem Hashmi, Alain Pagani, Didier Stricker, Muhammad Zeshan Afzal |
| 2023 | Improving Predicate Representation in Scene Graph Generation by Self-Supervised Learning. | So Hasegawa, Masayuki Hiromoto, Akira Nakagawa, Yuhei Umeda |
| 2023 | Interpolated SelectionConv for Spherical Images and Surfaces. | David Hart, Michael Whitney, Bryan S. Morse |
| 2023 | Rebalancing gradient to improve self-supervised co-training of depth, odometry and optical flow predictions. | Marwane Hariat, Antoine Manzanera, David Filliat |
| 2023 | MixGen: A New Multi-Modal Data Augmentation. | Xiaoshuai Hao, Yi Zhu, Srikar Appalaraju, Aston Zhang, Wanqian Zhang, Bo Li, Mu Li |
| 2023 | MMPTRACK: Large-scale Densely Annotated Multi-camera Multiple People Tracking Benchmark. | Xiaotian Han, Quanzeng You, Chunyu Wang, Zhizheng Zhang, Peng Chu, Houdong Hu, Jiang Wang, Zicheng Liu |
| 2023 | Diffeomorphic Image Registration with Neural Velocity Field. | Kun Han, Shanlin Sun, Xiangyi Yan, Chenyu You, Hao Tang, Junayed Naushad, Haoyu Ma, Deying Kong, Xiaohui Xie |
| 2023 | Learning Few-shot Segmentation from Bounding Box Annotations. | Byeolyi Han, Tae-Hyun Oh |
| 2023 | Joint Video Rolling Shutter Correction and Super-Resolution. | Akash Gupta, Sudhir Kumar Singh, Amit K. Roy-Chowdhury |
| 2023 | A Suspect Identification Framework using Contrastive Relevance Feedback. | Devansh Gupta, Aditya Saini, Sarthak Bhagat, Shagun Uppal, Rishi Raj Jain, Drishti Bhasin, Ponnurangam Kumaraguru, Rajiv Ratn Shah |
| 2023 | DSAG: A Scalable Deep Framework for Action-Conditioned Multi-Actor Full Body Motion Synthesis. | Debtanu Gupta, Shubh Maheshwari, Sai Shashank Kalakonda, Manasvi Vaidyula, Ravi Kiran Sarvadevabhatla |
| 2023 | Towards Generating Ultra-High Resolution Talking-Face Videos with Lip synchronization. | Anchit Gupta, Rudrabha Mukhopadhyay, Sindhu Balachandra, Faizan Farooq Khan, Vinay P. Namboodiri, C. V. Jawahar |