| 2024 | Few-Shot Object Detection as a Service: Facilitating Training and Deployment for Domain Experts. | Werner Bailer, Mihai Dogariu, Bogdan Ionescu, Hannes Fassold |
| 2024 | Facilitating the Production of Well-Tailored Video Summaries for Sharing on Social Media. | Evlampios Apostolidis, Konstantinos Apostolidis, Vasileios Mezaris |
| 2024 | VISIONE 5.0: Enhanced User Interface and AI Models for VBS2024. | Giuseppe Amato, Paolo Bolettieri, Fabio Carrara, Fabrizio Falchi, Claudio Gennaro, Nicola Messina, Lucia Vadicamo, Claudio Vairo |
| 2024 | E2Evideo: End to End Video and Image Pre-processing and Analysis Tool. | Faiga Alawad, Pl Halvorsen, Michael A. Riegler |
| 2024 | A Language-Based Solution to Enable Metaverse Retrieval. | Ali Abdari, Alex Falcon, Giuseppe Serra |
| 2023 | COMIM-GAN: Improved Text-to-Image Generation via Condition Optimization and Mutual Information Maximization. | Longlong Zhou, Xiaojun Wu, Tianyang Xu |
| 2023 | Toward More Accurate Heterogeneous Iris Recognition with Transformers and Capsules. | Zhiyong Zhou, Yuanning Liu, Xiaodong Zhu, Shuai Liu, Shaoqiang Zhang, Zhen Liu |
| 2023 | SPEM: Self-adaptive Pooling Enhanced Attention Module for Image Recognition. | ShanShan Zhong, Wushao Wen, Jinghui Qin |
| 2023 | Space-Time Video Super-Resolution 3D Transformer. | Minyan Zheng, Jianping Luo |
| 2023 | Multi-scale Gaussian Difference Preprocessing and Dual Stream CNN-Transformer Hybrid Network for Skin Lesion Segmentation. | Xin Zhao, Zhihang Ren |
| 2023 | CMFG: Cross-Model Fine-Grained Feature Interaction for Text-Video Retrieval. | Shengwei Zhao, Yuying Liu, Shaoyi Du, Zhiqiang Tian, Ting Qu, Linhai Xu |
| 2023 | The Importance of Image Interpretation: Patterns of Semantic Misclassification in Real-World Adversarial Images. | Zhengyu Zhao, Nga Dang, Martha A. Larson |
| 2023 | Lightweight Multi-level Information Fusion Network for Facial Expression Recognition. | Yuan Zhang, Xiang Tian, Ziyang Zhang, Xiangmin Xu |
| 2023 | Rumor Detection on Social Media by Using Global-Local Relations Encoding Network. | Xinxin Zhang, Shanliang Pan, Chengwu Qian, Jiadong Yuan |
| 2023 | DiffMotion: Speech-Driven Gesture Synthesis Using Denoising Diffusion Model. | Fan Zhang, Naye Ji, Fuxing Gao, Yongping Li |
| 2023 | Feature Enhancement and Reconstruction for Small Object Detection. | Chong-Jian Zhang, Song-Lu Chen, Qi Liu, Zhi-Yong Huang, Feng Chen, Xu-Cheng Yin |
| 2023 | Self-supervised Multi-object Tracking with Cycle-Consistency. | Yuanhang Yin, Yang Hua, Tao Song, Ruhui Ma, Haibing Guan |
| 2023 | CCF-Net: A Cascade Center-Based Framework Towards Efficient Human Parts Detection. | Kai Ye, Haoqin Ji, Yuan Li, Lei Wang, Peng Liu, Linlin Shen |
| 2023 | Multi-scale and Multi-stage Deraining Network with Fourier Space Loss. | Zhaoyong Yan, Liyan Ma, Xiangfeng Luo, Yan Sun |
| 2023 | BENet: Boundary Enhance Network for Salient Object Detection. | Zhiqi Yan, Shuang Liang |
| 2023 | Transformer-Based Cross-Modal Recipe Embeddings with Large Batch Training. | Jing Yang, Junwen Chen, Keiji Yanai |
| 2023 | Manga Text Detection with Manga-Specific Data Augmentation and Its Applications on Emotion Analysis. | Yi-Ting Yang, Wei-Ta Chu |
| 2023 | Weighted Multi-view Clustering Based on Internal Evaluation. | Haoqi Xu, Jian Hou, Huaqiang Yuan |
| 2023 | Optimizing Local Feature Representations of 3D Point Clouds with Anisotropic Edge Modeling. | Haoyi Xiu, Xin Liu, Weimin Wang, Kyoung-Sook Kim, Takayuki Shinohara, Qiong Chang, Masashi Matsuoka |
| 2023 | HSS: A Hierarchical Semantic Similarity Hard Negative Sampling Method for Dense Retrievers. | Xinjia Xie, Feng Liu, Shun Gai, Zhen Huang, Minghao Hu, Ankun Wang |