| 2024 | Dive into Coarse-to-Fine Strategy in Single Image Deblurring. | Zebin Li, Jianping Luo |
| 2024 | Mutant Texts: A Technique for Uncovering Unexpected Inconsistencies in Large-Scale Vision-Language Models. | Mingliang Liang, Zhouran Liu, Martha A. Larson |
| 2024 | NearbyPatchCL: Leveraging Nearby Patches for Self-supervised Patch-Level Multi-class Classification in Whole-Slide Images. | Gia-Bao Le, Van-Tien Nguyen, Trung-Nghia Le, Minh-Triet Tran |
| 2024 | An Integrated System for Spatio-temporal Summarization of 360-Degrees Videos. | Ioannis Kontostathis, Evlampios Apostolidis, Vasileios Mezaris |
| 2024 | Enhancing Generative Generalized Zero Shot Learning via Multi-Space Constraints and Adaptive Integration. | Zhe Kong, Neng Gao, Yifei Zhang, Yuhan Liu |
| 2024 | Exquisitor at the Video Browser Showdown 2024: Relevance Feedback Meets Conversational Search. | Omar Shahbaz Khan, Hongyi Zhu, Ujjwal Sharma, Evangelos Kanoulas, Stevan Rudinac, Bjrn r Jnsson |
| 2024 | Adversarially Robust Deepfake Detection via Adversarial Feature Similarity Learning. | Sarwar Khan, Jun-Cheng Chen, Wen-Hung Liao, Chu-Song Chen |
| 2024 | Co-speech Gesture Generation with Variational Auto Encoder. | Shinichi Ka, Koichi Shinoda |
| 2024 | CLF-Net: A Few-Shot Cross-Language Font Generation Method. | Qianqian Jin, Fazhi He, Wei Tang |
| 2024 | Dual-Fisheye Image Stitching via Unsupervised Deep Learning. | Zhanjie Jin, Anming Dong, Jiguo Yu, Shuxiang Dong, You Zhou |
| 2024 | Learning Complementary Instance Representation with Parallel Adaptive Graph-Based Network for Action Detection. | Yanyan Jiao, Wenzhu Yang, Wenjie Xing |
| 2024 | LUMOS-DM: Landscape-Based Multimodal Scene Retrieval Enhanced by Diffusion Model. | Viet-Tham Huynh, Trong-Thuan Nguyen, Quang-Thuc Nguyen, Mai-Khiem Tran, Tam V. Nguyen, Minh-Triet Tran |
| 2024 | Joint Image Data Hiding and Rate-Distortion Optimization in Neural Compressed Latent Representations. | Chen-Hsiu Huang, Ja-Ling Wu |
| 2024 | PDTW150K: A Dataset for Patent Drawing Retrieval. | Chan-Ming Hsu, Tse-Hung Lin, Yu-Hsien Chen, Chih-Yi Chiu |
| 2024 | Waseda_Meisei_SoftBank at Video Browser Showdown 2024. | Takayuki Hori, Kazuya Ueki, Yuma Suzuki, Hiroki Takushima, Hayato Tanoue, Haruki Sato, Takumi Takada, Aiswariya Manoj Kumar |
| 2024 | GSUNet: A Brain Tumor Segmentation Method Based on 3D Ghost Shuffle U-Net. | Jixuan Hong, Jingjing Xie, Xueqin He, Chenhui Yang |
| 2024 | MetaVSR: A Novel Approach to Video Super-Resolution for Arbitrary Magnification. | Zixuan Hong, Weipeng Cao, Zhiwu Xu, Zhenru Chen, Xi Tao, Zhong Ming, Chuqing Cao, Liang Zheng |
| 2024 | Training-Free Region Prediction with Stable Diffusion. | Yuma Honbu, Keiji Yanai |
| 2024 | Prior-Knowledge-Free Video Frame Interpolation with Bidirectional Regularized Implicit Neural Representations. | Yuanjian He, Weile Zhang, Junyuan Deng, Yulai Cong |
| 2024 | Implementation of Melody Slot Machines. | Masatoshi Hamanaka |
| 2024 | Semantic Importance-Based Deep Image Compression Using a Generative Approach. | Xi Gu, Yuanyuan Xu, Kun Zhu |
| 2024 | TalkSee: Interactive Video Retrieval Engine Using Large Language Model. | Guihe Gu, Zhengqian Wu, Jiangshan He, Lin Song, Zhongyuan Wang, Chao Liang |
| 2024 | Face Forgery Detection via Texture and Saliency Enhancement. | Sizheng Guo, Haozhe Yang, Xianming Lin |
| 2024 | Pseudo-label Based Unsupervised Momentum Representation Learning for Multi-domain Image Retrieval. | Mingyuan Ge, Jianan Shui, Junyu Chen, Mingyong Li |
| 2024 | A New Retrieval Engine for Vitrivr. | Ralph Gasser, Rahel Arnold, Fynn Faber, Heiko Schuldt, Raphael Waltenspl, Luca Rossetto |