| 2025 | VideoEase at VBS2025: An Interactive Video Retrieval System. | Quang-Linh Tran, Binh T. Nguyen, Gareth J. F. Jones, Cathal Gurrin |
| 2025 | Intra-class Compact Facial Expression Recognition Based on Amplitude Phase Separation. | Xiang Tian, Yuan Zhang, Chang Mu, Ziyang Zhang |
| 2025 | Wavelet Integrated Convolutional Neural Network for ECG Signal Denoising. | Takamasa Terada, Masahiro Toyoura |
| 2025 | RoLD: Robot Latent Diffusion for Multi-task Policy Modeling. | Wenhui Tan, Bei Liu, Junbo Zhang, Ruihua Song, Jianlong Fu |
| 2025 | CalorieVoL: Integrating Volumetric Context Into Multimodal Large Language Models for Image-Based Calorie Estimation. | Hikaru Tanabe, Keiji Yanai |
| 2025 | RobSparse: Automatic Search for GPU-Friendly Robust and Sparse Vision Transformers. | Yulan Su, Sisi Zhang, Yan Wang, Xingbin Wang, Lutan Zhao, Dan Meng, Rui Hou |
| 2025 | Poseidon: A NAS-Based Ensemble Defense Method Against Multiple Perturbations. | Yulan Su, Sisi Zhang, Zechao Lin, Xingbin Wang, Lutan Zhao, Dan Meng, Rui Hou |
| 2025 | Detoxification of Unlabeled Dataset: Reducing Implicit Class Imbalance Using Pseudo-Jacobian of GAN's Generator. | Kosei Suyama, Kazuaki Nakamura |
| 2025 | Target-Oriented Dynamic Denosing Curriculum Learning for Multimodel Stance Detection. | Zihao Suo, Shanliang Pan |
| 2025 | Dual-Task Feedback Learning for Tongue Detection via Super-Resolution Integration. | Ying Sun, Meiyi Wei, Gang Chen |
| 2025 | Deep Dual Internal Learning for Hyperspectral Image Super-Resolution. | Yongqing Sun, Hong Liu, Qiong Chang, Xianhua Han |
| 2025 | LITA: LMM-Guided Image-Text Alignment for Art Assessment. | Tatsumi Sunada, Kaede Shiohara, Ling Xiao, Toshihiko Yamasaki |
| 2025 | Operatic Singing Voice Synthesis From Inexperienced Voice Considering Tempo and Vowel Change. | Aoto Sugahara, Soma Kishimoto, Yuji Adachi, Kiyoto Tai, Ryoichi Takashima, Tetsuya Takiguchi |
| 2025 | PraK Tool V3: Enhancing Video Item Search Using Localized Text and Texture Queries. | Michael Stroh, Vojtech Kloda, Benjamin Verner, Zuzana Voplkov, Raphael Buchmller, Bastian Jckl, Jakub Hajko, Jakub Lokoc |
| 2025 | Toward Appearance-Based Autonomous Landing Site Identification for Multirotor Drones in Unstructured Environments. | Joshua Springer, Gylfi r Gumundsson, Marcel Kyas |
| 2025 | Simplified Video Retrieval in Virtual Reality with vitrivr-VR. | Florian Spiess, Luca Rossetto, Heiko Schuldt |
| 2025 | Frequency-Aware Convolution for Sound Event Detection. | Tao Song, Wenwen Zhang |
| 2025 | Making Strides Security in Multimodal Fake News Detection Models: A Comprehensive Analysis of Adversarial Attacks. | Jiahua Si, Youze Wang, Wenbo Hu, Qiang Liu, Richang Hong |
| 2025 | Self-supervised Reference-Based Image Super-Resolution with Conditional Diffusion Model. | Shuai Shi, Na Qi, Yezi Li, Qing Zhu |
| 2025 | Real-Time Action Detection in Volleyball Matches Using DETR Architecture. | Mu-Jan Shih, Yi-Yu Hsu |
| 2025 | SSDL: Sensor-to-Skeleton Diffusion Model with Lipschitz Regularization for Human Activity Recognition. | Nikhil Sharma, Changchang Sun, Zhenghao Zhao, Anne Hee Hiong Ngu, Hugo Latapie, Yan Yan |
| 2025 | Exquisitor at the Video Browser Showdown 2025: Unifying Conversational Search and User Relevance Feedback. | Ujjwal Sharma, Omar Shahbaz Khan, Stevan Rudinac, Bjrn r Jnsson |
| 2025 | Revisit Data Association in Semantic SLAM Systems for Autonomous Parking. | Xuan Shao, Leming Huang, Xinghua Liu |
| 2025 | Quantized-ViT Efficient Training via Fisher Matrix Regularization. | Yuzhang Shang, Gaowen Liu, Ramana Kompella, Yan Yan |
| 2025 | AMDA: Advancing Multimedia Data Annotation for Human-Centric Situations. | Ibrahim Serouis, Florence Sdes |