| 2025 | Hyper-NeuS: Hypernetworks for Neural SDF Implicit Surface Reconstruction by Volume Rendering. | Jingkun Li, Na Qi, Qing Zhu |
| 2025 | AD2AT: Audio Description to Alternative Text, a Dataset of Alternative Text from Movies. | lise Lincker, Camille Guinaudeau, Shin'ichi Satoh |
| 2025 | Mix-YOLONet: Deep Image Dehazing for Improving Object Detection. | Xin Lim, Lai-Kuan Wong, Yuen Peng Loh, Ke Gu, Weisi Lin |
| 2025 | Multimodal Engagement Prediction in Human-Robot Interaction Using Transformer Neural Networks. | Jia Yap Lim, John See, Christian Dondrup |
| 2025 | Transformer-Based Audio Generation Conditioned by 2D Latent Maps: A Demonstration. | Christian Limberg, Zhe Zhang, Marc A. Kastner |
| 2025 | Robust Active Speaker Detection in Challenging Environments Using GNN-Fused Multi-modal Cues and Body Language. | Yongqian Li, Yong Luo, Xin Zhou |
| 2025 | WavFusion: Towards Wav2vec 2.0 Multimodal Speech Emotion Recognition. | Feng Li, Jiusong Luo, Wanjun Xia |
| 2025 | TDM: Temporally-Consistent Diffusion Model for All-in-One Real-World Video Restoration. | Yizhou Li, Zihua Liu, Yusuke Monno, Masatoshi Okutomi |
| 2025 | Leveraging Latent Diffusion in 3D Gaussian Splatting for Novel View Synthesis. | Bohan Li, Xingyi Li, Yangwen Liang, Shuangquan Wang, Kee-Bong Song |
| 2025 | DART: Depth-Enhanced Accurate and Real-Time Background Matting. | Guofeng Li, Hanxi Li, Bo Li, Lin Wu, Yan Cheng |
| 2025 | Fusionista: Fusion of 3-D Information of Video in Retrieval System. | Huy M. Le, Dat Nguyen Tien, Khang Le Duy, Tuan Nguyen Dang Quang, Nguyen Khanh Toan, Tuyen Nguyen, Binh T. Nguyen |
| 2025 | DiveXplore at the Video Browser Showdown 2025. | Mario Leopold, Klaus Schoeffmann |
| 2025 | Correlation-Based Weighted Federated Learning with Multimodal Sensing and Knowledge Distillation: An Application on a Real-World Benchmark Dataset. | Duy-Dong Le, Duy-Thanh Huynh, Pham The Bao |
| 2025 | Lightweight Motion-Aware Video Super-Resolution for Compressed Videos. | Ilhwan Kwon, Jun Li, Rajiv Ratn Shah, Mukesh Prasad |
| 2025 | Training a Segmentation-Based Visual Anonymization Service for Street Scenes. | Martin Korb, Werner Bailer |
| 2025 | Enhancing User Control in AI-Based Video Summarization for Social Media. | Ioannis Kontostathis, Evlampios Apostolidis, Konstantinos Apostolidis, Vasileios Mezaris |
| 2025 | Saliency Based Data Augmentation for Few-Shot Video Action Recognition. | Yongqiang Kong, Yunhong Wang, Annan Li |
| 2025 | A User Identification and Reading Style Detection System Based on Eye Movement Patterns While Reading. | Onanong Kongmeesub, Cathal Gurrin, Dongyun Nie |
| 2025 | An Implementation of Networked JamSketch. | Tetsuro Kitahara, Takuya Tsutsumi, Takaaki Nagoshi, Taizan Suzuki |
| 2025 | Multi-Dimensional Exploration of Media Collection Metadata. | Omar Shahbaz Khan, Aaron Duane, Hariz Hasnan, No Le Blavec, Pierre Ouvrard, Johan Verdon, Laurent d'Orazio, Constance Thierry, Bjrn r Jnsson |
| 2025 | RoboDJ: Live Commentary Robots System Driven by Physical- and Cyber-World Observations. | Yasutomo Kawanishi, Yutaka Nakamura, Taiken Shintani, Carlos Toshinori Ishi, Seiya Kawano, Koichiro Yoshino, Takashi Minato, Michihiko Minoh |
| 2025 | The Right to an Explanation Under the GDPR and the AI Act. | Bjrn Aslak Juliussen |
| 2025 | Boosting Human Pose Estimation via Heatmap Refinement. | Ling Jiang, Zhuocheng Liu, Kaige Li, Wei Wu |
| 2025 | Noise-Robust Separating Multi-source Aliased Vibration Signal Based on Transformer Demucs. | Wanchang Jiang, Yuxin Jiang |
| 2025 | Badminton Footwork Practice via an Immersive Virtual Reality System. | Duen-Chian Jheng, Bill Louis Harchan, Berenika Nawoja Kostka de Sztemberg, Jen-Hao Hsu, Min-Chun Tien |