| 2025 | gFlow: Distributed Real-Time Reverse Remote Rendering System Model. | Yixiao Xu, Yubo Li, Wanzhao Xu, Yicheng Gu, Yun Wang, Jiangyuan Ma, Zhengwei Qi |
| 2025 | AMPLE: Emotion-Aware Multimodal Fusion Prompt Learning for Fake News Detection. | Xiaoman Xu, Xiangrun Li, Taihang Wang, Ye Jiang |
| 2025 | Multimodal Prompt Learning for Audio Visual Scene-Aware Dialog. | Feifei Xu, Fumiaoyue Jia, Wang Zhou |
| 2025 | A Multi-expert Collaborative Framework for Multimodal Named Entity Recognition. | Bo Xu, Haiqi Jiang, Shouang Wei, Ming Du, Hui Song, Hongya Wang |
| 2025 | One-Shot Generative Domain Adaptation by Constructing Self-amplifying Datasets. | Yanru Xiang, Yi Li |
| 2025 | Joint Decision Network with Modality-Specific and Dual Interactive Features for Fake News Detection. | Fei Wu, Ruixuan Zhou, Yimu Ji, Xiao-Yuan Jing |
| 2025 | Chain of Thought Guided Few-Shot Fine-Tuning of LLMs for Multimodal Aspect-Based Sentiment Classification. | Hao Wu, Danping Yang, Peng Liu, Xianxian Li |
| 2025 | Optimally Planning Drone Trajectories to Capture 3D Gaussian Splatting Objects. | Cheng-Yuan Wu, Yuan-Chun Sun, Cheng-Tse Lee, Cheng-Hsin Hsu |
| 2025 | Zero-Shot Sketch-Based Image Retrieval with Hybrid Information Fusion and Sample Relationship Modeling. | Weijie Wu, Jun Li, Zhijian Wu, Jianhua Xu |
| 2025 | TS-MEFM: A New Multimodal Speech Emotion Recognition Network Based on Speech and Text Fusion. | Wei Wei, Bingkun Zhang, Yibing Wang |
| 2025 | TACST: Time-Aware Transformer for Robust Speech Emotion Recognition. | Wei Wei, Bingkun Zhang, Yibing Wang |
| 2025 | SelectSum: Topic-Based Selective Summarization of Speech-Based Videos. | Jobin Idiculla Wattaseril, Jrgen Dllner |
| 2025 | Saliency Guided Optimization of Diffusion Latents. | Xiwen Wang, Jizhe Zhou, Xuekang Zhu, Cheng Li, Mao Li |
| 2025 | PianoPal: A Robotic Multimedia System for Interactive Piano Instruction Based on Q-Learning and Real-Time Feedback. | Yufei Wang, Junfeng Yao, Zefeng Wang |
| 2025 | Camouflaged Object Detection Based on Localization Guidance and Multi-scale Refinement. | Jinyang Wang, Wei Wu |
| 2025 | EIA: Edge-Aware Imperceptible Adversarial Attacks on 3D Point Clouds. | Zhensu Wang, Weilong Peng, Le Wang, Zhizhe Wu, Peican Zhu, Keke Tang |
| 2025 | LLMs-Based Augmentation for Domain Adaptation in Long-Tailed Food Datasets. | Qing Wang, Chong-Wah Ngo, Ee-Peng Lim, Qianru Sun |
| 2025 | MC-YOLO: Multi-scale Transmission Line Defect Target Recognition Network. | Jingdong Wang, Xu Ding, Fanqi Meng |
| 2025 | MSA-Former: Multi-scale Adaptive Transformer for Image Snow Removal. | Bin Wang, Zekun Chen, Lei Zhang, Shili Liang, Sijia Guo, Xinyu Kang, Huajing Li |
| 2025 | AMFT-YOLO: A Adaptive Multi-scale YOLO Algorithm with Multi-level Feature Fusion for Object Detection in UAV Scenes. | Tiebiao Wang, Zhenchao Cui, Xiaoyang Li |
| 2025 | Frequency-Based Unsupervised Low-Light Image Enhancement Framework. | Haodian Wang |
| 2025 | ViewsInsight2.0: Enhancing Video Retrieval for VBS 2025 with an Automatic Query Generator Powered by Large Language Models. | Gia-Huy Vuong, Van-Son Ho, Tien-Thanh Nguyen-Dang, Xuan-Dang Thai, Minh-Quan Ho-Le, Tu-Khiem Le, Minh-Khoi Pham, Van-Tu Ninh, Cathal Gurrin, Minh-Triet Tran |
| 2025 | Leveraging Pruning, Quantization and Multi-objective Optimization for an Efficient Deployment of Multi-modal Models. | Dang Vu, Tien Dang, Quoc-Trung Nguyen, Tan Pham |
| 2025 | Comparative Analysis of Relevance Feedback Techniques for Image Retrieval. | Lucia Vadicamo, Francesca Scotti, Alan Dearle, Richard Connor |
| 2025 | Kiite World: Socializing Map-Based Music Exploration Through Playlist Sharing and Synchronized Listening. | Kosetsu Tsukuda, Takumi Takahashi, Keisuke Ishida, Masahiro Hamasaki, Masataka Goto |