| 2026 | ICPR | Knowledge-Integrated Reasoning: A Novel Approach for External Knowledge Based Visual Question Answering. | Pyry Satama, Abduljalil Radman, Jorma Laaksonen |
| 2025 | CVPR | TSAM: Temporal SAM Augmented with Multimodal Prompts for Referring Audio-Visual Segmentation. | Abduljalil Radman, Jorma Laaksonen |
| 2025 | EMNLP | Learning to Describe Implicit Changes: Noise-robust Pre-training for Image Difference Captioning. | Zixin Guo, Jiayang Sun, Tzu-Jui Julius Wang, Abduljalil Radman, Selen Pehlivan, Min Cao, Jorma Laaksonen |
| 2025 | NAACL | CAMEL-Bench: A Comprehensive Arabic LMM Benchmark. | Sara Ghaboura, Ahmed Heakl, Omkar Thawakar, Ali Husain Salem Abdulla Alharthi, Ines Riahi, Abduljalil Radman, Jorma Laaksonen, Fahad Shahbaz Khan, Salman Khan, Rao Muhammad Anwer |
| 2024 | VISIGRAPP | AV-PEA: Parameter-Efficient Adapter for Audio-Visual Multimodal Learning. | Abduljalil Radman, Jorma Laaksonen |
| 2023 | SIGIR | PiTL: Cross-modal Retrieval with Weakly-supervised Vision-language Pre-training via Prompting. | Zixin Guo, Tzu-Jui Julius Wang, Selen Pehlivan, Abduljalil Radman, Jorma Laaksonen |