| 2026 | ICPR | Knowledge-Integrated Reasoning: A Novel Approach for External Knowledge Based Visual Question Answering. | Pyry Satama, Abduljalil Radman, Jorma Laaksonen |
| 2026 | LREC | ARB: A Comprehensive Arabic Multimodal Reasoning Benchmark. | Sara Ghaboura, Shubham Patle, Ketan More, Wafa Hamad Mohamed Alghallabi, Omkar Thawakar, Jorma Laaksonen, Hisham Cholakkal, Salman Khan, Rao Muhammad Anwer |
| 2025 | CVPR | TSAM: Temporal SAM Augmented with Multimodal Prompts for Referring Audio-Visual Segmentation. | Abduljalil Radman, Jorma Laaksonen |
| 2025 | CVPR | All Languages Matter: Evaluating LMMs on Culturally Diverse 100 Languages. | Ashmal Vayani, Dinura Dissanayake, Hasindri Watawana, Noor Ahsan, Nevasini Sasikumar, Omkar Thawakar, Henok Biadglign Ademtew, Yahya Hmaiti, Amandeep Kumar, Kartik Kuckreja, Mykola Maslych, Wafa Al Ghallabi, Mihail Minkov Mihaylov, Chao Qin, Abdelrahman M. Shaker, Mike Zhang, Mahardika Krisna Ihsani, Amiel Gian Esplana, Monil Gokani, Shachar Mirkin, Harsh Singh, Ashay Srivastava, Endre Hamerlik, Fathinah Asma Izzati, Fadillah Adamsyah Maani, Sebastian Cavada, Jenny Chim, Rohit Gupta, Sanjay Manjunath, Kamila Zhumakhanova, Feno Heriniaina Rabevohitra, Azril Hafizi Amirudin, Muhammad Ridzuan, Daniya Najiha Abdul Kareem, Ketan Pravin More, Kunyang Li, Pramesh Shakya, Muhammad Saad, Amirpouya Ghasemaghaei, Amirbek Djanibekov, Dilshod Azizov, Branislava Jankovic, Naman Bhatia, Alvaro Cabrera, Johan S. Obando-Ceron, Olympiah Otieno, Fabian Farestam, Muztoba Rabbani, Sanoojan Baliah, Santosh Sanjeev, Abduragim Shtanchaev, Maheen Fatima, Thao Nguyen, Amrin Kareem, Toluwani Aremu, Nathan Augusto Zacarias Xavier, Amit Bhatkal, Hawau Olamide Toyin, Aman Chadha, Hisham Cholakkal, Rao Muhammad Anwer, Michael Felsberg, Jorma Laaksonen, Thamar Solorio, Monojit Choudhury, Ivan Laptev, Mubarak Shah, Salman H. Khan, Fahad Shahbaz Khan |
| 2025 | EMNLP | Learning to Describe Implicit Changes: Noise-robust Pre-training for Image Difference Captioning. | Zixin Guo, Jiayang Sun, Tzu-Jui Julius Wang, Abduljalil Radman, Selen Pehlivan, Min Cao, Jorma Laaksonen |
| 2025 | NAACL | CAMEL-Bench: A Comprehensive Arabic LMM Benchmark. | Sara Ghaboura, Ahmed Heakl, Omkar Thawakar, Ali Husain Salem Abdulla Alharthi, Ines Riahi, Abduljalil Radman, Jorma Laaksonen, Fahad Shahbaz Khan, Salman Khan, Rao Muhammad Anwer |
| 2024 | ACCV | Diffusion-Based Multimodal Video Captioning. | Jaakko Kainulainen, Zixin Guo, Jorma Laaksonen |
| 2024 | COLING | Text-to-Multimodal Retrieval with Bimodal Input Fusion in Shared Cross-Modal Transformer. | Pranav Arora, Selen Pehlivan, Jorma Laaksonen |
| 2024 | ICPR | Size-Modulated Deformable Attention in Spatio-Temporal Video Grounding Pipelines. | Hans Tiwari, Selen Pehlivan, Jorma Laaksonen |
| 2024 | IGARSS | A Comparison of Hyperspectral Super-Resolution Techniques for Boreal Forest Imagery. | Yuvrajsinh Chudasama, Usman Muhammad, Ville Mayra, Florent Guiotte, Jorma Laaksonen |
| 2024 | IGARSS | Mesh Surface And Morphological Hierarchies For Individual Tree Detection And Segmentation From LiDAR Data. | Florent Guiotte, Joel Kostensalo, Jorma Laaksonen |
| 2024 | VISIGRAPP | AV-PEA: Parameter-Efficient Adapter for Audio-Visual Multimodal Learning. | Abduljalil Radman, Jorma Laaksonen |
| 2023 | CVPR | Person Image Synthesis via Denoising Diffusion Model. | Ankan Kumar Bhunia, Salman H. Khan, Hisham Cholakkal, Rao Muhammad Anwer, Jorma Laaksonen, Mubarak Shah, Fahad Shahbaz Khan |
| 2023 | MICCAI | Cross-Modulated Few-Shot Image Generation for Colorectal Tissue Classification. | Amandeep Kumar, Ankan Kumar Bhunia, Sanath Narayan, Hisham Cholakkal, Rao Muhammad Anwer, Jorma Laaksonen, Fahad Shahbaz Khan |
| 2023 | MICCAI | 3D Mitochondria Instance Segmentation with Spatio-Temporal Transformers. | Omkar Thawakar, Rao Muhammad Anwer, Jorma Laaksonen, Orly Reiner, Mubarak Shah, Fahad Shahbaz Khan |
| 2023 | SIGIR | PiTL: Cross-modal Retrieval with Weakly-supervised Vision-language Pre-training via Prompting. | Zixin Guo, Tzu-Jui Julius Wang, Selen Pehlivan, Abduljalil Radman, Jorma Laaksonen |
| 2023 | WACV | Learning by Hallucinating: Vision-Language Pre-training with Weak Supervision. | Tzu-Jui Julius Wang, Jorma Laaksonen, Tomas Langer, Heikki Arponen, Tom E. Bishop |
| 2022 | COLING | When to Laugh and How Hard? A Multimodal Approach to Detecting Humor and Its Intensity. | Khalid Alnajjar, Mika Hmlinen, Jrg Tiedemann, Jorma Laaksonen, Mikko Kurimo |
| 2022 | ECCV | DoodleFormer: Creative Sketch Drawing with Transformers. | Ankan Kumar Bhunia, Salman Khan, Hisham Cholakkal, Rao Muhammad Anwer, Fahad Shahbaz Khan, Jorma Laaksonen, Michael Felsberg |
| 2022 | ICPR | Post-Attention Modulator for Dense Video Captioning. | Zixin Guo, Tzu-Jui Julius Wang, Jorma Laaksonen |
| 2022 | IJCNLP | CLIP4IDC: CLIP for Image Difference Captioning. | Zixin Guo, Tzu-Jui Julius Wang, Jorma Laaksonen |
| 2021 | HCI | When Worlds Collide: AI-Created, Human-Mediated Video Description Services and the User Experience. | Sabine Braun, Kim Starr, Jaleh Delfani, Liisa Tiittula, Jorma Laaksonen, Karel Braeckman, Dieter Van Rijsselbergen, Sasha Lagrillire, Lauri Saarikoski |
| 2021 | IGARSS | Patch Size Selection for Analysis of Sub-Meter Resolution Hyperspectral Imagery of Forests. | Matti Mottus, Matthieu Molinier, Eelis Halme, Hai Cu, Jorma Laaksonen |
| 2020 | BMVC | Tackling the Unannotated: Scene Graph Generation with Bias-Reduced Models. | Tzu-Jui Julius Wang, Selen Pehlivan, Jorma Laaksonen |
| 2019 | CAIP | Multi-stream Convolutional Networks for Indoor Scene Recognition. | Rao Muhammad Anwer, Fahad Shahbaz Khan, Jorma Laaksonen, Nazar Zaki |
| 2019 | ICCV | Deep Contextual Attention for Human-Object Interaction Detection. | Tiancai Wang, Rao Muhammad Anwer, Muhammad Haris Khan, Fahad Shahbaz Khan, Yanwei Pang, Ling Shao, Jorma Laaksonen |
| 2019 | ICIP | A Multi-Task Bayesian Deep Neural Net for Detecting Life-Threatening Infant Incidents From Head Images. | Tzu-Jui Julius Wang, Jorma Laaksonen, Yi-Ping Liao, Bo-Zong Wu, Shih-Yun Shen |
| 2017 | CVPR | Saliency Revisited: Analysis of Mouse Movements Versus Fixations. | Hamed R. Tavakoli, Fawad Ahmed, Ali Borji, Jorma Laaksonen |
| 2017 | CVPR | Fixation Prediction in Videos Using Unsupervised Hierarchical Features. | Julius Wang, Hamed R. Tavakoli, Jorma Laaksonen |
| 2017 | EJC | VisualLabel: An Integrated Multimedia Content Management and Access Framework. | Iftikhar Ahmad, Petri Rantanen, Pekka Sillberg, Jorma Laaksonen, Shuhua Liu, Thomas Forss, Aqdas Malik, Marko Nieminen, Rakshith Shetty, Satoru Ishikawa, Jarno Kallio, Jukka P. Saarinen, Moncef Gabbouj, Jari Soini |
| 2017 | ICCV | Paying Attention to Descriptions Generated by Image Captioning Models. | Hamed R. Tavakoli, Rakshith Shetty, Ali Borji, Jorma Laaksonen |
| 2017 | IJCNN | Image pseudo tag generation with Deep Boltzmann machine anc topic-concept similarity map. | Satoru Ishikawa, Jorma Laaksonen, Juha Karhunen |
| 2017 | ISM | Computational and Perceptual Determinants of Film Mood in Different Types of Scenes. | Jussi Tarvainen, Jorma Laaksonen, Tapio Takala |
| 2016 | ACCV | Bottom-Up Fixation Prediction Using Unsupervised Hierarchical Models. | Hamed Rezazadegan Tavakoli, Jorma Laaksonen |
| 2016 | CBMI | Comparing and combining unimodal methods for multimodal recognition. | Satoru Ishikawa, Jorma Laaksonen |
| 2016 | ISVC | Preliminary Studies on Personalized Preference Prediction from Gaze in Comparing Visualizations. | Hamed Rezazadegan Tavakoli, Hanieh Poostchi, Jaakko Peltonen, Jorma Laaksonen, Samuel Kaski |
| 2014 | CBMI | Using semantic features to improve large-scale visual concept detection. | Mats Sjberg, Jorma Laaksonen |
| 2014 | ICASSP | Unsupervised feature extraction for multimedia event detection and ranking using audio content. | Ehsan Amid, Annamaria Mesaros, Kalle J. Palomki, Jorma Laaksonen, Mikko Kurimo |
| 2014 | ICPR | Experiments on Recognising the Handshape in Blobs Extracted from Sign Language Videos. | Ville Viitaniemi, Matti Karppa, Jorma Laaksonen |
| 2014 | LREC | SLMotion - An extensible sign language oriented video analysis tool. | Matti Karppa, Ville Viitaniemi, Marcos Luzardo, Jorma Laaksonen, Tommi Jantunen |
| 2014 | LREC | S-pot - a benchmark in spotting signs within continuous signing. | Ville Viitaniemi, Tommi Jantunen, Leena Savolainen, Matti Karppa, Jorma Laaksonen |
| 2013 | ICMI | Adaptive timeline interface to personal history data. | Antti Ajanki, Markus Koskela, Jorma Laaksonen, Samuel Kaski |
| 2013 | ICONIP | Affective Abstract Image Classification and Retrieval Using Multiple Kernel Learning. | He Zhang, Zhirong Yang, Mehmet Gnen, Markus Koskela, Jorma Laaksonen, Timo Honkela, Erkki Oja |
| 2012 | ICPR | Real-time large-scale visual concept detection with linear classifiers. | Mats Sjberg, Markus Koskela, Satoru Ishikawa, Jorma Laaksonen |
| 2012 | LREC | Comparing computer vision analysis of signed language video with motion capture recordings. | Matti Karppa, Tommi Jantunen, Ville Viitaniemi, Jorma Laaksonen, Birgitta Burger, Danny De Weerdt |
| 2011 | ICANN | Gaze- and Speech-Enhanced Content-Based Image Retrieval in Image Tagging. | He Zhang, Teemu Ruokolainen, Jorma Laaksonen, Christina Hochleitner, Rudolf Traunmller |
| 2011 | ICONIP | A Multimodal Information Collector for Content-Based Image Retrieval System. | He Zhang, Mats Sjberg, Jorma Laaksonen, Erkki Oja |
| 2011 | IDA | Analyzing Emotional Semantics of Abstract Art Using Low-Level Image Features. | He Zhang, Eimontas Augilius, Timo Honkela, Jorma Laaksonen, Hannes Gamper, Henok Alene |
| 2010 | ICANN | Region Matching Techniques for Spatial Bag of Visual Words Based Image Category Recognition. | Ville Viitaniemi, Jorma Laaksonen |
| 2010 | ICPR | PicSOM Experiments in ImageCLEF RobotVision. | Mats Sjberg, Markus Koskela, Ville Viitaniemi, Jorma Laaksonen |
| 2009 | ICANN | Image Theft Detection with Self-Organising Maps. | Philip Prentis, Mats Sjberg, Markus Koskela, Jorma Laaksonen |
| 2009 | ICANN | Representing Images with | Ville Viitaniemi, Jorma Laaksonen |
| 2008 | ICANN | Image Classification by Histogram Features Created with Learning Vector Quantization. | Marcin Blachnik, Jorma Laaksonen |
| 2008 | ICONIP | Classification of Fundus Images for Diagnosing Glaucoma by Self-Organizing Map and Learning Vector Quantization. | Nobuo Matsuda, Jorma Laaksonen, Fumiaki Tajima, Hideaki Sato |
| 2007 | ACCV | How Marginal Likelihood Inference Unifies Entropy, Correlation and SNR-Based Stopping in Nonlinear Diffusion Scale-Spaces. | Ramunas Girdziusas, Jorma Laaksonen |
| 2007 | CBMI | Evaluating Performance of Automatic Image Annotation: Example Case by Fusing Global Image Features. | Ville Viitaniemi, Jorma Laaksonen |
| 2007 | ICANN | Face Recognition Using Parzenfaces. | Zhirong Yang, Jorma Laaksonen |
| 2007 | ICCV | When is a Discrete Diffusion a Scale-Space? | Ramunas Girdziusas, Jorma Laaksonen |
| 2007 | IGARSS | Detecting changes in polarimetric SAR data with content-based image retrieval. | Matthieu Molinier, Jorma Laaksonen, Yrj Rauste, Tuomas Hme |
| 2007 | IJCNN | Approximated Geodesic Updates with Principal Natural Gradients. | Zhirong Yang, Jorma Laaksonen |
| 2006 | ICANN | Retrieval of Multimedia Objects by Combining Semantic Information from Visual and Textual Descriptors. | Mats Sjberg, Jorma Laaksonen, Matti Pll, Timo Honkela |
| 2006 | ICANN | Techniques for Still Image Scene Classification and Object Detection. | Ville Viitaniemi, Jorma Laaksonen |
| 2006 | ICANN | A Fast Fixed-Point Algorithm for Two-Class Discriminative Feature Extraction. | Zhirong Yang, Jorma Laaksonen |
| 2006 | IGARSS | A Self-Organizing Map Framework for Detection of Man-Made Structures and Changes in Satellite Imagery. | Matthieu Molinier, Jorma Laaksonen, Tuomas Hme |
| 2005 | ICANN | Jacobi Alternative to Bayesian Evidence Maximization in Diffusion Filtering. | Ramunas Girdziusas, Jorma Laaksonen |
| 2005 | ICANN | Content-Based Retrieval of Web Pages and Other Hierarchical Objects with Self-organizing Maps. | Mats Sjberg, Jorma Laaksonen |
| 2005 | IJCNN | Gaussian processes of nonlinear diffusion filtering. | Ramunas Girdziusas, Jorma Laaksonen |
| 2005 | MVA | Interactive Retrieval in Facial Image Database Using Self-Organizing Maps. | Zhirong Yang, Jorma Laaksonen |
| 2004 | ICONIP | Gaussian Process Regression with Fluid Hyperpriors. | Ramunas Girdziusas, Jorma Laaksonen |
| 2004 | ICPR | Entropy-Based Measures for Clustering and SOM Topology Preservation Applied to Content-Based Image Indexing and Retrieval. | Markus Koskela, Jorma Laaksonen, Erkki Oja |
| 2002 | ICANN | Implementing Relevance Feedback as Convolutions of Local Neighborhoods on Self-Organizing Maps. | Markus Koskela, Jorma Laaksonen, Erkki Oja |
| 2002 | ICFHR | Class-confidence critic combining. | Matti Aksela, Ramunas Girdziusas, Jorma Laaksonen, Erkki Oja, Jari Kangas |
| 2002 | ICPR | Using MPEG-7 Descriptors in Image Retrieval with Self-Organizing Maps. | Markus Koskela, Jorma Laaksonen, Erkki Oja |
| 2002 | ICPR | A Comparison of Techniques for Automatic Clustering of Handwritten Characters. | Vuokko Vuori, Jorma Laaksonen |
| 2001 | ICDAR | Rejection Methods for an Adaptive Committee Classifier. | Matti Aksela, Jorma Laaksonen, Erkki Oja, Jari Kangas |
| 2001 | ICDAR | Speeding Up On-line Recognition of Handwritten Characters by Pruning the Prototype Set. | Vuokko Vuori, Jorma Laaksonen, Erkki Oja, Jari Kangas |
| 2000 | ICPR | Statistical Shape Features in Content-Based Image Retrieval. | Sami S. Brandt, Jorma Laaksonen, Erkki Oja |
| 2000 | ICPR | Controlling On-Line Adaptation of a Prototype-Based Classifier for Handwritten Characters. | Vuokko Vuori, Jorma Laaksonen, Erkki Oja, Jari Kangas |
| 1999 | ICDAR | Dynamically Expanding Context as Committee Adaptation Method in On-Line Recognition of Handwritten Latin Characters. | Jorma Laaksonen, Matti Aksela, Erkki Oja, Jari Kangas |
| 1999 | ICDAR | On-line Adaptation in Recognition of Handwritten Alphanumeric Characters. | Vuokko Vuori, Jorma Laaksonen, Erkki Oja, Jari Kangas |
| 1999 | IJCNN | Adaptive local subspace classifier in on-line recognition of handwritten characters. | Jorma Laaksonen, Matti Aksela, Erkki Oja, Jari Kangas |
| 1999 | IJCNN | PicSOM: self-organizing maps for content-based image retrieval. | Jorma Laaksonen, Markus Koskela, Erkki Oja |
| 1997 | ICANN | Local Subspace Classifier. | Jorma Laaksonen |
| 1996 | ICANN | Subspace Dimension Selection and Averaged Learning Subspace Method in Handwritten Digit Classification. | Jorma Laaksonen, Erkki Oja |
| 1996 | ICPR | Neural network and statistical perspectives of classification. | Lasse Holmstrm, Petri Koistinen, Jorma Laaksonen, Erkki Oja |
| 1991 | Interspeech | A new reliability-based phoneme segmentation method for the "neural" phonetic typewriter. | Jorma Laaksonen |