| 2025 | ICCV | A Signer-Invariant Conformer and Multi-Scale Fusion Transformer for Continuous Sign Language Recognition. | Md. Rezwanul Haque, Md. Milon Islam, S. M. Taslim Uddin Raju, Fakhri Karray |
| 2025 | ICCV | FusionEnsembleNet: An Attention-Based Ensemble of Spatiotemporal Networks for Multimodal Sign Language Recognition. | Md. Milon Islam, Md. Rezwanul Haque, S. M. Taslim Uddin Raju, Fakhri Karray |
| 2025 | IJCNN | GNN-ViTCap: GNN-Enhanced Multiple Instance Learning with Vision Transformers for Whole Slide Image Classification and Captioning. | S. M. Taslim Uddin Raju, Md. Milon Islam, Md. Rezwanul Haque, Hamdi Altaheri, Fakhri Karray |
| 2025 | SMC | MMFformer: Multimodal Fusion Transformer Network for Depression Detection. | Md. Rezwanul Haque, Md. Milon Islam, S. M. Taslim Uddin Raju, Hamdi Altaheri, Lobna Nassar, Fakhri Karray |
| 2025 | SMC | MDD-Net: Multimodal Depression Detection through Mutual Transformer. | Md. Rezwanul Haque, Md. Milon Islam, S. M. Taslim Uddin Raju, Hamdi Altaheri, Lobna Nassar, Fakhri Karray |
| 2024 | SMC | TransUAAE-CapGen: Caption Generation from Histopathological Patches through Transformer and UNet-Based Adversarial Autoencoder. | S. M. Taslim Uddin Raju, Abdul Raqeeb Mohammad, Md. Milon Islam, Fakhri Karray |
| 2022 | SMC | Multimodal Human Activity Recognition for Smart Healthcare Applications. | Md. Milon Islam, Sheikh Nooruddin, Fakhri Karray |