Muhammad Maaz
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
10
Venues
7
Active years
2019–2025
Best venue rank
A*
Where they publish
Papers
10 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2025 | EMNLP | A Culturally-diverse Multilingual Multimodal Video Benchmark & Model. | Bhuiyan Sanjid Shafique, Ashmal Vayani, Muhammad Maaz, Hanoona Abdul Rasheed, Dinura Dissanayake, Mohammed Irfan Kurpath, Yahya Hmaiti, Go Inoue, Jean Lahoud, Md. Safirur Rashid, Shadid Intisar Quasem, Maheen Fatima, Franco Vidal, Mykola Maslych, Ketan Pravin More, Sanoojan Baliah, Hasindri Watawana, Yuhao Li, Fabian Farestam, Leon Schaller, Roman Tymtsiv, Simon Weber, Hisham Cholakkal, Ivan Laptev, Shin'ichi Satoh, Michael Felsberg, Mubarak Shah, Salman H. Khan, Fahad Shahbaz Khan |
| 2025 | WACV | Palo: A Polyglot Large Multimodal Model for 5B People. | Hanoona Abdul Rasheed, Muhammad Maaz, Abdelrahman M. Shaker, Salman H. Khan, Hisham Cholakkal, Rao Muhammad Anwer, Tim Baldwin, Michael Felsberg, Fahad Shahbaz Khan |
| 2024 | ACL | Video-ChatGPT: Towards Detailed Video Understanding via Large Vision and Language Models. | Muhammad Maaz, Hanoona Abdul Rasheed, Salman Khan, Fahad Khan |
| 2024 | CVPR | GLaMM: Pixel Grounding Large Multimodal Model. | Hanoona Abdul Rasheed, Muhammad Maaz, Sahal Shaji Mullappilly, Abdelrahman M. Shaker, Salman H. Khan, Hisham Cholakkal, Rao Muhammad Anwer, Eric P. Xing, Ming-Hsuan Yang, Fahad Shahbaz Khan |
| 2023 | CVPR | MaPLe: Multi-modal Prompt Learning. | Muhammad Uzair Khattak, Hanoona Abdul Rasheed, Muhammad Maaz, Salman H. Khan, Fahad Shahbaz Khan |
| 2023 | CVPR | Fine-tuned CLIP Models are Efficient Video Learners. | Hanoona Abdul Rasheed, Muhammad Uzair Khattak, Muhammad Maaz, Salman H. Khan, Fahad Shahbaz Khan |
| 2023 | ICCV | SwiftFormer: Efficient Additive Attention for Transformer-based Real-time Mobile Vision Applications. | Abdelrahman M. Shaker, Muhammad Maaz, Hanoona Abdul Rasheed, Salman H. Khan, Ming-Hsuan Yang, Fahad Shahbaz Khan |
| 2022 | ECCV | Class-Agnostic Object Detection with Multi-modal Transformer. | Muhammad Maaz, Hanoona Abdul Rasheed, Salman Khan, Fahad Shahbaz Khan, Rao Muhammad Anwer, Ming-Hsuan Yang |
| 2022 | ECCV | EdgeNeXt: Efficiently Amalgamated CNN-Transformer Architecture for Mobile Vision Applications. | Muhammad Maaz, Abdelrahman M. Shaker, Hisham Cholakkal, Salman H. Khan, Syed Waqas Zamir, Rao Muhammad Anwer, Fahad Shahbaz Khan |
| 2019 | FIT | Controlling Smart-City Traffic using Machine Learning. | Tania Iram, Jawwad Shamsi, Usama Alvi, Saif Ur Rahman, Muhammad Maaz |