Skip to content

Muhammad Maaz

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

10

Venues

7

Active years

2019–2025

Best venue rank

A*

Where they publish

Papers

10 indexed papers, newest first.

YearVenueTitleAuthors
2025EMNLPA Culturally-diverse Multilingual Multimodal Video Benchmark & Model.Bhuiyan Sanjid Shafique, Ashmal Vayani, Muhammad Maaz, Hanoona Abdul Rasheed, Dinura Dissanayake, Mohammed Irfan Kurpath, Yahya Hmaiti, Go Inoue, Jean Lahoud, Md. Safirur Rashid, Shadid Intisar Quasem, Maheen Fatima, Franco Vidal, Mykola Maslych, Ketan Pravin More, Sanoojan Baliah, Hasindri Watawana, Yuhao Li, Fabian Farestam, Leon Schaller, Roman Tymtsiv, Simon Weber, Hisham Cholakkal, Ivan Laptev, Shin'ichi Satoh, Michael Felsberg, Mubarak Shah, Salman H. Khan, Fahad Shahbaz Khan
2025WACVPalo: A Polyglot Large Multimodal Model for 5B People.Hanoona Abdul Rasheed, Muhammad Maaz, Abdelrahman M. Shaker, Salman H. Khan, Hisham Cholakkal, Rao Muhammad Anwer, Tim Baldwin, Michael Felsberg, Fahad Shahbaz Khan
2024ACLVideo-ChatGPT: Towards Detailed Video Understanding via Large Vision and Language Models.Muhammad Maaz, Hanoona Abdul Rasheed, Salman Khan, Fahad Khan
2024CVPRGLaMM: Pixel Grounding Large Multimodal Model.Hanoona Abdul Rasheed, Muhammad Maaz, Sahal Shaji Mullappilly, Abdelrahman M. Shaker, Salman H. Khan, Hisham Cholakkal, Rao Muhammad Anwer, Eric P. Xing, Ming-Hsuan Yang, Fahad Shahbaz Khan
2023CVPRMaPLe: Multi-modal Prompt Learning.Muhammad Uzair Khattak, Hanoona Abdul Rasheed, Muhammad Maaz, Salman H. Khan, Fahad Shahbaz Khan
2023CVPRFine-tuned CLIP Models are Efficient Video Learners.Hanoona Abdul Rasheed, Muhammad Uzair Khattak, Muhammad Maaz, Salman H. Khan, Fahad Shahbaz Khan
2023ICCVSwiftFormer: Efficient Additive Attention for Transformer-based Real-time Mobile Vision Applications.Abdelrahman M. Shaker, Muhammad Maaz, Hanoona Abdul Rasheed, Salman H. Khan, Ming-Hsuan Yang, Fahad Shahbaz Khan
2022ECCVClass-Agnostic Object Detection with Multi-modal Transformer.Muhammad Maaz, Hanoona Abdul Rasheed, Salman Khan, Fahad Shahbaz Khan, Rao Muhammad Anwer, Ming-Hsuan Yang
2022ECCVEdgeNeXt: Efficiently Amalgamated CNN-Transformer Architecture for Mobile Vision Applications.Muhammad Maaz, Abdelrahman M. Shaker, Hisham Cholakkal, Salman H. Khan, Syed Waqas Zamir, Rao Muhammad Anwer, Fahad Shahbaz Khan
2019FITControlling Smart-City Traffic using Machine Learning.Tania Iram, Jawwad Shamsi, Usama Alvi, Saif Ur Rahman, Muhammad Maaz