Skip to content

M. Saiful Bari

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

18

Venues

6

Active years

2020–2026

Best venue rank

A*

Where they publish

Papers

18 indexed papers, newest first.

YearVenueTitleAuthors
2026EACLStop Taking Tokenizers for Granted: They Are Core Design Decisions in Large Language Models.Sawsan Alqahtani, Mir Tafseer Nayeem, Md. Tahmid Rahman Laskar, Tasnim Mohiuddin, M. Saiful Bari
2025ACLZeroSumEval: An Extensible Framework For Scaling LLM Evaluation with Inter-Model Competition.Hisham Abdullah Alyahya, Haidar Khan, Yazeed Alnumay, M. Saiful Bari, Blent Yener
2025EMNLPAraEval: An Arabic Multi-Task Evaluation Suite for Large Language Models.Alhanoof Althnian, Norah A. Alzahrani, Shaykhah Z. Alsubaie, Eman Albilali, Ahmed Abdelali, Nouf M. Alotaibi, M. Saiful Bari, Yazeed Alnumay, Abdulhamed Alothaimen, Maryam Saif, Shahad D. Alzaidi, Faisal Abdulrahman Mirza, Yousef Almushayqih, Mohammed Al Saleem, Ghadah Alabduljabbar, Abdulmohsen Al-Thubaity, Areeb Alowisheq, Nora Al-Twairesh
2025ICLRALLaM: Large Language Models for Arabic and English.M. Saiful Bari, Yazeed Alnumay, Norah A. Alzahrani, Nouf M. Alotaibi, Hisham Abdullah Alyahya, Sultan Alrashed, Faisal Abdulrahman Mirza, Shaykhah Z. Alsubaie, Hassan A. Alahmed, Ghadah Alabduljabbar, Raghad Alkhathran, Yousef Almushayqih, Raneem Alnajim, Salman Alsubaihi, Maryam Al Mansour, Saad Amin Hassan, Majed Alrubaian, Ali Alammari, Zaki Alawami, Abdulmohsen Al-Thubaity, et al.
2024ACLWhen Benchmarks are Targets: Revealing the Sensitivity of Large Language Model Leaderboards.Norah A. Alzahrani, Hisham Abdullah Alyahya, Yazeed Alnumay, Sultan Alrashed, Shaykhah Alsubaie, Yousef Almushayqih, Faisal Mirza, Nouf Alotaibi, Nora Al-Twairesh, Areeb Alowisheq, M. Saiful Bari, Haidar Khan
2024ACLXCodeEval: An Execution-based Large Scale Multilingual Multitask Benchmark for Code Understanding, Generation, Translation and Retrieval.Mohammad Abdullah Matin Khan, M. Saiful Bari, Xuan Do Long, Weishi Wang, Md. Rizwan Parvez, Shafiq Joty
2024COLINGBenLLM-Eval: A Comprehensive Evaluation into the Potentials and Pitfalls of Large Language Models on Bengali NLP.Mohsinul Kabir, Mohammed Saidul Islam, Md. Tahmid Rahman Laskar, Mir Tafseer Nayeem, M. Saiful Bari, Enamul Hoque
2024EMNLPA Systematic Survey and Critical Review on Evaluating Large Language Models: Challenges, Limitations, and Recommendations.Md. Tahmid Rahman Laskar, Sawsan Alqahtani, M. Saiful Bari, Mizanur Rahman, Mohammad Abdullah Matin Khan, Haidar Khan, Israt Jahan, Amran Bhuiyan, Chee-Wei Tan, Md. Rizwan Parvez, Enamul Hoque, Shafiq Joty, Jimmy Huang
2023ACLA Systematic Study and Comprehensive Evaluation of ChatGPT on Benchmark Datasets.Md. Tahmid Rahman Laskar, M. Saiful Bari, Mizanur Rahman, Md Amran Hossen Bhuiyan, Shafiq Joty, Jimmy Xiangji Huang
2023ACLCrosslingual Generalization through Multitask Finetuning.Niklas Muennighoff, Thomas Wang, Lintang Sutawika, Adam Roberts, Stella Biderman, Teven Le Scao, M. Saiful Bari, Sheng Shen, Zheng Xin Yong, Hailey Schoelkopf, Xiangru Tang, Dragomir Radev, Alham Fikri Aji, Khalid Almubarak, Samuel Albanie, Zaid Alyafeai, Albert Webson, Edward Raff, Colin Raffel
2023ACLBLOOM+1: Adding Language Support to BLOOM for Zero-Shot Prompting.Zheng Xin Yong, Hailey Schoelkopf, Niklas Muennighoff, Alham Fikri Aji, David Ifeoluwa Adelani, Khalid Almubarak, M. Saiful Bari, Lintang Sutawika, Jungo Kasai, Ahmed Baruwa, Genta Indra Winata, Stella Biderman, Edward Raff, Dragomir Radev, Vassilina Nikoulina
2022ACLPromptSource: An Integrated Development Environment and Repository for Natural Language Prompts.Stephen H. Bach, Victor Sanh, Zheng Xin Yong, Albert Webson, Colin Raffel, Nihal V. Nayak, Abheesht Sharma, Taewoon Kim, M. Saiful Bari, Thibault Fvry, Zaid Alyafeai, Manan Dey, Andrea Santilli, Zhiqing Sun, Srulik Ben-David, Canwen Xu, Gunjan Chhablani, Han Wang, Jason Alan Fries, Maged Saeed AlShaibani, Shanya Sharma, Urmish Thakker, Khalid Almubarak, Xiangru Tang, Dragomir R. Radev, Mike Tian-Jian Jiang, Alexander M. Rush
2022EMNLPWhat Language Model to Train if You Have One Million GPU Hours?Teven Le Scao, Thomas Wang, Daniel Hesslow, Lucile Saulnier, Stas Bekman, M. Saiful Bari, Stella Biderman, Hady Elsahar, Niklas Muennighoff, Jason Phang, Ofir Press, Colin Raffel, Victor Sanh, Sheng Shen, Lintang Sutawika, Jaesung Tae, Zheng Xin Yong, Julien Launay, Iz Beltagy
2021ACLUXLA: A Robust Unsupervised Data Augmentation Framework for Zero-Resource Cross-Lingual NLP.M. Saiful Bari, Tasnim Mohiuddin, Shafiq R. Joty
2021ACLAugVic: Exploiting BiText Vicinity for Low-Resource NMT.Tasnim Mohiuddin, M. Saiful Bari, Shafiq R. Joty
2021EMNLPNearest Neighbour Few-Shot Learning for Cross-lingual Classification.M. Saiful Bari, Batool Haider, Saab Mansour
2020AAAIZero-Resource Cross-Lingual Named Entity Recognition.M. Saiful Bari, Shafiq R. Joty, Prathyusha Jwalapuram
2020EMNLPLNMap: Departures from Isomorphic Assumption in Bilingual Lexicon Induction Through Non-Linear Mapping in Latent Space.Tasnim Mohiuddin, M. Saiful Bari, Shafiq Rayhan Joty