Skip to content

A Systematic Survey and Critical Review on Evaluating Large Language Models: Challenges, Limitations, and Recommendations.

Md. Tahmid Rahman Laskar, Sawsan Alqahtani, M. Saiful Bari, Mizanur Rahman, Mohammad Abdullah Matin Khan, Haidar Khan, Israt Jahan, Amran Bhuiyan, Chee-Wei Tan, Md. Rizwan Parvez, Enamul Hoque, Shafiq Joty, Jimmy Huang

VenueA*EMNLP
Year2024
ProceedingsEMNLP

Browse the full EMNLP paper archive.