Musical Score Understanding Benchmark: Evaluating Large Language Models' Comprehension of Complete Musical Scores.
Congren Dai, Yue Yang, Krinos Li, Huichi Zhou, Shijie Liang, Zhang Bo, Enyang Liu, Ge Jin, Hongran An, Haosen Zhang, Peiyuan Jing, Kinhei Lee, Zhenxuan Zhang, Xiaobing Li, Maosong Sun
Browse the full ACL paper archive.