Understanding Large Language Model Performance in Software Engineering: A Large-scale Question Answering Benchmark.
Ruida Hu, Chao Peng, Jingyi Ren, Bo Jiang, Xiangxin Meng, Qinyun Wu, Pengfei Gao, Xinchen Wang, Cuiyun Gao
Browse the full SIGIR paper archive.