To Err Is Human, How about Medical Large Language Models? Comparing Pre-trained Language Models for Medical Assessment Errors and Reliability.
Wen-Wai Yim, Yujuan Fu, Asma Ben Abacha, Meliha Yetisgen
Browse the full COLING paper archive.
Wen-Wai Yim, Yujuan Fu, Asma Ben Abacha, Meliha Yetisgen
Browse the full COLING paper archive.