DogeRM: Equipping Reward Models with Domain Knowledge through Model Merging.
Tzu-Han Lin, Chen-An Li, Hung-yi Lee, Yun-Nung Chen
Browse the full EMNLP paper archive.
Tzu-Han Lin, Chen-An Li, Hung-yi Lee, Yun-Nung Chen
Browse the full EMNLP paper archive.