Routing to the Expert: Efficient Reward-guided Ensemble of Large Language Models.
Keming Lu, Hongyi Yuan, Runji Lin, Junyang Lin, Zheng Yuan, Chang Zhou, Jingren Zhou
Browse the full NAACL paper archive.
Keming Lu, Hongyi Yuan, Runji Lin, Junyang Lin, Zheng Yuan, Chang Zhou, Jingren Zhou
Browse the full NAACL paper archive.