Optimizing RAG Rerankers with LLM Feedback via Reinforcement Learning.
Yuhang Wu, Xiangqing Shen, Fanfan Wang, Cangqi Zhou, Zhen Wu, Xinyu Dai, Rui Xia
Browse the full ACL paper archive.
Yuhang Wu, Xiangqing Shen, Fanfan Wang, Cangqi Zhou, Zhen Wu, Xinyu Dai, Rui Xia
Browse the full ACL paper archive.