UR² : Unify RAG and Reasoning through Reinforcement Learning.
Weitao Li, Boran Xiang, Xiaolong Wang, Jingyi Ren, Ante Wang, Zhinan Gou, Weizhi Ma, Yang Liu
Browse the full ACL paper archive.
Weitao Li, Boran Xiang, Xiaolong Wang, Jingyi Ren, Ante Wang, Zhinan Gou, Weizhi Ma, Yang Liu
Browse the full ACL paper archive.