EMTIR-GRPO: Efficient Multi-Tool Augmented Large Language Models via Reinforcement Learning.
Shixin Jiang, Zhihao Zhu, Jiafeng Liang, Yang Wu, Ming Liu, Bing Qin
Browse the full ACL paper archive.
Shixin Jiang, Zhihao Zhu, Jiafeng Liang, Yang Wu, Ming Liu, Bing Qin
Browse the full ACL paper archive.