Debate, Reflect, and Distill: Multi-Agent Feedback with Tree-Structured Preference Optimization for Efficient Language Model Enhancement.
Xiaofeng Zhou, Heyan Huang, Lizi Liao
Browse the full ACL paper archive.
Xiaofeng Zhou, Heyan Huang, Lizi Liao
Browse the full ACL paper archive.