Meta-Rewarding Language Models: Self-Improving Alignment with LLM-as-a-Meta-Judge.
Tianhao Wu, Weizhe Yuan, Olga Golovneva, Jing Xu, Yuandong Tian, Jiantao Jiao, Jason E. Weston, Sainbayar Sukhbaatar
Browse the full EMNLP paper archive.
Tianhao Wu, Weizhe Yuan, Olga Golovneva, Jing Xu, Yuandong Tian, Jiantao Jiao, Jason E. Weston, Sainbayar Sukhbaatar
Browse the full EMNLP paper archive.