Skip to content

Weighted-Reward Preference Optimization for Implicit Model Fusion.

Ziyi Yang, Fanqi Wan, Longguang Zhong, Tianyuan Shi, Xiaojun Quan

VenueA*ICLR
Year2025
ProceedingsICLR

Browse the full ICLR paper archive.