Skip to content

From General Reward to Targeted Reward: Improving Open-ended Long-context Generation Models.

Zhihan Guo, Jiele Wu, Wenqian Cui, Yifei Zhang, Minda Hu, Yufei Wang, Irwin King

VenueA*EMNLP
Year2025
ProceedingsEMNLP

Browse the full EMNLP paper archive.