Skip to content

RLPF: Reinforcement Learning from Prediction Feedback for User Summarization with LLMs.

Jiaxing Wu, Lin Ning, Luyang Liu, Harrison Lee, Neo Wu, Chao Wang, Sushant Prakash, Shawn O'Banion, Bradley Green, Jun Xie

VenueA*AAAI
Year2025
ProceedingsAAAI

Browse the full AAAI paper archive.