Skip to content

MA-RLHF: Reinforcement Learning from Human Feedback with Macro Actions.

Yekun Chai, Haoran Sun, Huang Fang, Shuohuan Wang, Yu Sun, Hua Wu

VenueA*ICLR
Year2025
ProceedingsICLR

Browse the full ICLR paper archive.