Skip to content

Can Prompt Difficulty be Online Predicted for Accelerating RL Finetuning of Reasoning Models?

Yun Qu, Qi Wang, Yixiu Mao, Vincent Tao Hu, Bjrn Ommer, Xiangyang Ji

VenueA*KDD
Year2026
ProceedingsKDD (1)

Browse the full KDD paper archive.