Skip to content

RLKD: Distilling LLMs' Reasoning via Reinforcement Learning.

Shicheng Xu, Liang Pang, Yunchang Zhu, Jia Gu, Zihao Wei, Jingcheng Deng, Feiyang Pan, Huawei Shen, Xueqi Cheng

VenueA*AAAI
Year2026
ProceedingsAAAI

Browse the full AAAI paper archive.