Average-Reward Reinforcement Learning with Trust Region Methods.
Xiaoteng Ma, Xiaohang Tang, Li Xia, Jun Yang, Qianchuan Zhao
Browse the full IJCAI paper archive.
Xiaoteng Ma, Xiaohang Tang, Li Xia, Jun Yang, Qianchuan Zhao
Browse the full IJCAI paper archive.