RLBOF: Reinforcement Learning from Bayesian Optimization Feedback.
Hailong Huang, Xiubo Liang, Quanwei Zhang, Hongzhi Wang, Xiangdong Li
Browse the full IJCNN paper archive.
Hailong Huang, Xiubo Liang, Quanwei Zhang, Hongzhi Wang, Xiangdong Li
Browse the full IJCNN paper archive.