Skip to content

A Reduction-Based Framework for Conservative Bandits and Reinforcement Learning.

Yunchang Yang, Tianhao Wu, Han Zhong, Evrard Garcelon, Matteo Pirotta, Alessandro Lazaric, Liwei Wang, Simon Shaolei Du

VenueA*ICLR
Year2022
ProceedingsICLR

Browse the full ICLR paper archive.