Skip to content

Regret guarantees for model-based reinforcement learning with long-term average constraints.

Mridul Agarwal, Qinbo Bai, Vaneet Aggarwal

VenueAUAI
Year2022
ProceedingsUAI

Browse the full UAI paper archive.