On Instance-Dependent Bounds for Offline Reinforcement Learning with Linear Function Approximation.
Thanh Nguyen-Tang, Ming Yin, Sunil Gupta, Svetha Venkatesh, Raman Arora
Browse the full AAAI paper archive.
Thanh Nguyen-Tang, Ming Yin, Sunil Gupta, Svetha Venkatesh, Raman Arora
Browse the full AAAI paper archive.