Skip to content

Instance-Dependent Complexity of Contextual Bandits and Reinforcement Learning: A Disagreement-Based Perspective.

Dylan J. Foster, Alexander Rakhlin, David Simchi-Levi, Yunzong Xu

VenueA*COLT
Year2021
ProceedingsCOLT

Browse the full COLT paper archive.