Dueling Posterior Sampling for Preference-Based Reinforcement Learning.
Ellen R. Novoseller, Yibing Wei, Yanan Sui, Yisong Yue, Joel Burdick
Browse the full UAI paper archive.
Ellen R. Novoseller, Yibing Wei, Yanan Sui, Yisong Yue, Joel Burdick
Browse the full UAI paper archive.