Skip to content

Policy Gradient with Tree Search (PGTS) in Reinforcement Learning Evades Local Maxima.

Navdeep Kumar, Priyank Agrawal, Kfir Yehuda Levy, Shie Mannor

VenueA*ICLR
Year2024
ProceedingsTiny Papers @ ICLR

Browse the full ICLR paper archive.