Stochastic policy gradient reinforcement learning on a simple 3D biped.
Russ Tedrake, Teresa Weirui Zhang, H. Sebastian Seung
Browse the full IROS paper archive.
Russ Tedrake, Teresa Weirui Zhang, H. Sebastian Seung
Browse the full IROS paper archive.