Skip to content

Neural Rewards Regression for near-optimal policy identification in Markovian and partial observable environments.

Daniel Schneega, Steffen Udluft, Thomas Martinetz

VenueBESANN
Year2007
ProceedingsESANN

Browse the full ESANN paper archive.