Skip to content

Reward-Weighted Regression Converges to a Global Optimum.

Miroslav Strupl, Francesco Faccio, Dylan R. Ashley, Rupesh Kumar Srivastava, Jrgen Schmidhuber

VenueA*AAAI
Year2022
ProceedingsAAAI

Browse the full AAAI paper archive.