Skip to content

An Average-Reward Reinforcement Learning Algorithm for Computing Bias-Optimal Policies.

Sridhar Mahadevan

VenueA*AAAI
Year1996
ProceedingsAAAI/IAAI, Vol. 1

Browse the full AAAI paper archive.