Skip to content

Advantage based value iteration for Markov decision processes with unknown rewards.

Pegah Alizadeh, Yann Chevaleyre, Franois Lvy

VenueBIJCNN
Year2016
ProceedingsIJCNN

Browse the full IJCNN paper archive.