Skip to content

Variation-resistant Q-learning: Controlling and Utilizing Estimation Bias in Reinforcement Learning for Better Performance.

Andreas Pentaliotis, Marco A. Wiering

VenueBICAART
Year2021
ProceedingsICAART (2)

Browse the full ICAART paper archive.