Skip to content

Off-Policy Correction for Deep Deterministic Policy Gradient Algorithms via Batch Prioritized Experience Replay.

Dogan Can iek, Enes Duran, Baturay Saglam, Furkan B. Mutlu, Suleyman S. Kozat

VenueBICTAI
Year2021
ProceedingsICTAI

Browse the full ICTAI paper archive.