Skip to content

A Dynamic and Task-Independent Reward Shaping Approach for Discrete Partially Observable Markov Decision Processes.

Sepideh Nahali, Hajer Ayadi, Jimmy X. Huang, Esmat Pakizeh, Mir Mohsen Pedram, Leila Safari

VenueBPAKDD
Year2023
ProceedingsPAKDD (2)

Browse the full PAKDD paper archive.