A Dynamic and Task-Independent Reward Shaping Approach for Discrete Partially Observable Markov Decision Processes.
Sepideh Nahali, Hajer Ayadi, Jimmy X. Huang, Esmat Pakizeh, Mir Mohsen Pedram, Leila Safari
Browse the full PAKDD paper archive.
Sepideh Nahali, Hajer Ayadi, Jimmy X. Huang, Esmat Pakizeh, Mir Mohsen Pedram, Leila Safari
Browse the full PAKDD paper archive.