Skip to content

A Reinforcement Learning Method for Environments with Stochastic Variables: Post-Decision Proximal Policy Optimization with Dual Critic Networks.

Leonardo Kanashiro Felizardo, Edoardo Fadda, Paolo Brandimarte, Emilio Del-Moral-Hernandez, Mari Cristina Vasconcelos Nascimento

VenueBIJCNN
Year2025
ProceedingsIJCNN

Browse the full IJCNN paper archive.