Skip to content

Paavo Parmas

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

4

Venues

3

Active years

2018–2025

Best venue rank

A*

Where they publish

Papers

4 indexed papers, newest first.

YearVenueTitleAuthors
2025ICLRNear-Optimal Policy Identification in Robust Constrained Markov Decision Processes via Epigraph Form.Toshinori Kitamura, Tadashi Kozuno, Wataru Kumagai, Kenta Hoshino, Yohei Hosoe, Kazumi Kasaura, Masashi Hamaya, Paavo Parmas, Yutaka Matsuo
2023ICMLModel-based Reinforcement Learning with Scalable Composite Policy Gradient Estimators.Paavo Parmas, Takuma Seno, Yuma Aoki
2021AISTATSA unified view of likelihood ratio and reparameterization gradients.Paavo Parmas, Masashi Sugiyama
2018ICMLPIPPS: Flexible Model-Based Policy Search Robust to the Curse of Chaos.Paavo Parmas, Carl Edward Rasmussen, Jan Peters, Kenji Doya