| 2025 | ECAI | Pessimistic Iterative Planning with RNNs for Robust POMDPs. | Maris F. L. Galesloot, Marnix Suilen, Thiago D. Simo, Steven Carr, Matthijs T. J. Spaan, Ufuk Topcu, Nils Jansen |
| 2025 | ICAART | Making Reinforcement Learning Safer via Curriculum Learning. | Kelvin Toonen, Thiago D. Simo |
| 2025 | ICLR | Safety-Prioritizing Curricula for Constrained Reinforcement Learning. | Cevahir Kprl, Thiago D. Simo, Nils Jansen, Ufuk Topcu |
| 2025 | ICLR | Robust Transfer of Safety-Constrained Reinforcement Learning Agents. | Markel Zubia, Thiago D. Simo, Nils Jansen |
| 2024 | AAAI | Factored Online Planning in Many-Agent POMDPs. | Maris F. L. Galesloot, Thiago D. Simo, Sebastian Junges, Nils Jansen |
| 2024 | AAAI | Robust Active Measuring under Model Uncertainty. | Merlijn Krale, Thiago D. Simo, Jana Tumova, Nils Jansen |
| 2024 | ICAART | A Supervised Learning Approach to Robust Reinforcement Learning for Job Shop Scheduling. | Christoph Schmidl, Thiago D. Simo, Nils Jansen |
| 2024 | ICML | Scalable Safe Policy Improvement for Factored Multi-Agent MDPs. | Federico Bianchi, Edoardo Zorzi, Alberto Castellini, Thiago D. Simo, Matthijs T. J. Spaan, Alessandro Farinelli |
| 2023 | AAAI | Safe Policy Improvement for POMDPs via Finite-State Controllers. | Thiago D. Simo, Marnix Suilen, Nils Jansen |
| 2023 | ECAI | Reinforcement Learning by Guided Safe Exploration. | Qisong Yang, Thiago D. Simo, Nils Jansen, Simon H. Tindemans, Matthijs T. J. Spaan |
| 2023 | ICAART | Targeted Adversarial Attacks on Deep Reinforcement Learning Policies via Model Checking. | Dennis Gross, Thiago D. Simo, Nils Jansen, Guillermo A. Prez |
| 2023 | ICLR | Safe Reinforcement Learning From Pixels Using a Stochastic Latent Representation. | Yannick Hogewind, Thiago D. Simo, Tal Kachman, Nils Jansen |
| 2023 | ICML | Scalable Safe Policy Improvement via Monte Carlo Tree Search. | Alberto Castellini, Federico Bianchi, Edoardo Zorzi, Thiago D. Simo, Alessandro Farinelli, Matthijs T. J. Spaan |
| 2023 | IJCAI | Recursive Small-Step Multi-Agent A* for Dec-POMDPs. | Wietze Koops, Nils Jansen, Sebastian Junges, Thiago D. Simo |
| 2023 | IJCAI | More for Less: Safe Policy Improvement with Stronger Performance Guarantees. | Patrick Wienhft, Marnix Suilen, Thiago D. Simo, Clemens Dubslaff, Christel Baier, Nils Jansen |
| 2023 | UAI | Risk-aware curriculum generation for heavy-tailed task distributions. | Cevahir Kprl, Thiago D. Simo, Nils Jansen, Ufuk Topcu |
| 2021 | AAAI | WCSAC: Worst-Case Soft Actor Critic for Safety-Constrained Reinforcement Learning. | Qisong Yang, Thiago D. Simo, Simon H. Tindemans, Matthijs T. J. Spaan |
| 2019 | AAAI | Safe Policy Improvement with Baseline Bootstrapping in Factored Environments. | Thiago D. Simo, Matthijs T. J. Spaan |
| 2019 | IJCAI | Safe and Sample-Efficient Reinforcement Learning Algorithms for Factored Environments. | Thiago D. Simo |
| 2019 | IJCAI | Structure Learning for Safe Policy Improvement. | Thiago D. Simo, Matthijs T. J. Spaan |