Skip to content

Steffen Udluft

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

39

Venues

10

Active years

2006–2026

Best venue rank

A*

Where they publish

Papers

39 indexed papers, newest first.

YearVenueTitleAuthors
2026ESANNPoint-wise Q-value maximization for converging Q-learning in continuous state-spaces.Philipp Wissmann, Daniel Hein, Steffen Udluft, Thomas A. Runkler
2026ESANNEfficient and Resilient Machine Learning for Industrial Applications.Philipp Wissmann, Philip Naumann, Daniel Hein, Steffen Udluft, Marc Weber, Simon Leszek, Thomas A. Runkler
2025ESANNTEA: Trajectory Encoding Augmentation for Robust and Transferable Policies in Offline Reinforcement Learning.Batikan Bora Ormanci, Phillip Swazinna, Steffen Udluft, Thomas A. Runkler
2025ESANNIs Q-learning an Ill-posed Problem?Philipp Wissmann, Daniel Hein, Steffen Udluft, Thomas A. Runkler
2025QCEFrom Classical Data to Quantum Advantage - Quantum Policy Evaluation on Quantum Hardware.Daniel Hein, Simon Wiedemann, Markus Baumann, Patrik Felbinger, Justin Klein, Maximilian Schieder, Jonas Stein, Danille Schuman, Thomas Cope, Steffen Udluft
2025QCEVariational Quantum Circuits in Offline Contextual Bandit Problems.Lukas Schulte, Daniel Hein, Steffen Udluft, Thomas A. Runkler
2025QCEFirst Experience with Real-Time Control Using Simulated VQC-Based Quantum Policies.Yize Sun, Mohamad Hagog, Marc Weber, Daniel Hein, Steffen Udluft, Yunpu Ma, Volker Tresp
2025QCELearning Control with Simulated Variational Quantum Policies in a Surrogate Cart-Pole Environment.Yize Sun, Mohamad Hagog, Marc Weber, Daniel Hein, Steffen Udluft, Yunpu Ma, Volker Tresp
2024ESANNWhy long model-based rollouts are no reason for bad Q-value estimates.Philipp Wissmann, Daniel Hein, Steffen Udluft, Volker Tresp
2024QCEModel-Based Offline Quantum Reinforcement Learning.Simon Eisenmann, Daniel Hein, Steffen Udluft, Thomas A. Runkler
2023ESANNAutomatic Trade-off Adaptation in Offline RL.Phillip Swazinna, Steffen Udluft, Thomas A. Runkler
2023ICLRUser-Interactive Offline Reinforcement Learning.Phillip Swazinna, Steffen Udluft, Thomas A. Runkler
2023QCEWorkshop Summary: Quantum Machine Learning.Volker Tresp, Steffen Udluft, Daniel Hein, Werner Hauptmann, Martin Leib, Christopher Mutschler, Daniel D. Scherer, Wolfgang Mauerer
2022ICAARTSafe Policy Improvement Approaches on Discrete Markov Decision Processes.Philipp Scholl, Felix Dietrich, Clemens Otte, Steffen Udluft
2022ICAARTSafe Policy Improvement Approaches and Their Limitations.Philipp Scholl, Felix Dietrich, Clemens Otte, Steffen Udluft
2021ESANNBehavior Constraining in Weight Space for Offline Reinforcement Learning.Phillip Swazinna, Steffen Udluft, Daniel Hein, Thomas A. Runkler
2019GECCOGenerating interpretable reinforcement learning policies using genetic programming.Daniel Hein, Steffen Udluft, Thomas A. Runkler
2018ESANNSensitivity analysis for predictive uncertainty.Stefan Depeweg, Jos Miguel Hernndez-Lobato, Steffen Udluft, Thomas A. Runkler
2018GECCOGenerating interpretable fuzzy controllers using particle swarm optimization and genetic programming.Daniel Hein, Steffen Udluft, Thomas A. Runkler
2018ICMLDecomposition of Uncertainty in Bayesian Deep Learning for Efficient and Risk-sensitive Learning.Stefan Depeweg, Jos Miguel Hernndez-Lobato, Finale Doshi-Velez, Steffen Udluft
2017ICLRLearning and Policy Search in Stochastic Dynamical Systems with Bayesian Neural Networks.Stefan Depeweg, Jos Miguel Hernndez-Lobato, Finale Doshi-Velez, Steffen Udluft
2017IJCNNBatch reinforcement learning on the industrial benchmark: First experiences.Daniel Hein, Steffen Udluft, Michel Tokic, Alexander Hentschel, Thomas A. Runkler, Volkmar Sterzing
2014ESANNExploiting similarity in system identification tasks with recurrent neural networks.Sigurd Spieckermann, Siegmund Dll, Steffen Udluft, Alexander Hentschel, Thomas A. Runkler
2014ICANNRegularized Recurrent Neural Networks for Data Efficient Dual-Task Learning.Sigurd Spieckermann, Siegmund Dll, Steffen Udluft, Thomas A. Runkler
2013ESANNEnsembles for Continuous Actions in Reinforcement Learning.Siegmund Duell, Steffen Udluft
2012ESANNRecurrent Neural State Estimation in Domains with Long-Term Dependencies.Siegmund Duell, Lina Weichbrodt, Alexander Hans, Steffen Udluft
2011ESANNEnsemble Usage for More Reliable Policy Identification in Reinforcement Learning.Alexander Hans, Steffen Udluft
2010ECAIUncertainty Propagation for Efficient Exploration in Reinforcement Learning.Alexander Hans, Steffen Udluft
2010ESANNThe Markov Decision Process Extraction Network.Siegmund Duell, Alexander Hans, Steffen Udluft
2010ICMLAEnsembles of Neural Networks for Robust Reinforcement Learning.Alexander Hans, Steffen Udluft
2009ICANNEfficient Uncertainty Propagation for Reinforcement Learning with Limited Data.Alexander Hans, Steffen Udluft
2008ESANNSafe exploration for reinforcement learning.Alexander Hans, Daniel Schneega, Anton Maximilian Schfer, Steffen Udluft
2008IJCNNUncertainty propagation for quality assurance in Reinforcement Learning.Daniel Schneega, Steffen Udluft, Thomas Martinetz
2007ESANNThe Recurrent Control Neural Network.Anton Maximilian Schfer, Steffen Udluft, Hans-Georg Zimmermann
2007ESANNNeural Rewards Regression for near-optimal policy identification in Markovian and partial observable environments.Daniel Schneega, Steffen Udluft, Thomas Martinetz
2007ESANNExplicit Kernel Rewards Regression for data-efficient near-optimal policy identification.Daniel Schneega, Steffen Udluft, Thomas Martinetz
2007ICANNImproving Optimality of Neural Rewards Regression for Data-Efficient Batch Near-Optimal Policy Identification.Daniel Schneega, Steffen Udluft, Thomas Martinetz
2007IJCNNA Neural Reinforcement Learning Approach to Gas Turbine Control.Anton Maximilian Schfer, Daniel Schneega, Volkmar Sterzing, Steffen Udluft
2006ICANNLearning Long Term Dependencies with Recurrent Neural Networks.Anton Maximilian Schfer, Steffen Udluft, Hans-Georg Zimmermann