Skip to content

Marcello Restelli

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

106

Venues

19

Active years

2001–2026

Best venue rank

A*

Where they publish

Papers

106 indexed papers, newest first.

YearVenueTitleAuthors
2026COLTOnline Market Making and the Value of Observing the Order Book.Davide Maran, Marcello Restelli
2025AISTATSEfficient Exploitation of Hierarchical Structure in Sparse Reward Reinforcement Learning.Gianluca Drappo, Arnaud Robert, Marcello Restelli, Aldo A. Faisal, Alberto Maria Metelli, Ciara Pike-Burke
2025AISTATSAchieving $\widetilde{\mathcal{O}}(\sqrt{T})$ Regret in Average-Reward POMDPs with Known Observation Models.Alessio Russo, Alberto Maria Metelli, Marcello Restelli
2025ECAI"So, Tell Me About Your Policy...": Distillation of Interpretable Policies from Deep Reinforcement Learning Agents.Giovanni Dispoto, Paolo Bonetti, Marcello Restelli
2025ICMLEnhancing Diversity In Parallel Agents: A Maximum State Entropy Exploration Story.Vincenzo De Paola, Riccardo Zamboni, Mirco Mutti, Marcello Restelli
2025IJCNNA Reinforcement Learning Approach for Optimal Control in Microgrids.Davide Salaorni, Federico Bianchi, Marcello Restelli, Francesco Trov
2024AAAIOnline Markov Decision Processes Configuration with Continuous Decision Space.Davide Maran, Pierriccardo Olivieri, Francesco Emanuele Stradi, Giuseppe Urso, Nicola Gatti, Marcello Restelli
2024AAAIParameterized Projected Bellman Operator.Tho Vincent, Alberto Maria Metelli, Boris Belousov, Jan Peters, Marcello Restelli, Carlo D'Eramo
2024AISTATSAutoregressive Bandits.Francesco Bacchiocchi, Gianmarco Genalti, Davide Maran, Marco Mussi, Marcello Restelli, Nicola Gatti, Alberto Maria Metelli
2024COLTProjection by Convolution: Optimal Sample Complexity for Reinforcement Learning in Continuous-Space MDPs.Davide Maran, Alberto Maria Metelli, Matteo Papini, Marcello Restelli
2024ICANNBuilding Surrogate Models Using Trajectories of Agents Trained by Reinforcement Learning.Julen Cestero, Marco Quartulli, Marcello Restelli
2024ICLRExploiting Causal Graph Priors with Posterior Sampling for Reinforcement Learning.Mirco Mutti, Riccardo De Santi, Marcello Restelli, Alexander Marx, Giorgia Ramponi
2024ICMLGraph-Triggered Rising Bandits.Gianmarco Genalti, Marco Mussi, Nicola Gatti, Marcello Restelli, Matteo Castiglioni, Alberto Maria Metelli
2024ICMLNo-Regret Reinforcement Learning in Smooth MDPs.Davide Maran, Alberto Maria Metelli, Matteo Papini, Marcello Restelli
2024ICMLFactored-Reward Bandits with Intermediate Observations.Marco Mussi, Simone Drago, Marcello Restelli, Alberto Maria Metelli
2024ICMLBest Arm Identification for Stochastic Rising Bandits.Marco Mussi, Alessandro Montenegro, Francesco Trov, Marcello Restelli, Alberto Maria Metelli
2024ICMLHow to Explore with Belief: State Entropy Maximization in POMDPs.Riccardo Zamboni, Duilio Cirino, Marcello Restelli, Mirco Mutti
2024IJCNNCausal Feature Selection via Transfer Entropy.Paolo Bonetti, Alberto Maria Metelli, Marcello Restelli
2024IJCNNThe Power of Hybrid Learning in Industrial Robotics: Efficient Grasping Strategies with Supervised-Driven Reinforcement Learning.Vincenzo De Paola, Giuseppe Calcagno, Alberto Maria Metelli, Marcello Restelli
2023AAAIWasserstein Actor-Critic: Directed Exploration via Optimism for Continuous-Actions Control.Amarildo Likmeta, Matteo Sacco, Alberto Maria Metelli, Marcello Restelli
2023AAAITight Performance Guarantees of Imitator Policies with Continuous Actions.Davide Maran, Alberto Maria Metelli, Marcello Restelli
2023AAAIDynamic Pricing with Volume Discounts in Online Settings.Marco Mussi, Gianmarco Genalti, Alessandro Nuara, Francesco Trov, Marcello Restelli, Nicola Gatti
2023AAAIProvably Efficient Causal Model-Based Reinforcement Learning for Systematic Generalization.Mirco Mutti, Riccardo De Santi, Emanuele Rossi, Juan Felipe Caldern, Michael M. Bronstein, Marcello Restelli
2023AAAISimultaneously Updating All Persistence Values in Reinforcement Learning.Luca Sabbioni, Luca Al Daire, Lorenzo Bisi, Alberto Maria Metelli, Marcello Restelli
2023AISTATSA Tale of Sampling and Estimation in Discounted Reinforcement Learning.Alberto Maria Metelli, Mirco Mutti, Marcello Restelli
2023ICMLTowards Theoretical Understanding of Inverse Reinforcement Learning.Alberto Maria Metelli, Filippo Lazzati, Marcello Restelli
2023ICMLDynamical Linear Bandits.Marco Mussi, Alberto Maria Metelli, Marcello Restelli
2023ICMLTruncating Trajectories in Monte Carlo Reinforcement Learning.Riccardo Poiani, Alberto Maria Metelli, Marcello Restelli
2023ITWInformation-Theoretic Regret Bounds for Bandits with Fixed Expert Advice.Khaled Eldowa, Nicol Cesa-Bianchi, Alberto Maria Metelli, Marcello Restelli
2023UAIOn the Relation between Policy Improvement and Off-Policy Minimum-Variance Policy Evaluation.Alberto Maria Metelli, Samuele Meta, Marcello Restelli
2022AAAILifelong Hyper-Policy Optimization with Multiple Importance Sampling Regularization.Pierre Liotet, Francesco Vidaich, Alberto Maria Metelli, Marcello Restelli
2022AAAIUnsupervised Reinforcement Learning in Multiple Environments.Mirco Mutti, Mattia Mancassola, Marcello Restelli
2022AISTATSFinite Sample Analysis of Mean-Volatility Actor-Critic for Risk-Averse Reinforcement Learning.Khaled Eldowa, Lorenzo Bisi, Marcello Restelli
2022AISTATSReward-Free Policy Space Compression for Reinforcement Learning.Mirco Mutti, Stefano Del Col, Marcello Restelli
2022ICLRGoal-Directed Planning via Hindsight Experience Replay.Lorenzo Moro, Amarildo Likmeta, Enrico Prati, Marcello Restelli
2022ICMLBalancing Sample Efficiency and Suboptimality in Inverse Reinforcement Learning.Angelo Damiani, Giorgio Manganini, Alberto Maria Metelli, Marcello Restelli
2022ICMLDelayed Reinforcement Learning by Imitation.Pierre Liotet, Davide Maran, Lorenzo Bisi, Marcello Restelli
2022ICMLStochastic Rising Bandits.Alberto Maria Metelli, Francesco Trov, Matteo Pirola, Marcello Restelli
2022ICMLThe Importance of Non-Markovianity in Maximum State Entropy Exploration.Mirco Mutti, Riccardo De Santi, Marcello Restelli
2022IJCAIMulti-Armed Bandit Problem with Temporally-Partitioned Rewards: When Partial Feedback Counts.Giulia Romano, Andrea Agostini, Francesco Trov, Nicola Gatti, Marcello Restelli
2022IJCNNStorehouse: a Reinforcement Learning Environment for Optimizing Warehouse Management.Julen Cestero, Marco Quartulli, Alberto Maria Metelli, Marcello Restelli
2022KDDPricing the Long Tail by Explainable Product Aggregation and Monotonic Bandits.Marco Mussi, Gianmarco Genalti, Francesco Trov, Alessandro Nuara, Nicola Gatti, Marcello Restelli
2022UAILearning in Markov games: Can we exploit a general-sum opponent?Giorgia Ramponi, Marcello Restelli
2021AAAIPolicy Optimization as Online Learning with Mediator Feedback.Alberto Maria Metelli, Matteo Papini, Pierluca D'Oro, Marcello Restelli
2021AAAITask-Agnostic Exploration via Policy Gradient of a Non-Parametric State Entropy Estimate.Mirco Mutti, Lorenzo Pratissoli, Marcello Restelli
2021AAAINewton Optimization on Helmholtz Decomposition for Continuous Games.Giorgia Ramponi, Marcello Restelli
2021ICMLProvably Efficient Learning of Transferable Rewards.Alberto Maria Metelli, Giorgia Ramponi, Alessandro Concetti, Marcello Restelli
2021ICMLLeveraging Good Representations in Linear Contextual Bandits.Matteo Papini, Andrea Tirinzoni, Marcello Restelli, Alessandro Lazaric, Matteo Pirotta
2021IJCAIMeta-Reinforcement Learning by Tracking Task Non-stationarity.Riccardo Poiani, Andrea Tirinzoni, Marcello Restelli
2021IJCNNLearning a Belief Representation for Delayed Reinforcement Learning.Pierre Liotet, Erick Venneri, Marcello Restelli
2021UAITime-variant variational transfer for value functions.Giuseppe Canonaco, Andrea Soprani, Matteo Giuliani, Andrea Castelletti, Manuel Roveri, Marcello Restelli
2020AAAIGradient-Aware Model-Based Policy Search.Pierluca D'Oro, Alberto Maria Metelli, Andrea Tirinzoni, Matteo Papini, Marcello Restelli
2020AAAIAn Intrinsically-Motivated Approach for Learning Highly Exploring and Fast Mixing Policies.Mirco Mutti, Marcello Restelli
2020AISTATSBalancing Learning Speed and Stability in Policy Gradient via Adaptive Exploration.Matteo Papini, Andrea Battistello, Marcello Restelli
2020AISTATSTruly Batch Model-Free Inverse Reinforcement Learning about Multiple Intentions.Giorgia Ramponi, Amarildo Likmeta, Alberto Maria Metelli, Andrea Tirinzoni, Marcello Restelli
2020AISTATSA Novel Confidence-Based Algorithm for Structured Bandits.Andrea Tirinzoni, Alessandro Lazaric, Marcello Restelli
2020ECAIModel-Free Non-Stationarity Detection and Adaptation in Reinforcement Learning.Giuseppe Canonaco, Marcello Restelli, Manuel Roveri
2020ICLRSharing Knowledge in Multi-Task Deep Reinforcement Learning.Carlo D'Eramo, Davide Tateo, Andrea Bonarini, Marcello Restelli, Jan Peters
2020ICMLControl Frequency Adaptation via Action Persistence in Batch Reinforcement Learning.Alberto Maria Metelli, Flavio Mazzolini, Lorenzo Bisi, Luca Sabbioni, Marcello Restelli
2020ICMLSequential Transfer in Reinforcement Learning with a Generative Model.Andrea Tirinzoni, Riccardo Poiani, Marcello Restelli
2020IJCAIRisk-Averse Trust Region Optimization for Reward-Volatility Reduction.Lorenzo Bisi, Luca Sabbioni, Edoardo Vittori, Matteo Papini, Marcello Restelli
2020ICPRInferring Functional Properties from Fluid Dynamics Features.Andrea Schillaci, Maurizio Quadrio, Carlotta Pipolo, Marcello Restelli, Giacomo Boracchi
2019ICMLReinforcement Learning in Configurable Continuous Environments.Alberto Maria Metelli, Emanuele Ghelfi, Marcello Restelli
2019ICMLOptimistic Policy Optimization via Multiple Importance Sampling.Matteo Papini, Alberto Maria Metelli, Lorenzo Lupo, Marcello Restelli
2019ICMLTransfer of Samples in Policy Search via Multiple Importance Sampling.Andrea Tirinzoni, Mattia Salvini, Marcello Restelli
2019IJCNNFeature Selection via Mutual Information: New Theoretical Insights.Mario Beraha, Alberto Maria Metelli, Matteo Papini, Andrea Tirinzoni, Marcello Restelli
2019IJCNNExploiting Action-Value Uncertainty to Drive Exploration in Reinforcement Learning.Carlo D'Eramo, Andrea Cini, Marcello Restelli
2019IJCNNExploration Driven by an Optimistic Bellman Equation.Samuele Tosatto, Carlo D'Eramo, Joni Pajarinen, Marcello Restelli, Jan Peters
2019WWWDealing with Interdependencies and Uncertainty in Multi-Channel Advertising Campaigns Optimization.Alessandro Nuara, Nicola Sosio, Francesco Trov, Maria Chiara Zaccardi, Nicola Gatti, Marcello Restelli
2018AAAIA Combinatorial-Bandit Algorithm for the Online Joint Bid/Budget Optimization of Pay-per-Click Advertising Campaigns.Alessandro Nuara, Francesco Trov, Nicola Gatti, Marcello Restelli
2018ICMLConfigurable Markov Decision Processes.Alberto Maria Metelli, Mirco Mutti, Marcello Restelli
2018ICMLStochastic Variance-Reduced Policy Gradient.Matteo Papini, Damiano Binaghi, Giuseppe Canonaco, Matteo Pirotta, Marcello Restelli
2018ICMLImportance Weighted Transfer of Samples in Reinforcement Learning.Andrea Tirinzoni, Andrea Sessa, Matteo Pirotta, Marcello Restelli
2018IJCNNTargeting Optimization for Internet Advertising by Learning from Logged Bandit Feedback.Margherita Gasparini, Alessandro Nuara, Francesco Trov, Nicola Gatti, Marcello Restelli
2017AAAIEstimating the Maximum Expected Value in Continuous Reinforcement Learning Problems.Carlo D'Eramo, Alessandro Nuara, Matteo Pirotta, Marcello Restelli
2017AAAIUnimodal Thompson Sampling for Graph-Structured Arms.Stefano Paladino, Francesco Trov, Marcello Restelli, Nicola Gatti
2017ICMLBoosted Fitted Q-Iteration.Samuele Tosatto, Matteo Pirotta, Carlo D'Eramo, Marcello Restelli
2017IJCNNRisk-averse trees for learning from logged bandit feedback.Francesco Trov, Stefano Paladino, Paolo Simone, Marcello Restelli, Nicola Gatti
2017UAIRegret Minimization Algorithms for the Followers Behaviour Identification in Leadership Games.Lorenzo Bisi, Giuseppe De Nittis, Francesco Trov, Marcello Restelli, Nicola Gatti
2016AAAISequence-Form and Evolutionary Dynamics: Realization Equivalence to Agent Form and Logit Dynamics.Nicola Gatti, Marcello Restelli
2016AAAIInverse Reinforcement Learning through Policy Gradient Minimization.Matteo Pirotta, Marcello Restelli
2016ECAIBudgeted Multi-Armed Bandit in Continuous Action Space.Francesco Trov, Stefano Paladino, Marcello Restelli, Nicola Gatti
2016ICMLEstimating Maximum Expected Value through Gaussian Approximation.Carlo D'Eramo, Marcello Restelli, Alessandro Nuara
2015AAAIMulti-Objective Reinforcement Learning with Continuous Pareto Frontier Approximation.Matteo Pirotta, Simone Parisi, Marcello Restelli
2015ICRAEstimating a Mean-Path from a set of 2-D curves.Amir M. Ghalamzan E., Luca Bascetta, Marcello Restelli, Paolo Rocco
2015IJCNNFollowing Newton direction in Policy Gradient with parameter exploration.Giorgio Manganini, Matteo Pirotta, Marcello Restelli, Luca Bascetta
2014AAAIEvolutionary Dynamics of Q-Learning over the Sequence Form.Fabio Panozzo, Nicola Gatti, Marcello Restelli
2014IJCNNPolicy gradient approaches for multi-objective sequential decision making.Simone Parisi, Matteo Pirotta, Nicola Smacchia, Luca Bascetta, Marcello Restelli
2013AAAIEfficient Evolutionary Dynamics with Extensive-Form Games.Nicola Gatti, Fabio Panozzo, Marcello Restelli
2013ICMLSafe Policy Iteration.Matteo Pirotta, Marcello Restelli, Alessio Pecorino, Daniele Calandriello
2012AAAIComputing Equilibria with Two-Player Zero-Sum Continuous Stochastic Games with Switching Controller.Guido Bonomi, Nicola Gatti, Fabio Panozzo, Marcello Restelli
2012IJCNNTree-based Fitted Q-iteration for Multi-Objective Markov Decision problems.Andrea Castelletti, Francesca Pianosi, Marcello Restelli
2009ICINCOBatch Reinforcement Learning - An Application to a Controllable Semi-active Suspension System.Simone Tognetti, Marcello Restelli, Sergio M. Savaresi, Cristiano Spelta
2008ICMLTransfer of samples in batch reinforcement learning.Alessandro Lazaric, Marcello Restelli, Andrea Bonarini
2007AAMASBifurcation Analysis of Reinforcement Learning Agents in the Selten's Horse Game.Alessandro Lazaric, Enrique Munoz de Cote, Fabio Dercole, Marcello Restelli
2007ICINCOPiecewise constant reinforcement learning for robotic applications.Andrea Bonarini, Alessandro Lazaric, Marcello Restelli
2005ICRAAutomatic Error Detection and Reduction for an Odometric Sensor based on Two Optical Mice.Andrea Bonarini, Matteo Matteucci, Marcello Restelli
2005ICRAMRT: Robotics Off-the-Shelf with the Modular Robotic Toolkit.Andrea Bonarini, Matteo Matteucci, Marcello Restelli
2004ICINCODead Reckoning for Mobile Robots Using Two Optical Mice.Andrea Bonarini, Matteo Matteucci, Marcello Restelli
2004IROSA kinematic-independent dead-reckoning sensor for indoor mobile robotics.Andrea Bonarini, Matteo Matteucci, Marcello Restelli
2003RoboCupFilling the Gap among Coordination, Planning, and Reaction Using a Fuzzy Cognitive Model.Andrea Bonarini, Matteo Matteucci, Marcello Restelli
2003RoboCupA Probabilistic Framework for Weighting Different Sensor Data in MUREA.Marcello Restelli, Domenico G. Sorrenti, Fabio M. Marchese
2002IROSA robot localization method based on evidence accumulation and multi-resolution.Marcello Restelli, Domenico G. Sorrenti, Fabio M. Marchese
2002RoboCupMUREA: A MUlti-Resolution Evidence Accumulation Method for Robot Localization in Known Environments.Marcello Restelli, Domenico G. Sorrenti, Fabio M. Marchese
2001RoboCupFun2Mas: The Milan Robocup Team.Andrea Bonarini, Giovanni Invernizzi, Fabio M. Marchese, Matteo Matteucci, Marcello Restelli, Domenico G. Sorrenti
2001RoboCupA Framework for Robust Sensing in Multi-agent Systems.Andrea Bonarini, Matteo Matteucci, Marcello Restelli