Skip to content

Achieving $\widetilde{\mathcal{O}}(\sqrt{T})$ Regret in Average-Reward POMDPs with Known Observation Models.

Alessio Russo, Alberto Maria Metelli, Marcello Restelli

Year2025
ProceedingsAISTATS

Browse the full AISTATS paper archive.