Skip to content

Optimistic Q-learning for average reward and episodic reinforcement learning extended abstract.

Priyank Agrawal, Shipra Agrawal

VenueA*COLT
Year2025
ProceedingsCOLT

Browse the full COLT paper archive.