Skip to content

Online Matching with Stochastic Rewards: Provable Better Bound via Adversarial Reinforcement Learning.

Qiankun Zhang, Aocheng Shen, Boyu Zhang, Hanrui Jiang, Bingqian Du

VenueA*ICML
Year2024
ProceedingsICML

Browse the full ICML paper archive.