PISDR: Page and Item Sequential Decision for Re-ranking Based on Offline Reinforcement Learning.
Zheng Yuan, Qian Wan, Tao Zhang, Chengfu Huo
Browse the full ACML paper archive.
Zheng Yuan, Qian Wan, Tao Zhang, Chengfu Huo
Browse the full ACML paper archive.