Locality-Sensitive State-Guided Experience Replay Optimization for Sparse Rewards in Online Recommendation.
Xiaocong Chen, Lina Yao, Julian J. McAuley, Weili Guan, Xiaojun Chang, Xianzhi Wang
Browse the full SIGIR paper archive.
Xiaocong Chen, Lina Yao, Julian J. McAuley, Weili Guan, Xiaojun Chang, Xianzhi Wang
Browse the full SIGIR paper archive.