Adversarial Batch Inverse Reinforcement Learning: Learn to Reward from Imperfect Demonstration for Interactive Recommendation.
Jialin Liu, Xinyan Su, Zeyu He, Jun Li
Browse the full CSCWD paper archive.
Jialin Liu, Xinyan Su, Zeyu He, Jun Li
Browse the full CSCWD paper archive.