Comparing Multi-Armed Bandit Algorithms and Q-learning for Multiagent Action Selection: a Case Study in Route Choice.
Thiago Bell Felix de Oliveira, Ana L. C. Bazzan, Bruno C. da Silva, Ricardo Grunitzki
Browse the full IJCNN paper archive.
Thiago Bell Felix de Oliveira, Ana L. C. Bazzan, Bruno C. da Silva, Ricardo Grunitzki
Browse the full IJCNN paper archive.