Discovering symbolic policies with deep reinforcement learning.
Mikel Landajuela, Brenden K. Petersen, Sookyung Kim, Cludio P. Santiago, Ruben Glatt, T. Nathan Mundhenk, Jacob F. Pettit, Daniel M. Faissol
Browse the full ICML paper archive.
Mikel Landajuela, Brenden K. Petersen, Sookyung Kim, Cludio P. Santiago, Ruben Glatt, T. Nathan Mundhenk, Jacob F. Pettit, Daniel M. Faissol
Browse the full ICML paper archive.