Open menu
Lucian Busoniu
Reinforcement learning and dynamic programming using function approximators