Open menu
Prashanth L. A.
Gradient-Based Algorithms for Zeroth-Order Optimization
Risk-Sensitive Reinforcement Learning Via Policy Gradient Search