ملف الباحث
Dionysios S. Kalogerias
ورقة واحدة في مجموعة PaperMetrix
المنشورات
أوراق هذا المؤلف
-
Actor-only Deterministic Policy Gradient via Zeroth-order Gradient Oracles in Action Space
2021
Deterministic policies demonstrate substantial empirical success over their stochastic counterparts as they remove a level of randomness in Policy Gradient (PG) methods when applied to stochastic search problems involving Markov decision processes. However, current implementations …