ملف الباحث
Md. Masudur Rahman
ورقة واحدة في مجموعة PaperMetrix
المنشورات
أوراق هذا المؤلف
-
Bootstrap Advantage Estimation for Policy Optimization in Reinforcement Learning
2022 · arXiv (Cornell University)
This paper proposes an advantage estimation approach based on data augmentation for policy optimization. Unlike using data augmentation on the input to learn value and policy function as existing methods use, our method uses data …