ملف الباحث

Md. Masudur Rahman

ورقة واحدة في مجموعة PaperMetrix

المنشورات

أوراق هذا المؤلف

  1. Bootstrap Advantage Estimation for Policy Optimization in Reinforcement Learning

    2022 · arXiv (Cornell University)

    This paper proposes an advantage estimation approach based on data augmentation for policy optimization. Unlike using data augmentation on the input to learn value and policy function as existing methods use, our method uses data …