ملف الباحث

Po-Han Chiang

ورقة واحدة في مجموعة PaperMetrix

المنشورات

أوراق هذا المؤلف

  1. Mixture of Step Returns in Bootstrapped DQN

    2020 · arXiv (Cornell University)

    The concept of utilizing multi-step returns for updating value functions has been adopted in deep reinforcement learning (DRL) for a number of years. Updating value functions with different backup lengths provides advantages in different aspects, …