ملف الباحث
Po-Han Chiang
ورقة واحدة في مجموعة PaperMetrix
المنشورات
أوراق هذا المؤلف
-
Mixture of Step Returns in Bootstrapped DQN
2020 · arXiv (Cornell University)
The concept of utilizing multi-step returns for updating value functions has been adopted in deep reinforcement learning (DRL) for a number of years. Updating value functions with different backup lengths provides advantages in different aspects, …