ملف الباحث
Isaac S. Chan
ورقة واحدة في مجموعة PaperMetrix
المنشورات
أوراق هذا المؤلف
-
Adaptive Tree Backup Algorithms for Temporal-Difference Reinforcement Learning
2022 · arXiv (Cornell University)
Q($σ$) is a recently proposed temporal-difference learning method that interpolates between learning from expected backups and sampled backups. It has been shown that intermediate values for the interpolation parameter $σ\in [0,1]$ perform better in practice, …