ملف الباحث
Wichayaporn Wongkamjan
ورقة واحدة في مجموعة PaperMetrix
المنشورات
أوراق هذا المؤلف
-
COPlanner: Plan to Roll Out Conservatively but to Explore Optimistically for Model-Based RL
2023 · arXiv (Cornell University)
Dyna-style model-based reinforcement learning contains two phases: model rollouts to generate sample for policy learning and real environment exploration using current policy for dynamics model learning. However, due to the complex real-world environment, it is …