ملف الباحث

Wichayaporn Wongkamjan

ورقة واحدة في مجموعة PaperMetrix

المنشورات

أوراق هذا المؤلف

  1. COPlanner: Plan to Roll Out Conservatively but to Explore Optimistically for Model-Based RL

    2023 · arXiv (Cornell University)

    Dyna-style model-based reinforcement learning contains two phases: model rollouts to generate sample for policy learning and real environment exploration using current policy for dynamics model learning. However, due to the complex real-world environment, it is …