ملف الباحث
Alexandre Laterre
ورقة واحدة في مجموعة PaperMetrix
المنشورات
أوراق هذا المؤلف
-
Ranked Reward: Enabling Self-Play Reinforcement Learning for Combinatorial Optimization
2018 · arXiv (Cornell University)
Adversarial self-play in two-player games has delivered impressive results when used with reinforcement learning algorithms that combine deep neural networks and tree search. Algorithms like AlphaZero and Expert Iteration learn tabula-rasa, producing highly informative training …