ملف الباحث

Gupta, Taneesh

ورقة واحدة في مجموعة PaperMetrix

المنشورات

أوراق هذا المؤلف

  1. CARMO: Dynamic Criteria Generation for Context-Aware Reward Modelling

    2024 · arXiv (Cornell University)

    Reward modeling in large language models is susceptible to reward hacking, causing models to latch onto superficial features such as the tendency to generate lists or unnecessarily long responses. In reinforcement learning from human feedback …