ملف الباحث

Varun Chandrasekaran

ورقة واحدة في مجموعة PaperMetrix

المنشورات

أوراق هذا المؤلف

  1. Privately Aligning Language Models with Reinforcement Learning

    2023 · arXiv (Cornell University)

    Positioned between pre-training and user deployment, aligning large language models (LLMs) through reinforcement learning (RL) has emerged as a prevailing strategy for training instruction following-models such as ChatGPT. In this work, we initiate the study …