ملف الباحث
Ruosen Li
ورقة واحدة في مجموعة PaperMetrix
المنشورات
أوراق هذا المؤلف
-
PRD: Peer Rank and Discussion Improve Large Language Model based Evaluations
2023 · arXiv (Cornell University)
Nowadays, the quality of responses generated by different modern large language models (LLMs) is hard to evaluate and compare automatically. Recent studies suggest and predominantly use LLMs for reference-free evaluation of open-ended question answering. More …