ملف الباحث
Yubing Ren
ورقة واحدة في مجموعة PaperMetrix
المنشورات
أوراق هذا المؤلف
-
PIG: Privacy Jailbreak Attack on LLMs via Gradient-based Iterative In-Context Optimization
2025 · arXiv (Cornell University)
Large Language Models (LLMs) excel in various domains but pose inherent privacy risks. Existing methods to evaluate privacy leakage in LLMs often use memorized prefixes or simple instructions to extract data, both of which well-alignment …