ملف الباحث

Yubing Ren

ورقة واحدة في مجموعة PaperMetrix

المنشورات

أوراق هذا المؤلف

  1. PIG: Privacy Jailbreak Attack on LLMs via Gradient-based Iterative In-Context Optimization

    2025 · arXiv (Cornell University)

    Large Language Models (LLMs) excel in various domains but pose inherent privacy risks. Existing methods to evaluate privacy leakage in LLMs often use memorized prefixes or simple instructions to extract data, both of which well-alignment …