توی گزارش hugging face نوشته که مهاجم (همون ایجینتهای openai) با اپلود کردن یه دیتاست مخرب، سرور پردازشگر دیتاست رو مجبور به اجرای کد مخرب کردن و از این طرق تونستن واردش بشن.
بعد از ورود به سرور با استفاده از یه آسیبپذیری دیگه تونستن سطح دسترسی خودشون رو افزایش بدن و به سطح
خلاصه اتفاقی که OpenAI توی گزارش منتشر کرده:
یه تست امنیت سایبری داخلی به وسیله OpenAI برگزار میشه و برای اینکه حداکثر توانایی مدل رو بسنجه، بعضی محدودیتهای ایمنی رو موقتاً کم میکنه.
مدلها مأمور شدن چالشهای پیشرفته ExploitGym رو حل کنن.
تست داخل یه Sandbox بدون اینترنت