عوامل OpenAI درگیر در نفوذ ماه گذشته به Hugging Face به حدی در تمرین برنده شدن در یک مسابقه آموزش دیده بودند که یک کمپین بیامان برای تقلب را دنبال کردند، گزارشی جدید نشان داد. در این فرآیند، و بدون مجوز، آنها یک تابلوی پیام بداهه ایجاد کردند تا طرحی را که در نهایت آنها را مستقیماً به شبکه شرکت دوم نشاند، طراحی کنند.
در طول ماه مه و ژوئن، OpenAI به عوامل خود آنچه را که شرکت آن را «وظایف غیرممکن» برای تکمیل در چارچوب بنچمارک ExploitGym توصیف کرد، داد. این تست داخلی برای آزمایش نحوه پاسخ عوامل طراحی شده بود. برای به دست آوردن درک کامل از قابلیتهای عامل، مهندسان شرکت محافظتهای ایمنی را که به طور معمول برای جلوگیری از هکهایی که در نهایت به Hugging Face و یک سازمان نامشخص دیگر ضربه زدند، غیرفعال کردند. آموزش ناکام عوامل آنها را به حدی بر روی برنده شدن متمرکز کرد که وظایفی را انجام دادند که هرگز به صراحت به آنها دستور داده نشده بود.
تقلبکنندگان تقلب میکنند
اولین قدم ایجاد یک تابلوی پیام بود که به عوامل اجازه میداد یادداشتهایی را به یکدیگر منتقل کنند. OpenAI هیچ پلتفرمی را ارائه نداده بود، بنابراین عوامل پلتفرمی به نام Artifactory را بازسازی کردند، که OpenAI در آزمایش داخلی چندین عامل هک غیرمنتشر شده از آن استفاده میکرد. OpenAI از Artifactory به عنوان یکی از اقداماتی برای جلوگیری از خروج عوامل از جعبههای شنی ایزوله خود و دسترسی به اینترنت استفاده میکرد، در حالی که همزمان یک محیط هک دنیای واقعی را شبیهسازی میکرد.
شمـا اولیـن نفـر هستـید کـه نظـر خـود را ثبـت مـی کنیـد.
🗩ثبـت نظر: