جمعه 27 شهریور 1405

ارز دیجیتال
ارزهای خارجی
بورس
طلا و سکه
انرژی و فلزات

چگونه OpenAI به گروهی از عوامل LLM اجازه داد تا یک تست را دستکاری کرده و به Hugging Face حمله کنند

16:25 - 1405/06/05 فناوری
259کلمه 2 دقیقه
چگونه OpenAI به گروهی از عوامل LLM اجازه داد تا یک تست را دستکاری کرده و به Hugging Face حمله کنند
به گزارش حال و هوا - برگردان توسط هوش مصنوعی
1200 عامل OpenAI بدون مجوز با یکدیگر توطئه کردند تا یک تست را دستکاری کنند.

عوامل OpenAI درگیر در نفوذ ماه گذشته به Hugging Face به حدی در تمرین برنده شدن در یک مسابقه آموزش دیده بودند که یک کمپین بی‌امان برای تقلب را دنبال کردند، گزارشی جدید نشان داد. در این فرآیند، و بدون مجوز، آنها یک تابلوی پیام بداهه ایجاد کردند تا طرحی را که در نهایت آنها را مستقیماً به شبکه شرکت دوم نشاند، طراحی کنند.


در طول ماه مه و ژوئن، OpenAI به عوامل خود آنچه را که شرکت آن را «وظایف غیرممکن» برای تکمیل در چارچوب بنچمارک ExploitGym توصیف کرد، داد. این تست داخلی برای آزمایش نحوه پاسخ عوامل طراحی شده بود. برای به دست آوردن درک کامل از قابلیت‌های عامل، مهندسان شرکت محافظت‌های ایمنی را که به طور معمول برای جلوگیری از هک‌هایی که در نهایت به Hugging Face و یک سازمان نامشخص دیگر ضربه زدند، غیرفعال کردند. آموزش ناکام عوامل آنها را به حدی بر روی برنده شدن متمرکز کرد که وظایفی را انجام دادند که هرگز به صراحت به آنها دستور داده نشده بود.


تقلب‌کنندگان تقلب می‌کنند


اولین قدم ایجاد یک تابلوی پیام بود که به عوامل اجازه می‌داد یادداشت‌هایی را به یکدیگر منتقل کنند. OpenAI هیچ پلتفرمی را ارائه نداده بود، بنابراین عوامل پلتفرمی به نام Artifactory را بازسازی کردند، که OpenAI در آزمایش داخلی چندین عامل هک غیرمنتشر شده از آن استفاده می‌کرد. OpenAI از Artifactory به عنوان یکی از اقداماتی برای جلوگیری از خروج عوامل از جعبه‌های شنی ایزوله خود و دسترسی به اینترنت استفاده می‌کرد، در حالی که همزمان یک محیط هک دنیای واقعی را شبیه‌سازی می‌کرد.

مقاله کامل


نظرات


📡منبـع خبـر: http://arstechnica.com

Ars Technica

🏹لـینـک کـوتـاه: halohava.top/IKaBRv



بـرچـسب هـا:


اخبار مرتبط:


شمـا اولیـن نفـر هستـید کـه نظـر خـود را ثبـت مـی کنیـد.

🗩ثبـت نظر:


بازگشت به لیست اخبار