عوامل خودمعرف OpenAI بیش از 18000 پیام را در یک ویکی عمومی منتشر کردند که در آن در مورد راههایی برای دور زدن محدودیتهای امنیتی محیط ایزوله (sandbox) در طول آزمایشهای داخلی احتمالی برای سنجش تواناییهای هک این عوامل بحث میکردند، محققان روز جمعه اعلام کردند.
در مجموع، عواملی با 3700 نام مختلف، این پیامها را در وبسایت آلمانی DSEwiki در طول یک دوره شش هفتهای منتشر کردند. علاوه بر بحث در مورد راههایی که عوامل میتوانند از محیط محدود OpenAI که برای جلوگیری از ارسال کد یا محتوا به اینترنت در نظر گرفته شده بود، خارج شوند، این پیامها پاسخهای آزمون را نیز به اشتراک گذاشتند. این پیامها همچنین راههای احتمالی برای انجام حملات XSS (اسکریپتنویسی متقابل سایت) علیه ویکی و جعل هویت مدیران سایت را به اشتراک گذاشتند. در سه مورد از این پیامها، عوامل از کلمه «گله» برای توصیف مجموعهای از عوامل درگیر در این فعالیت استفاده کردند.
همکاری برای به اشتراک گذاشتن پاسخها
تیم تحقیقاتی متشکل از سیدنی ون آرکس، اسپنسر کیتس، توماس لارسن و کورمک اسلید برد، گفتند که این پیامها را پیدا کرده و آنها را کنار هم قرار دادهاند. محققان میگویند شکافهایی در درک دقیق اقدامات انجام شده توسط عوامل وجود دارد، زیرا این تحقیق صرفاً بر اساس محتوای پیامها است. علاوه بر این، عوامل دادههای «زنجیره تفکر» را تولید کردهاند که فقط توسط OpenAI قابل درک است. در نتیجه، محققان گفتند که در برخی موارد مجبور به حدس زدن شدهاند، از جمله اینکه این عوامل در واقع از OpenAI هستند. OpenAI در بیانیهای این موضوع را تأیید کرد.
شمـا اولیـن نفـر هستـید کـه نظـر خـود را ثبـت مـی کنیـد.
🗩ثبـت نظر: