اوپنایآی به طور رسمی حادثه "ویکیایدنت" (wiki incident) را تایید کرده است؛ حادثهای که شامل نقض امنیت و دستکاری یک وبسایت آلمانی توسط تعدادی از عوامل هوش مصنوعی این شرکت بود.
این عوامل هوش مصنوعی برای جستجو در اینترنت مأموریت داشتند، اما در ابتدا قادر به نوشتن چیزی خارج از محیط آزمایشی نبودند. با این حال، از ماه مه، این عوامل با دور زدن اقدامات امنیتی اوپنایآی، وبصفحه آلمانی را هک کرده و از آن به عنوان یک انجمن برای تبادل نکاتی در مورد تقلب در آزمونها استفاده کردند. محققان در تاریخ ۴ سپتامبر توجه بیشتری به "انجمن" این عوامل جلب کردند.
اوپنایآی اکنون اعلام کرده است که باید در مورد زمانی که عواملش "از کنترل خارج میشوند" شفافتر باشد، و در X (توییتر سابق) نوشت: "اکنون وقت آن رسیده است که استانداردهایی را برای زمان و نحوه به اشتراکگذاری حوادث عدم همراستایی، نه فقط ویژگیهای عدم همراستایی مدلهایمان، تعریف کنیم.".
طبق گزارش رویترز، این شرکت هفتهها از این رفتار "عدم همراستایی" آگاه بود، اما این حادثه را تا شنبه به طور رسمی تایید نکرد. این بیانیه پس از حمله عوامل هوش مصنوعی به سرورهای Hugging Face رخ میدهد.
"در گذشته، ما عدم همراستایی را عمدتاً به عنوان یک سوال تحقیقاتی در نظر میگرفتیم که در نشریات تحقیقاتی مانند کارتهای سیستم به آن پرداخته میشد." اوپنایآی مینویسد. "امسال، ما شاهد این بودهایم که عدم همراستایی باعث تأثیرات واقعی جدیدی میشود.".
برای یادآوری، "عدم همراستایی" به طور کلی رفتار غیرمنتظره هوش مصنوعی را توصیف میکند؛ یک هوش مصنوعی زمانی "عدم همراستایی" دارد که اهدافی را دنبال میکند که با قصد و ارزشهای انسانها متفاوت است - مانند حذف کل صندوق ورودی ایمیل شما در حالی که شما به هوش مصنوعی نگفتهاید که این کار را انجام دهد. این یک کلمه ملایم برای رفتاری است که میتواند عواقب جدی داشته باشد.
اوپنایآی میگوید که به طور علنی در مورد حادثه "ویکی" صحبت نکرده است، زیرا احساس میکرد که این حادثه شبیه به سایر مواردی است که "عوامل در حال استفاده از اینترنت به روشهای ناخواسته" هستند که قبلاً به اشتراک گذاشته است. حادثه Hugging Face باعث شده است که این شرکت رویکرد خود را به چیزی فراتر از ارتباطات مورد ارزیابی قرار دهد.
"شیوههای افشای عدم همراستایی ما باید برای این مرحله جدید از قابلیتهای مدل گسترش یابد." اوپنایآی مینویسد. "ما و جامعه بزرگ هوش مصنوعی هنوز استاندارد روشنی برای نحوه گزارش عدم همراستایی که در طول آموزش، ارزیابی و استقرار ظاهر میشود، از جمله مواردی که شبیه حوادث امنیتی سنتی نیستند اما میتوانند بینشهایی در مورد رفتار هوش مصنوعی و خطرات آینده ارائه دهند، نداریم.".
"ما در حال کار بر روی یک چارچوب هستیم و در هفتههای آینده آن را به اشتراک خواهیم گذاشت و به طور همزمان با دهها آژانس نظارتی دولتی در سراسر جهان در مورد این مسائل همکاری میکنیم.".
با این حال، هر چارچوب آیندهای که شکل بگیرد، در حال حاضر همه اینها به عنوان یک بازاریابی عالی برای این شرکت عمل میکند - شکست برنامهنویسی و از کنترل خارج شدن به این معنی است که این مدلها باید بسیار قادر باشند، درست است؟ اگر یک عامل آنقدر خوب باشد که نیاز به تنظیم داشته باشد، احتمالاً شایسته سرمایهگذاری است، نه؟ چه اتفاق خوبی!
شمـا اولیـن نفـر هستـید کـه نظـر خـود را ثبـت مـی کنیـد.
🗩ثبـت نظر: