گوگل یکی از تنها آزمایشگاههای هوش مصنوعی بود که هنوز نقض امنیتی مربوط به نمایندگان خود را در طول آزمایشهای معمول پیش از استقرار، به طور عمومی افشا نکرده بود.
گوگل روز جمعه این سه حادثه را که در ماه مه رخ داده بود، تأیید کرد.
این حوادث به عنوان بخشی از یک آزمایش که توسط شرکت ارزیابی شخص ثالث Irregular انجام میشد، رخ داد - مشابه سایر نقضهای امنیتی مربوط به مدلهای هوش مصنوعی OpenAI، Anthropic و Meta.
وال استریت ژورنال اولین کسی بود که این حوادث را گزارش داد.
آنچه آنها میگویند: هدر ادکینز، معاون رئیس مهندسی امنیت در گوگل، در بیانیهای گفت: «توسعه ایمن مدلهای قدرتمند هوش مصنوعی بسیار مهم است و ما عمیقاً در این زمینه سرمایهگذاری میکنیم.»
آدکینز افزود که تیمش با نهادهای آسیبدیده تماس گرفت و «با شریک آموزشی خود در مورد تغییراتی که اکنون در فرآیندهای آزمایش خود ایجاد کردهاند، همکاری کرد.»
سخنگوی Irregular در گفتوگو با Axios تأیید کرد که حادثه Gemini شامل همان مسائل امنیتی است که منجر به حوادث مشابه در مدلهای سایر آزمایشگاههای هوش مصنوعی نیز شده است.
این سخنگو همچنین در بیانیهای اعلام کرد که به همه «آزمایشگاههای مربوطه در اواخر ماه ژوئیه اطلاع داده شده» و «تمام مشکلات شناختهشده از طرف ما هفتهها پیش برطرف و حل شده است.»
این هکها زمانی اتفاق افتادند که Gemini در حال تکمیل یک تمرین هک "تسخیر پرچم" بود، که در آن از مدل خواسته شد تا اطلاعات را از نرمافزاری که توسط یک شرکت خیالی در یک محیط آزمایشی اداره میشود، بازیابی کند، طبق گزارش WSJ.
با این حال، این شرکت خیالی نامی مشابه یک شرکت واقعی داشت.
در یک مورد، مدل رمزهای عبور یک سیستم محافظتشده را حدس زد تا زمانی که به آن دسترسی پیدا کرد. در دو مورد دیگر، مدل اعتبارنامههایی را در یک مخزن عمومی پیدا کرد که سپس به آن اجازه دسترسی به سایر سیستمهای محافظتشده را داد.
بله، اما: مدل گوگل به محض اینکه متوجه شد به شرکتهای واقعی دسترسی پیدا کرده است، اقدامات آنها را متوقف کرد.
نکتهی جالب: شرکت Irregular به وال استریت ژورنال گفت که قرار نبوده این مدل بتواند آنلاین شود، اما دسترسی به اینترنت به طور ناخواسته امکانپذیر شده است.
پس از آنکه OpenAI و Anthropic تابستان امسال موارد دیگری را افشا کردند، منبعی آشنا با این موضوع به Axios گفت که آزمایشگاههای هوش مصنوعی و Irregular در مورد رویهها و اقدامات حفاظتی دقیق کاملاً هماهنگ نبودند و ابهاماتی در مورد نحوهی اجرای ارزیابیهای معمولاً مبتنی بر اینترنت توسط هر یک از طرفین باقی مانده است.
محققان در حال قایمموشک بازی با عاملهای هوش مصنوعی سرکش در وب آزاد هستند.
شمـا اولیـن نفـر هستـید کـه نظـر خـود را ثبـت مـی کنیـد.
🗩ثبـت نظر: