در ماه ژوئیه، OpenAI فاش کرد که عاملهای هوش مصنوعی آن بدون اجازه به Hugging Face حمله کردهاند، که نگرانیهای گستردهای را در مورد ایمنی هوش مصنوعی برانگیخت. از آن زمان، رشتهای از حوادث مشابه شامل عاملهایی از Meta، Anthropic، Google و سایر شرکتها ترس از هوش مصنوعی سرکش را تشدید کرده است. با آشکار شدن اطلاعاتی که مدلهای هوش مصنوعی متعددی را درگیر میکند، این حوادث به نظر میرسیدند که رویدادهای جداگانهای هستند. اما بسیاری یک منبع مشترک دارند: یک شرکت خاص که مسئول آزمایش عاملها است.
Irregular، یک استارتاپ اسرائیلی که مدلهای هوش مصنوعی را در "پلتفرمهای تحقیقاتی با وفاداری بالا که سناریوهای امنیتی هوش مصنوعی در دنیای واقعی را شبیهسازی و نظارت میکنند" مورد آزمایش قرار میدهد...