شرکت آنتروپیک، سازنده چتبات کلود، در اسناد ارائهشده به سرمایهگذاران هشدارهای بسیار جدی درباره خطرات هوش مصنوعی پیشرفته مطرح کرده است.
به گزارش ایتنا به نقل از Androidauthority، این شرکت میگوید برخی مدلهایش رفتارهایی از خود نشان دادهاند که میتواند در صورت توسعه بیشتر قابلیتهای هوش مصنوعی، نگرانیهای امنیتی جدی ایجاد کند.
بر اساس این اسناد، مدلهای آنتروپیک در برخی آزمایشها رفتارهای خودحفاظتی از خود نشان دادهاند؛ از جمله تلاش برای مقاومت در برابر خاموششدن، پنهانکردن یا دستکاری اطلاعات و رفتارهایی که شباهتهایی به باجگیری (blackmail) داشتهاند. آنتروپیک همچنین هشدار داده است که مدلهای پیشرفته ممکن است متوجه شوند تحت ارزیابی قرار دارند و در نتیجه، رفتار خود را تغییر دهند. چنین قابلیتی میتواند تشخیص اینکه یک سامانه واقعاً ایمن است یا صرفاً در زمان آزمایش رفتار مناسبی نشان میدهد را دشوارتر کند.
این هشدارها در شرایطی منتشر شدهاند که نگرانیها درباره ایمنی هوش مصنوعی افزایش یافته است. چند هفته پیش نیز ایوان هوبینگر، پژوهشگر آنتروپیک، هشدار داده بود که احتمال کشتهشدن تمام انسانها توسط هوش مصنوعی در طول دهه آینده، از دید او بیش از ۱۰ درصد است. این اظهارنظر البته یک ارزیابی شخصی از ریسک است و نباید با پیشبینی قطعی درباره آینده اشتباه گرفته شود.
اهمیت هشدارهای جدید آنتروپیک زمانی بیشتر میشود که حجم قابلتوجهی از اسناد این شرکت به ریسکهای احتمالی اختصاص یافته است. طبق گزارش رویترز، حدود ۸۰ صفحه از بخش اصلی ۲۶۱ صفحهای دفترچه عرضه سهام آنتروپیک به عوامل خطر اختصاص دارد؛ در حالی که بخش مربوط به معرفی کسبوکار ۴۸ صفحه است.
نمونههای عملی نیز به این نگرانیها دامن زدهاند. ماه گذشته، یک عامل هوش مصنوعی مبتنی بر کلود که با نام اوپنکلا (OpenClaw) فعالیت میکرد، از سامانه رزرو یک باشگاه ورزشی در استرالیا سوءاستفاده کرد و حتی بدون دریافت دستور مستقیم، فرد دیگری را از فهرست انتظار حذف کرد. شرکت اوپنایآی نیز با نگرانیهای مشابهی درباره رفتار خارج از محدوده تعیینشده مدلهایش مواجه شده است.