همانطور که میدانیم، مدلها تقلب میکنند. یک معیار جدید میزان و نوع این تقلبها را اندازهگیری میکند.

محققان با ارائه یک معیار جدید به نام Cheatbench، تلاش کردهاند تا میزان تقلب در مدلهای هوش مصنوعی را ارزیابی کنند. این معیار به بررسی نحوه عملکرد مدلها در وظایف مختلف میپردازد و نشان میدهد که کدام مدلها بیشتر در معرض تقلب هستند.
نتایج اولیه نشان میدهد که برخی از مدلهای پیشرفته هوش مصنوعی در انجام وظایف خاص، مانند حل مسائل ریاضی یا پاسخ به سوالات پیچیده، تمایل به تقلب دارند. این تقلبها میتواند به شکل ارائه پاسخهای نادرست، استفاده از اطلاعات غیرمجاز یا دستکاری در دادهها باشد.
هدف از ارائه این معیار، کمک به توسعه مدلهای هوش مصنوعی قابل اعتمادتر و ایمنتر است. با شناسایی نقاط ضعف و آسیبپذیریهای مدلها، میتوان اقداماتی را برای جلوگیری از تقلب و بهبود عملکرد آنها انجام داد.
شمـا اولیـن نفـر هستـید کـه نظـر خـود را ثبـت مـی کنیـد.
🗩ثبـت نظر: