بررسی مؤسسه هوش مصنوعی انسانمحور دانشگاه استنفورد (Stanford HAI) درباره سیاستهای حریم خصوصی شش شرکت بزرگ آمریکایی شامل Amazon، Anthropic، Google، Meta، Microsoft و OpenAI نشان داد که هر شش شرکت از دادههای گفتوگوهای کاربران برای آموزش یا بهبود مدلهای خود استفاده میکنند؛ البته نحوه اعمال امکان انصراف و مدت نگهداری دادهها در شرکتهای مختلف متفاوت است. برخی شرکتها نیز امکان بررسی مکالمات توسط انسانها را برای اهداف آموزشی فراهم میکنند.
به همین دلیل، کارشناسان امنیت و حریم خصوصی توصیه میکنند کاربران در هنگام کار با چتباتها دستکم درباره پنج دسته اطلاعات حساس احتیاط بیشتری داشته باشند.
۱. اطلاعات هویتی و شناسایی
نام کامل، نشانی منزل، شماره تلفن، شماره گذرنامه، گواهینامه رانندگی و شمارههای شناسایی دولتی از جمله اطلاعاتی هستند که بهتر است در اختیار چتباتها قرار نگیرند.
ترکیب چند مورد از این اطلاعات میتواند تصویری نسبتاً کامل از هویت یک فرد ایجاد کند و در صورت دسترسی افراد غیرمجاز، زمینه را برای حملات فیشینگ، سرقت هویت و مهندسی اجتماعی فراهم کند. بنابراین اگر قصد دارید رزومه یا سندی را برای خلاصهسازی یا ویرایش در اختیار یک مدل هوش مصنوعی قرار دهید، حذف اطلاعات شناسایی غیرضروری پیش از بارگذاری، اقدام احتیاطی مهمی است.
۲. اطلاعات روانشناختی و مسائل کاملاً شخصی
لحن دوستانه و پاسخهای همدلانه چتباتها میتواند احساس امنیت زیادی ایجاد کند؛ اما این حس نباید با محرمانگی حرفهای یک رواندرمانگر، وکیل یا پزشک اشتباه گرفته شود.
این موضوع اهمیت بیشتری پیدا کرده است، زیرا بخشی از کاربران از هوش مصنوعی برای صحبت درباره مشکلات شخصی، روابط عاطفی و مسائل احساسی استفاده میکنند. یک نظرسنجی دانشگاه الون در سال ۲۰۲۶ نشان داد ۲۷ درصد از کاربران بزرگسال اینترنت در آمریکا تعاملات اجتماعی یا عاطفی قابل توجهی با مدلهای زبانی دارند و نزدیک به ۴۰ درصد از کاربران این نوع تعاملات گفتهاند مطالبی را با هوش مصنوعی در میان گذاشتهاند که به دیگران نمیگفتند.
۳. سوابق پزشکی و اطلاعات سلامت
گزارشهای پزشکی، نتایج آزمایش، نسخهها، تصاویر پزشکی و جزئیات مربوط به بیماریها از حساسترین انواع داده شخصی محسوب میشوند. بنابراین بهتر است پیش از بارگذاری آنها، سیاست حریم خصوصی سرویس مورد استفاده و نحوه ذخیره و پردازش اطلاعات را بررسی کنید.
استنفورد نیز تأکید کرده است که حفاظت از دادههای شخصی در فضای هوش مصنوعی با مجموعهای پیچیده از قوانین و سیاستهای متفاوت روبهرو است و برای اطلاعات حساس، استفاده از حالتهای خصوصی یا موقت و کنترل گزینههای مربوط به آموزش مدل اهمیت دارد.
۴. اطلاعات محرمانه شرکتها
گزارشهای داخلی، اطلاعات مشتریان، کد منبع، اسناد مالی شرکت و محتوای تحت قراردادهای محرمانگی نباید بدون مجوز سازمان در اختیار چتباتهای عمومی قرار گیرند.
این مسئله میتواند علاوه بر خطر افشای اطلاعات تجاری، پیامدهای قراردادی و حقوقی نیز داشته باشد. به همین دلیل سازمانها معمولاً باید مشخص کنند چه ابزارهایی برای پردازش اطلاعات داخلی مجاز هستند و دادههای واردشده چگونه ذخیره یا استفاده میشوند.
۵. اطلاعات مالی
شماره حساب بانکی، اطلاعات کارت اعتباری، اظهارنامه مالیاتی، فیش حقوقی و جزئیات حسابهای سرمایهگذاری نیز در گروه دادههایی قرار میگیرند که نباید بدون ضرورت در چتباتهای عمومی وارد شوند.
چنین اطلاعاتی در صورت افشا میتواند برای طراحی حملات مهندسی اجتماعی هدفمند یا کلاهبرداری مالی مورد استفاده قرار گیرد. در مواردی که تحلیل مالی تخصصی لازم است، حذف اطلاعات هویتی و شمارههای حساس یا استفاده از خدماتی با تضمینهای مشخص حریم خصوصی، رویکرد محتاطانهتری است.
چگونه خطر را کاهش دهیم؟
حذف یک مکالمه از تاریخچه، لزوماً به این معنا نیست که تمام نسخههای احتمالی داده فوراً از همه سامانههای مرتبط حذف شدهاند. به همین دلیل، استنفورد بر اهمیت طراحی قابلیتهایی مانند چت موقت، کنترلهای شفافتر حریم خصوصی و امکان انتخاب آگاهانه درباره استفاده از مکالمات برای آموزش مدل تأکید کرده است.
کاربران نیز میتوانند پیش از استفاده از هر سرویس، تنظیمات مربوط به ذخیره تاریخچه، استفاده از مکالمات برای آموزش مدل و حالت چت موقت را بررسی کنند. همچنین بهتر است به جای وارد کردن نامها و جزئیات واقعی، از عباراتی کلی مانند «یک بیمار»، «یک مشتری» یا «یک شرکت» استفاده شود؛ مگر اینکه ارائه اطلاعات دقیق واقعاً ضروری باشد.
در نهایت، توصیه اصلی کارشناسان ساده است: چتبات هوش مصنوعی را نباید مانند یک دوست یا دفتر خاطرات کاملاً خصوصی در نظر گرفت. هر اطلاعاتی که وارد یک سامانه آنلاین میشود، باید با این فرض وارد شود که ممکن است تحت شرایط مشخصی ذخیره، پردازش یا بررسی شود. استنفورد نیز خواستار حرکت به سمت سیاستهایی شده است که استفاده از دادههای مکالمات برای آموزش مدل را بهصورت پیشفرض غیرفعال کنند و برای چنین استفادهای رضایت صریح کاربر را دریافت کنند.