منو

صفحه اصلی

اخبار

اعترافات درز کرده از اوپن‌آی درباره سرقت کتاب؛ چالش‌های اخلاقی هوش مصنوعی

اسناد منتشر شده نشان می‌دهند مدیران اوپن‌آی از سرقت کتاب در مراحل اولیه توسعه مدل‌های چت‌جی‌پی‌تی آگاه بوده‌اند. این موضوع چالش‌های حقوقی و اخلاقی جدیدی را برای این شرکت ایجاد کرده است.

به گزارش اطلاعات آنلاین به نقل از وال‌استریت ژورنال، اسناد منتشرشده نشان می‌دهند که مدیران و پژوهشگران ارشد اوپن‌آی در سال‌های نخست توسعه مدل‌های چت‌جی‌پی‌تی، آگاهانه و با وجود نگرانی‌های جدی درباره ماهیت غیرقانونی منبع، از کتاب‌های سرقت‌شده پایگاه داده «لایبری جنسیس» یا همان LibGen برای آموزش هوش مصنوعی استفاده کرده‌اند.

این افشاگری‌ها در جریان شکایت دسته‌جمعی نویسندگان نام‌داری همچون جان گریشام، دیوید بالداچی، جودی پیکولت و جاناتان فرانزن علیه اوپن‌آی و مایکروسافت مطرح شده است. شاکیان با استناد به این مدارک درون‌سازمانی، تلاش دارند تا پیش از برگزاری دادگاه رسمی، نظر مساعد قاضی را جلب کنند. در مقابل، شرکت‌های فناوری مدافع این رویکرد بوده و استدلال می‌کنند که بهره‌گیری از این محتواها ذیل مفهوم «استفاده منصفانه» قرار می‌گیرد و جنبه دگرگون‌کننده دارد؛ توجیهی که نویسندگان و نهادهای صنفی نمی‌پذیرند.

جزئیات منتشرشده از پیام‌های داخلی کارکنان اوپن‌آی در سال ۲۰۱۹، حاکی از آن است که دیوید لانسکی، مشاور حقوقی وقت شرکت، از پیشنهاددهندگان اصلی استفاده از این کتابخانه رایگان بوده است. با این حال، لحن دیگر اعضای فنی از جمله تام براون و بن مان نسبت به این اقدام کاملاً هشداردهنده بود؛ به‌طوری‌که آن‌ها منبع مورد نظر را «مشکوک» توصیف کرده بودند. پایگاه LibGen پیش‌تر نیز به‌دلیل انتشار غیرقانونی آثار دارای حق نشر، با احکام قضایی سنگینی از سوی دادگاه‌های فدرال و ناشران بزرگ علمی روبه‌رو شده بود.

فشارها و دغدغه‌های حقوقی درون اوپن‌آی به حدی بود که تیم پژوهشی تلاش کرد ردی از نام این سایت باقی نگذارد. داریو آمودی، پژوهشگر ارشد وقت اوپن‌آی و مدیرعامل فعلی شرکت رقیب یعنی آنتروپیک، در پیام‌رسان داخلی شرکت پرسیده بود که آیا پنهان کردن هویت واقعی پیکره‌های داده زیر نام‌های مبهمی مانند Books1 و Books2 درست است؟ بن مان نیز تأیید کرده بود که این توضیحات عمداً کلی تنظیم شده‌اند تا منبع اصلی یعنی LibGen فاش نشود. بخش قابل‌توجهی از مهندسان و محققانی که در آن دوران روی این مدل‌ها کار می‌کردند، اکنون در شرکت آنتروپیک مشغول به فعالیت هستند.

مدیران اوپن‌آی از نظر مالی نیز هزینه‌های خرید قانونی کتاب را بررسی کرده بودند. گرگ بروکمن، رئیس اوپن‌آی، در اواخر سال ۲۰۲۲ در پاسخی به ایلیا سوتسکور اذعان کرده بود که خرید انبوه کتاب امکان‌پذیر است، اما به دلیل هزینه‌بر بودن به ازای هر توکن، در اولویت شرکت قرار نگرفته است. با تشدید حاشیه‌ها و رسانه‌ای شدن موضوع، باب مک‌گرو، معاون وقت پژوهش اوپن‌آی، در اواسط سال ۲۰۲۲ دستور داد که برای مصون ماندن شرکت از تبعات حقوقی، داده‌های LibGen به‌طور کامل از سیستم‌ها و ذخیره‌سازی‌ها پاک‌سازی شود. او تأکید کرده بود که هرچند این کار بازتولید نتایج قبلی را دشوار می‌کند، اما از نظر حقوقی بسیار ارزشمند است.

فراتر از مساله کپی‌رایت، این اسناد نشان می‌دهند که مدیران اوپن‌آی به‌خوبی از پیامدهای اجتماعی فناوری خود آگاه بوده‌اند. جک کلارک، مدیر سابق سیاست‌گذاری اوپن‌آی، در سال ۲۰۲۰ هشدار داده بود که با پیشرفت مدل‌های هوش مصنوعی، نویسندگان ژانرهای مختلف نگران جایگزین شدن خود در بازار خواهند شد، اما شرکت ناچار است اعتراضات هنرمندان را نادیده بگیرد. تارون گوگینی، از کارکنان فنی شرکت نیز، موج بیکاری هنرمندان را یک «اختلال اقتصادی قابل‌قبول» خوانده بود؛ هرچند سام آلتمن بعدها در کنگره ادعا کرد که شرکت تمایلی به جایگزینی خالقان اثر ندارد.

این پرونده تنها به اوپن‌آی محدود نمی‌شود. شرکت آنتروپیک نیز سال گذشته مجبور شد برای حل‌وفصل دعاوی مشابه، توافقی ۱.۵ میلیارد دلاری با نویسندگان امضا کند. با گسترش این چالش‌ها و شکل‌گیری توافق‌های تجاری میان رسانه‌ها و غول‌های فناوری، افشای این اسناد بار دیگر بحث‌های داغ پیرامون مرز میان نوآوری تکنولوژیک و حقوق مولفان را در عصر هوش مصنوعی داغ‌تر کرده است.

#اوپن آی #سرقت ادبی #چت جی پی تی #وال استریت ژورنال #هوش مصنوعی
منبع: اطلاعات آنلاین