بحث درباره استفاده از محتوای دارای حق نشر برای آموزش مدلهای هوش مصنوعی مولد وارد مرحله تازهای شده است. اسناد جدید یک پرونده قضایی نشان میدهند برنت هخت، مدیر علوم کاربردی مایکروسافت، در اظهاراتی که در جریان پرونده ثبت شده، احتمال داده است مردم در سراسر جهان آموزش مدلهای زبانی بزرگ با استفاده از محتوای اینترنتی را نوعی سرقت گسترده نیروی انسانی تلقی کنند.
به گزارش ایتنا به نقل از Techspot، این اظهارات در شرایطی مطرح شده که مایکروسافت و اوپنایآی در یک پرونده حقوقی مرتبط با نیویورک تایمز استدلال میکنند استفاده از مطالب دارای حق نشر برای آموزش مدلهای هوش مصنوعی میتواند تحت مفهوم «استفاده منصفانه» قرار گیرد. آنها همچنین معتقدند خروجی مدلهای هوش مصنوعی در مواردی به اندازه کافی با محتوای اصلی تفاوت پیدا میکند و ماهیتی دگرگونشده دارد.
با این حال، اسناد داخلی ارائهشده در دادگاه، نمونههایی از توانایی مدلهای هوش مصنوعی برای بازتولید محتوای منتشرشده را نیز مطرح میکنند. گرگ براکمن، از مدیران اوپنایآی، در اظهاراتی اذعان کرده است که چتجیپیتی هنگام کار با مطالب نیویورک تایمز میتواند برخی جملات این نشریه را پیشبینی و تکمیل کند. بر اساس اسناد پرونده، هخت نیز گفته است دفاع از چنین وضعیتی ممکن است به تضعیف مفهوم استفاده منصفانه منجر شود.
به گزارش ایتنا به نقل از Techspot، این اظهارات در شرایطی مطرح شده که مایکروسافت و اوپنایآی در یک پرونده حقوقی مرتبط با نیویورک تایمز استدلال میکنند استفاده از مطالب دارای حق نشر برای آموزش مدلهای هوش مصنوعی میتواند تحت مفهوم «استفاده منصفانه» قرار گیرد. آنها همچنین معتقدند خروجی مدلهای هوش مصنوعی در مواردی به اندازه کافی با محتوای اصلی تفاوت پیدا میکند و ماهیتی دگرگونشده دارد.
با این حال، اسناد داخلی ارائهشده در دادگاه، نمونههایی از توانایی مدلهای هوش مصنوعی برای بازتولید محتوای منتشرشده را نیز مطرح میکنند. گرگ براکمن، از مدیران اوپنایآی، در اظهاراتی اذعان کرده است که چتجیپیتی هنگام کار با مطالب نیویورک تایمز میتواند برخی جملات این نشریه را پیشبینی و تکمیل کند. بر اساس اسناد پرونده، هخت نیز گفته است دفاع از چنین وضعیتی ممکن است به تضعیف مفهوم استفاده منصفانه منجر شود.
اوپنایآی پیشتر نیز اعلام کرده بود آموزش مدلهای کاربردی هوش مصنوعی بدون دسترسی به محتوای دارای حق نشر بسیار دشوار یا غیرممکن است. در همین حال، شرکتهای مختلف فناوری همچنان از دادههای گسترده برای آموزش مدلهای خود استفاده میکنند؛ موضوعی که درباره دادههای کاربران، مقالات خبری، کتابها و سایر محتوای اینترنتی بحثهای حقوقی و اخلاقی ایجاد کرده است.
بخش دیگری از اختلاف نیویورک تایمز با شرکتهای هوش مصنوعی به تأثیر این فناوری بر صنعت خبر مربوط میشود. خلاصههای تولیدشده توسط هوش مصنوعی در موتورهای جستوجو میتوانند اطلاعات موجود در مقالات را بدون نیاز به مراجعه مستقیم کاربران به وبسایت ناشران ارائه کنند. در اسناد اخیر نیز یکی از مدیران اوپنایآی، صنعت نشر و رسانه را در برابر تأثیر هوش مصنوعی با تهدیدهای جدی توصیف کرده است.