جمعه 27 شهریور 1405

ارز دیجیتال
ارزهای خارجی
بورس
طلا و سکه
انرژی و فلزات

کشف احتمال نابودی کتاب‌های کمیاب توسط شرکت‌های هوش مصنوعی برای آموزش مدل‌ها؛ نگرانی کتابفروشان

18:46 - 1405/05/21 فناوری
488کلمه 3 دقیقه
کشف احتمال نابودی کتاب‌های کمیاب توسط شرکت‌های هوش مصنوعی برای آموزش مدل‌ها؛ نگرانی کتابفروشان
به گزارش حال و هوا - برگردان توسط هوش مصنوعی
شرکت‌های هوش مصنوعی با خرید انبوه کتاب‌های کمیاب و سپس نابودی آن‌ها برای آموزش مدل‌های خود، با مقاومت کتابفروشان روبرو شده‌اند. این نگرانی وجود دارد که این عمل در مقیاس وسیع‌تری رخ دهد و نسخه‌های فیزیکی برخی کتاب‌ها برای همیشه از بین بروند.

اگر واقعاً بتوانید یک کتاب قدیمی را قدر بدانید و شاید از اینکه چگونه صفحات زرد و شکننده آن حاوی برخی از اولین راه‌هایی است که مردم سعی در درک دنیای اطراف خود داشته‌اند، شگفت‌زده شوید، آنگاه تیترهایی درباره شرکت‌های فناوری که کتاب‌های کمیاب را خریداری کرده و سپس آن‌ها را برای آموزش هوش مصنوعی از بین می‌برند، احتمالاً بخش لطیفی از روح شما را می‌آزارد.

واقعاً ناراحت‌کننده است که تصور کنیم انبوهی از عطف کتاب‌ها منتظر ورود به دستگاه‌های خردکن چوب باشند، در حالی که صفحات پاره شده بریده، اسکن و دور ریخته می‌شوند. اما این ارزان‌ترین و آسان‌ترین راه برای اسکن سریع کتاب‌ها است و شرکت‌های هوش مصنوعی در مسابقه‌ای برای پیشبرد مدل‌های خود با آموزش بر روی متون جذاب، با کیفیت بالا و طولانی که فقط در کتاب‌ها یافت می‌شوند، قرار دارند. بنابراین دوستداران کتاب می‌ترسند که این عمل در مقیاس وسیع‌تری نسبت به آنچه در حال حاضر گزارش می‌شود، اتفاق بیفتد و برخی از نسخه‌های فیزیکی کتاب‌ها برای همیشه از دست بروند.

اما آنچه این تخریب را دردناک‌تر می‌کند این است که لزوماً نباید اینطور باشد.

کتابفروشان متوجه شده‌اند که شرکت‌های هوش مصنوعی به طور فزاینده‌ای در حال خرید انبوه کتاب‌های قدیمی هستند. این کتاب‌ها که اغلب حاوی اطلاعات ارزشمند و منحصر به فردی هستند، به دلیل رایگان بودن و عدم وجود «لجن هوش مصنوعی» (AI slop) مورد توجه قرار می‌گیرند. این اصطلاح به متونی اشاره دارد که توسط هوش مصنوعی تولید شده و فاقد کیفیت و اصالت لازم هستند. کتابفروشان نگرانند که شرکت‌های هوش مصنوعی این کتاب‌ها را نه برای مطالعه و حفظ، بلکه برای استخراج داده و سپس از بین بردن فیزیکی آن‌ها خریداری می‌کنند.

این نگرانی‌ها زمانی شدت می‌گیرد که در نظر بگیریم شرکت‌هایی مانند Anthropic، Google، OpenAI و xAI در حال رقابت برای توسعه مدل‌های زبانی بزرگ (LLMs) هستند. این مدل‌ها برای بهبود عملکرد خود به حجم عظیمی از داده‌های متنی نیاز دارند و کتاب‌ها منبعی غنی از این داده‌ها محسوب می‌شوند. اما روش‌های فعلی اسکن و پردازش کتاب‌ها برای آموزش هوش مصنوعی، اغلب شامل تخریب فیزیکی نسخه‌های اصلی است.

یکی از دلایل اصلی این رویکرد، سرعت و هزینه است. اسکن سریع کتاب‌ها و پردازش آن‌ها برای استخراج اطلاعات، در مقایسه با روش‌های دیگر، ارزان‌تر و سریع‌تر تمام می‌شود. با این حال، این روش منجر به از دست رفتن دائمی نسخه‌های فیزیکی کتاب‌ها می‌شود که بخشی از میراث فرهنگی و تاریخی ما را تشکیل می‌دهند.

کتابفروشان و فعالان حوزه حفظ کتاب، راه‌حل‌های جایگزینی را پیشنهاد می‌کنند که به شرکت‌های هوش مصنوعی امکان دسترسی به داده‌های متنی را می‌دهد بدون آنکه نیازی به تخریب کتاب‌ها باشد. این راه‌حل‌ها شامل استفاده از کتابخانه‌های دیجیتال، همکاری با ناشران برای دسترسی به نسخه‌های دیجیتال کتاب‌ها، و توسعه روش‌های اسکن بدون آسیب رساندن به نسخه‌های فیزیکی است.

با این حال، به نظر می‌رسد که در حال حاضر، روند خرید و احتمالاً تخریب کتاب‌های کمیاب توسط شرکت‌های هوش مصنوعی ادامه دارد و این موضوع نگرانی‌های جدی را در میان علاقه‌مندان به کتاب و میراث فرهنگی ایجاد کرده است.

ادامه مقاله را بخوانید

نظرات


📡منبـع خبـر: http://arstechnica.com

Ars Technica

🏹لـینـک کـوتـاه: halohava.top/yMFNhv



بـرچـسب هـا:


اخبار مرتبط:


شمـا اولیـن نفـر هستـید کـه نظـر خـود را ثبـت مـی کنیـد.

🗩ثبـت نظر:


بازگشت به لیست اخبار