هوش مصنوعی کتاب‌های ارزشمند را می‌بلعد

شرکت‌های هوش مصنوعی برای تأمین داده آموزشی به خرید گسترده کتاب‌های قدیمی و کمیاب روی آورده‌اند.
به گزارش گروه علم و پیشرفت خبرگزاری فارس به نقل از فون‌آرنا، هوش مصنوعی برای باهوش‌تر شدن، حالا سراغ یکی از قدیمی‌ترین منابع دانش بشر رفته است: کتاب. شرکت‌های فعال در حوزه هوش مصنوعی برای دسترسی به حجم عظیمی از متن باکیفیت، به خرید گسترده کتاب‌های قدیمی و حتی کمیاب روی آورده‌اند؛ کتاب‌هایی که پس از اسکن در برخی موارد دیگر به شکل فیزیکی باقی نمی‌مانند. این روند هم بازار کتاب‌های دست‌دوم را دگرگون کرده و هم نگرانی‌هایی درباره نابودی بخشی از میراث مکتوب بشر ایجاد کرده است.ماجرا از نیاز روزافزون مدل‌های هوش مصنوعی به داده شروع می‌شود. اینترنت دیگر منبع بی‌پایانی از محتوای تازه و باکیفیت نیست و شرکت‌ها برای آموزش مدل‌های زبانی قدرتمند، به دنبال متن‌هایی هستند که ساختار منسجم، زبان انسانی و اطلاعات تخصصی داشته باشند. کتاب‌های چاپ‌شده، به‌خصوص آثار قدیمی که پیش از موج تولید محتوای هوش مصنوعی منتشر شده‌اند، برای این شرکت‌ها جذابیت ویژه‌ای دارند؛ زیرا احتمال کمتری دارد خودشان حاصل تولید ماشینی باشند. یک گزارش تحقیقی نیز نشان داده است شرکت‌هایی برای تهیه کتاب‌های چاپی از واسطه‌ها استفاده می‌کنند و حتی درباره مسئله «تصویر عمومی» این خریدها نگرانی وجود دارد.
اما بخش نگران‌کننده ماجرا بعد از خرید کتاب آغاز می‌شود. در روشی که به «اسکن مخرب» یا تخریبی معروف شده، عطف کتاب بریده می‌شود تا صفحات بتوانند با سرعت بالا وارد دستگاه اسکن شوند. پس از دیجیتالی‌شدن صفحات، نسخه کاغذی دیگر ارزش اولیه خود را ندارد و ممکن است دور ریخته یا برای بازیافت ارسال شود. برای یک کتاب معمولی شاید این اتفاق چندان مهم به نظر نرسد؛ اما وقتی پای نسخه‌های کمیاب، چاپ‌های قدیمی یا کتاب‌هایی به میان می‌آید که یافتن دوباره آنها دشوار است، ماجرا کاملاً متفاوت می‌شود.
یکی از مهم‌ترین نمونه‌های این روند به شرکت آنتروپیک مربوط است. اسناد دادگاه که در سال ۲۰۲۶ منتشر شدند، جزئیاتی از پروژه‌ای محرمانه با نام «پاناما» را آشکار کردند؛ پروژه‌ای که هدف آن خرید و دیجیتالی‌کردن حجم بسیار بزرگی از کتاب‌های چاپی برای استفاده در آموزش مدل‌های هوش مصنوعی بود. طبق گزارش‌ها، میلیون‌ها کتاب خریداری و صفحات آنها برای اسکن از عطف جدا شدند. اسناد دادگاه نشان می‌دهند این عملیات در مقیاس بسیار بزرگی دنبال شده بود.این اتفاق یک تناقض عجیب ایجاد کرده است: هوش مصنوعی برای یادگیری دانش بشر، به خود کتاب‌ها نیاز دارد؛ اما فرایند استخراج این دانش می‌تواند به نابودی نسخه فیزیکی همان منبع منجر شود. در نگاه اقتصادی، خریدهای عمده ممکن است برای کتاب‌فروشان دست‌دوم و فروشندگان کتاب‌های قدیمی درآمد قابل توجهی ایجاد کند. برخی فروشندگان حتی با سفارش‌هایی روبه‌رو شده‌اند که تعداد کتاب‌های درخواستی آنها غیرعادی بوده و خریدار درباره قیمت یا جزئیات معمول کتاب حساسیت چندانی نداشته است.اما همین رونق می‌تواند بازار را از مسیر طبیعی خود خارج کند. وقتی خریدارانی با سرمایه بسیار زیاد هزاران جلد کتاب را یکجا می‌خرند، کتاب‌فروشی که پیش‌تر با مجموعه‌ای از خریداران عادی، مجموعه‌داران و پژوهشگران سر و کار داشت، ناگهان با تقاضایی مواجه می‌شود که هدفش خواندن، نگهداری یا حتی فروش مجدد کتاب نیست؛ کتاب صرفاً ماده خام برای تولید داده است.
این مسئله به‌ویژه برای بازار کتاب‌های کمیاب اهمیت دارد. یک نسخه قدیمی ممکن است تنها یک کالا نباشد؛ ممکن است بخشی از تاریخ نشر، فرهنگ یا ادبیات یک کشور باشد. اگر نسخه‌ای کمیاب خریداری و سپس برای اسکن از بین برود، فایل دیجیتال حاصل از آن می‌تواند برای آموزش یک مدل ارزشمند باشد، اما نسخه اصلی دیگر در اختیار مجموعه‌داران، کتابخانه‌ها یا نسل‌های بعدی نخواهد بود.نگرانی‌ها حتی از حفظ میراث مکتوب فراتر رفته است. بیش از دوازده گروه مدنی اخیراً از کمیسیون تجارت فدرال آمریکا خواسته‌اند درباره خرید، اسکن و نابودی کتاب‌ها توسط شرکت‌های هوش مصنوعی تحقیق کند. استدلال آنها این است که مسئله فقط حق نشر نیست و چنین خریدهای گسترده‌ای ممکن است بر رقابت در بازار نیز اثر بگذارد؛ زیرا شرکت‌های بزرگ فناوری می‌توانند منابع مادی و اطلاعاتی ارزشمندی را در مقیاس بسیار بزرگ جذب کنند.از طرف دیگر، فشار هوش مصنوعی تنها به سمت بلعیدن کتاب‌های قدیمی نیست؛ خود بازار کتاب نیز با موج دیگری از تولید انبوه کتاب‌های تولیدشده با هوش مصنوعی مواجه شده است. یک پژوهش جدید روی بیش از ۱۴ هزار کتاب داستانی خودانتشاریافته در آمازون نشان داده که تعداد کتاب‌های دارای نشانه‌های قابل توجه از متن تولیدشده با هوش مصنوعی در حال افزایش است و تعداد کتاب‌های دارای فروش در هر فصل بسیار سریع‌تر از درآمد کل بازار رشد کرده است؛ وضعیتی که می‌تواند به کاهش درآمد متوسط هر کتاب فروخته‌شده منجر شود.
در نتیجه، هوش مصنوعی از دو طرف به بازار کتاب فشار وارد می‌کند: از یک سو برای ساختن مدل‌های بهتر، کتاب‌های موجود را به داده تبدیل می‌کند و در برخی فرایندها نسخه فیزیکی آنها از بین می‌رود؛ از سوی دیگر، خودش تولیدکننده سیل جدیدی از کتاب‌های کم‌هزینه است که می‌تواند فضای بازار را اشباع کند. اکنون پرسش بزرگ‌تری شکل گرفته است: اگر کتاب‌ها برای ساختن هوش مصنوعی به داده تبدیل شوند، چه کسی مالک نسخه‌های دیجیتال دانش خواهد بود و چه چیزی برای نسل بعد باقی می‌ماند؟ فناوری می‌تواند میلیون‌ها صفحه را در چند روز اسکن و به داده تبدیل کند؛ اما اگر نسخه‌های فیزیکی منابع کمیاب در همین مسیر نابود شوند، چیزی که از بین رفته شاید دیگر با هیچ الگوریتمی قابل بازسازی نباشد.هوش مصنوعی برای یادگیری، اشتهای سیری‌ناپذیری پیدا کرده است و حالا کتاب‌ها یکی از اصلی‌ترین خوراک‌های این اشتها هستند. نگرانی اصلی دیگر فقط این نیست که هوش مصنوعی چه چیزی از کتاب‌ها یاد می‌گیرد؛ مسئله این است که در مسیر یادگیری، چه تعداد از خود کتاب‌ها ممکن است برای همیشه از بازار و جهان فیزیکی ناپدید شوند.#هوش_مصنوعی #کتاب #کتابخوانی #بازار_کتاب #کتاب_های_کمیاب #فناوری #هوش_مصنوعی_مولد #رباتیک #آینده_فناوریآخرین مطالب حوزه فناوری را در صفحه اصلی «علم و پیشرفت» بخوانید.
01:09 - 2 شهریور 1405

0 بازدید