فروشندگان کتابهای دستدوم طی چند ماه گذشته متوجه یک الگوی عجیب و مشکوک شدهاند. سفارشهای بسیار حجیم و عمدهای برای خرید کتابهای قدیمی و دستدوم ثبت میشود که در اغلب موارد هیچ موضوع، نویسنده یا ژانر مشترک و مشخصی ندارند؛ موضوعی که باعث سردرگمی کتابفروشان شده که چه کسانی و با چه هدفی خواهان این کتابها هستند.
به گزارش بخش اخبار فناوری زوم تک به نقل از دیجیتال ترندز (Digital Trends) و بر اساس گزارش روزنامه گاردین (The Guardian)، کتابفروشان در بریتانیا و ایرلند سفارشهای عمدهای دریافت کردهاند که از متون کشاورزی گرفته تا زندگینامه چهرههای مسابقات اتومبیلرانی را شامل میشود. بر اساس گزارشها، برخی از این خریداران از نامهای مستعار و مبهم استفاده میکنند، سفارشها را به آدرس انبارهای حمل بار یکسان میفرستند و بدون چانهزنی برای دریافت تخفیف خرید عمده، قیمت کامل کتابها را پرداخت میکنند. فعالیتهای مشابهی نیز در ایالات متحده، استرالیا و اروپا مشاهده شده است.
چرا غول های هوش مصنوعی به دنبال خرید و جمعآوری کتاب های چاپی قدیمی هستند؟
هنوز مدرک قطعی و مستقیمی مبنی بر اینکه شرکتهای توسعهدهنده هوش مصنوعی (AI) پشت اکثر این خریدهای مرموز هستند وجود ندارد؛ اما با نگاهی به اتفاقاتی که در سایر بخشهای این صنعت در حال رخ دادن است، این فرضیه چندان دور از ذهن به نظر نمیرسد.
رسانه 404 Media پیشتر صفحهای را در وبسایت ISBNdb کشف کرده بود که در آن خدماتی تحت عنوان «تأمین کتابهای چاپی برای نیازهای دیتاست مدلهای زبانی بزرگ (LLMs) هوش مصنوعی» تبلیغ میشد. پایگاه ISBNdb این صفحه را در تاریخ ۲۸ ژوئیه حذف و اعلام کرد که این اقدام صرفاً تلاشی برای ارزیابی میزان تقاضای بازار بوده و شرکت تصمیم گرفته است از این ایده صرفنظر کند.

دو روز بعد، پایگاه ISBNdb بیانیه و توضیحات تکمیلی دقیقتری منتشر کرد. این مجموعه تأکید کرد که تاکنون هیچ کتابی را برای آموزش مدلهای هوش مصنوعی خریداری، اسکن یا به فروش نرسانده، هرگز مدلهای هوش مصنوعی را آموزش نداده و سرویس پیشنهادی مذکور نیز در واقعیت هرگز راهاندازی نشده است.
داده های ناب انسانی؛ مزیت بی بدیل متون پیش از عصر هوش مصنوعی مولد
سرنخهای دیگری نیز در این زمینه وجود دارد. نشریه آتلانتیک (The Atlantic) گزارش داده است که شرکت سنگاپوری دادههای هوش مصنوعی موسوم به 2077AI با درخواستهایی برای جمعآوری هزاران جلد کتاب تخصصی مرتبط بوده است؛ هرچند این موضوع به تنهایی نمیتواند ارتباط مستقیم این شرکت با موج گسترده خریدهای اخیر را اثبات کند.
یکی از فرضیههای قدرتمند این است که کتابهای منتشرشده پیش از شکوفایی و انفجار هوش مصنوعی مولد (Generative AI)، ویژگی فوقالعاده باارزشی برای توسعهدهندگان مدلها فراهم میکنند: حجم عظیمی از محتوای دستنوشته و اصیل انسانی بدون هیچگونه ریسک یا نگرانی از بابت آلودگی به متون تولیدشده توسط هوش مصنوعی. صفحه حذفشده در وبسایت ISBNdb نیز دقیقاً با استناد به همین ویژگی، کتابهای چاپی قدیمیتر را به عنوان دادههای آموزشی ارزشمند برای الگوریتمها معرفی کرده بود.
نگرانی از اسکن مخرب و نابودی فیزیکی کتاب های نایاب و چاپتمام
بزرگترین نگرانی در این میان، سرنوشت فیزیکی این کتابها است و متأسفانه ما از قبل میدانیم که فرآیند اسکن مخرب (Destructive Scanning) در این صنعت رخ میدهد.
اسناد دادگاه پیشتر فاش کرده بود که شرکت آنتروپیک (Anthropic) میلیونها دلار صرف خرید کتابهای فیزیکی کرده، عطف و شیرازه آنها را بریده، محتوای صفحات را اسکن نموده و سپس همزمان با ساخت کتابخانه آموزشی خود، باقیمانده کتابها را برای بازیافت ارسال کرده است. البته شرکت آنتروپیک مدعی است که برنامههای خرید کتاب آن شامل خرید و تخریب کتابهای نایاب یا عتیقه نمیشود.

با این حال، برای هر فردی که زمان زیادی را صرف جستجو برای یافتن کتابهای قدیمی و چاپتمام (Out-of-print) میکند، این احتمال به شدت نگرانکننده و آزاردهنده است. برخی از کتابها صرفاً در تیراژهای بسیار محدودی چاپ شدهاند و زمانی که این نسخههای باقیمانده از بین بروند، پیدا کردن نسخهای دیگر از آنها بسیار دشوار خواهد بود. این ایده که یکی از معدود نسخههای باقیمانده از یک اثر صرفاً برای استخراج متن جهت آموزش هوش مصنوعی نابود شود، بسیار تلخ و ناخوشایند است. اگر شرکتهای هوش مصنوعی واقعاً در پشتپرده این سفارشهای اسرارآمیز قرار دارند، تنها باید امیدوار بود که فردی پیش از برش دادن و تکهتکه کردن این کتابها، ارزش تاریخی و نسخه آنها را به دقت بررسی کند.





نظرات در مورد : خرید فلهای و مرموز کتاب های قدیمی توسط شرکت های هوش مصنوعی؛ آیا گنجینه های چاپی در حال نابودی هستند؟