
بر اساس گزارش رسانه 404 Media و اسناد افشاشده از پروندههای قضایی، شرکتهای بزرگ حوزه هوش مصنوعی از جمله «آنتروپیک» (Anthropic)، سازنده مدل هوش مصنوعی کلود، هزینههای دهها میلیون دلاری را برای خرید میلیونها جلد کتاب اختصاص دادهاند. هدف از این خرید، استخراج دادههای متنی برای آموزش مدلهای زبانی بزرگ (LLM) است.
فرآیند اسکن و تخریب فیزیکی کتابها
طبق اسناد منتشر شده، این شرکتها پس از خرید انبوه کتابها، از روشهای صنعتی برای جداسازی صفحات استفاده میکنند. فرآیند شامل مراحل زیر است:
- استفاده از دستگاههای برش هیدرولیک برای جدا کردن عطف کتابها.
- اسکن تکتک صفحات با تجهیزات صنعتی پیشرفته.
- از بین رفتن ساختار فیزیکی کتابهای قدیمی و تاریخی پس از اتمام فرآیند اسکن.
در یکی از اسناد داخلی افشا شده که مربوط به پروژهای با نام «پروژه پاناما» است، به تلاش برای اسکن گسترده کتابها اشاره شده است.
دور زدن قوانین کپیرایت و خلاءهای قانونی
علیرغم شکایتهای حقوقی چند میلیارد دلاری نویسندگان علیه شرکتهای هوش مصنوعی، این شرکتها با بهرهگیری از «دکترین فروش اول» (First Sale Doctrine) توانستهاند از قوانین کپیرایت عبور کنند. این دکترین به خریدار اجازه میدهد پس از خرید قانونی یک اثر، هرگونه تصرفی در کالای خریداریشده را انجام دهد.
تأثیر بر بازار کتابهای دستدوم و میراث فرهنگی
این فعالیتها بازار جدیدی را برای کتابفروشان دستدوم ایجاد کرده است که کتابهای قدیمی و خارجی خود را به شرکتهای فناوری میفروشند. اگرچه این روند برای برخی کتابفروشان سودآور بوده، اما نگرانیهای جدی در میان فعالان فرهنگی درباره نابودی کتابهای کمیاب و ارزشمند تاریخ که پس از اسکن به چرخه نابودی میافتند، ایجاد کرده است.