أظهرت القضايا القانونية الأخيرة المتعلقة بتدريب نماذج الذكاء الاصطناعي على الأعمال الأدبية المحمية عمق التعقيدات القانونية في هذا المجال. تدرّب أنظمة ChatGPT وGemini وClaude على قواعد بيانات ضخمة تضم مئات الملايين من الكتب والمقالات والأوراق الأكاديمية، غالبًا دون علم المؤلفين أو موافقتهم.

في حكم أصدره العام الماضي، أمر القاضي وليام ألسوب شركة Anthropic بدفع تسوية قدرها 1.5 مليار دولار لمجموعة من الكتّاب، إلا أن الحكم تضمن منحى غير متوقع: اعتبر القاضي أن تدريب نماذج الشركة على هذه الأعمال كان قانونيًا من حيث المبدأ. ما عاقبه عليه فعلًا كان الحصول على هذه الكتب من مكتبات رقمية غير شرعية. وشبّه القاضي طريقة امتصاص النموذج اللغوي لتريليونات الكلمات بكيفية اطلاع الكاتب على الأدب.

تعتمد معظم القضايا على مفهوم "الاستخدام العادل" وهو استثناء من قوانين حقوق النشر يسمح باستخدام المواد المحمية دون إذن صريح، بشرط أن يكون هذا الاستخدام "تحويليًا" أي أنه يخلق شيئًا مختلفًا. لكن المحاكم المختلفة تصل إلى نتائج متباينة. في قضية بين شركة Thomson Reuters وشركة Ross Intelligence، رأى القاضي أن التدريب على محتوى رويترز لبناء منصة قانونية منافسة لا يعتبر استخدامًا عادلًا، بينما الحجة بأن روبوتات الدردشة تنافس الكتّاب لم تنجح حتى الآن في المحكمة.

المشكلة الأساسية أن قانون حقوق النشر لم يُحدّث منذ عام 1976، ما يضطر القضاة لتطبيق قوانين عمرها خمسة عقود على تكنولوجيا لم تكن موجودة حينها. معظم شركات الذكاء الاصطناعي تواجه دعاوى قضائية معلقة، مما يعني أن حلًا نهائيًا لن يأتي قريبًا، والقرارات الحالية، رغم أنها قد تُعكس لاحقًا، تشكّل بالفعل واقع الصناعة.