اتخذت وزارة العدل الأمريكية موقفًا لصالح شركات الذكاء الاصطناعي في دعوى قضائية موحدة أطلقتها نيويورك تايمز وجهات حقوق نشر أخرى، معتبرة أن تدريب النماذج اللغوية على محتوى محمي بحقوق النشر يشكل استخدامًا عادلًا وفقًا للقانون.

رفعت الصحيفة دعواها ضد OpenAI وميكروسوفت في أواخر 2023 أمام محكمة فيدرالية بمانهاتن، متهمة الشركتين باستخدام ملايين مقالات التايمز دون ترخيص في تدريب نماذج مثل GPT-4 وتطوير منتجات تنافس الصحيفة كمصدر للمعلومات. طالبت الصحيفة بتعويضات تبلغ مليارات الدولارات وطلبت إتلاف النماذج اللغوية المدربة على محتواها. تُعتبر القضية الآن نقطة مرجعية حول كيفية تعامل المحاكم مع حقوق النشر والذكاء الاصطناعي.

حجت وزارة العدل بأن النصوص المحمية المستخدمة في التدريب لا تشكل انتهاكًا لحقوق النشر، مؤكدة أن التمييز بين مرحلة التدريب والمخرجات هو الفيصل. فخلال التدريب يتم نسخ الأعمال كاملة لكن لا تُنشر للعلن، والمخرجات غالبًا ما تفتقر إلى تشابه جوهري مع الأصول. واستشهدت الوزارة بحالة الكاتبة جوان ديديون التي نسخت قصصًا لهيمنجواي وهي مراهقة لفهم أسلوبه، معتبرة أنه من غير المعقول مساءلة الكاتب في كل مرة ينشر فيها عملًا استفاد من قراءاته السابقة.

أكدت الوزارة أيضًا أن النماذج اللغوية تحمل قيمة إبداعية وعامة، وأن المسؤولية القانونية عن التدريب ستعيق الابتكار الذي يحميه قانون حقوق النشر. غير أن هذه الحجج تتغاضى عن عامل الحجم والنطاق، فنسخ مؤلف واحد للنصوص لغرض التعلم يختلف جوهريًا عن قيام شركة بمليارات الدولارات بتحويل هذا المحتوى إلى منتجات تنافسية بحجم ضخم.

قبل أيام، كان مكتب حقوق النشر الأمريكي قد رفض في تقرير رسمي منح حصانة شاملة لتدريب الأنظمة، محتجًا بأن الذكاء الاصطناعي يعمل بنسخ مثالية وينتج محتوى بسرعة وحجم يتجاوز بكثير الإنتاج البشري. هاجمت وزارة العدل هذا التقرير مباشرة، محتجة بأن تقييم المديرة السابقة شيرا بيرلموتر لا يحمل سلطة قانونية ملزمة وتجاهل أحكام القضاء بخصوص تحليل كل حالة على حدتها. وجدير بالذكر أن بيرلموتر أُقيلت من منصبها بعد صدور تقريرها بفترة قصيرة.