الاتهام الأساسي بسيط: شركات الذكاء الاصطناعي جرفت الكتب والمقالات والصور والرموز والموسيقى المحمية بحقوق الطبع والنشر دون إذن أو دفع قرش. قامت شركات مثل OpenAI وMeta وStability AI وAnthropic ببناء أعمال تجارية بمليارات الدولارات من خلال تدريب نماذجها على أعمال استغرق البشر سنوات في إنشائها. والآن تتزايد الدعاوى القضائية بسرعة أكبر من استجابة ChatGPT، والنظام القانوني يحاول أن يحدد ما إذا كان هذا يشكل أكبر سرقة لحقوق النشر في التاريخ أو يعتبر ضمن الاستخدام العادل. أطلقت Getty Images الرصاصة الأولى في يناير 2023، عندما رفعت دعوى ضد Stability AI في كل من المحاكم الأمريكية والبريطانية، لادعاء نسخ 12 مليون صورة من قاعدة بياناتها لتدريب مولد الصور Stable Diffusion. الدليل الواضح؟ أحياناً تُخرج نماذج Stability صوراً لا تزال تحمل علامة Getty المائية، مشوهة لكن قابلة للتعرف عليها. لم تعد Getty تطالب بصفقة ترخيص، بل تريد تعويضات قانونية قد تصل إلى المليارات. في المحكمة الجنوبية لنيويورك (القضية 1:23-cv-00135)، القاضية كاثرين بولك فايلا تزن فيما إذا كان جمع بيانات Stability يشكل استخداماً عادلاً تحويلياً أم انتهاكاً واضحاً. اعتباراً من مايو 2024، نجت القضية من طلب Stability بالرفض، مما يعني أن الاكتشاف سيجبر الشركة على الكشف عن البيانات التدريبية التي استخدمتها وكيف. نسق اتحاد المؤلفين دعاوى جماعية تقرأ كما لو كانت قائمة بأهم الأدباء الأمريكيين. رفع سارة سيلفرمان وجون غريشام ومايكل تشابون وجورج آر. آر. مارتن وجودي بيكولت دعاوى ضد OpenAI وMeta (القضايا 3:23-cv-03416 و3:23-cv-03223 في المنطقة الشمالية من كاليفورنيا). شكواهم أنيقة: عندما تقوم بمطالبة ChatGPT أو LLaMA بتلخيص كتبهم، تنتج النماذج تفاصيل دقيقة عن الحبكة وأقواس الشخصيات وحتى محاكاة أسلوب الكتابة، مما يثبت أن النصوص الكاملة المحمية بحقوق النشر تم ابتلاعها أثناء التدريب. تعتمد دفاعات OpenAI على دعائمين: الاستخدام العادل (أن التدريب تحويلي ولا يحل محل السوق الأصلي) والحجة بأن التعلم من الأعمال المحمية بحقوق النشر هو ما يفعله البشر كل يوم. القاضي فينس شهابريا لم يقتنع بهذا بالكامل. في فبراير 2024، سمح بالمطالب الأساسية في قضايا حقوق الطبع والنشر بينما رفض بعض المطالب المشتقة حول انتهاكات قانون الألفية الجديدة لحقوق الطبع والنشر (DMCA). دخلت صناعة الموسيقى المعركة بشراسة. رفعت جمعية صناعة التسجيلات الأمريكية (RIAA)، نيابة عن مجموعة Universal Music وSony Music Entertainment وWarner Music Group، دعاوى ضد مولدات الموسيقى بالذكاء الاصطناعي Suno وUdio في يونيو 2024 (القضايا 1:24-cv-05410 و1:24-cv-05311، في منطقة ماساتشوستس). أدلتهم مدمرة: قاموا بمطالبة الذكاء الاصطناعي بكلمات أو تعليمات نمطية محددة وحصلوا على نتائج تكرر أجزاء من تسجيلات Mariah Carey وABBA وJames Brown. اعترف مايكي شولمان، الرئيس التنفيذي لـSuno، في مقابلة مع BBC أن الشركة تدرب على الموسيقى المحمية بحقوق النشر ولكنه يجادل بأن الناتج تحويلي. لا توافق RIAA، ويطالبون بما يصل إلى 150,000 دولار لكل عمل تم انتهاكه عمداً، وقد وثقوا أكثر من 400 أغنية في الشكوى وحدها. كيف تدير شركات الذكاء الاصطناعي هذا الحقل القانوني؟ تتوزع الاستراتيجيات على أربع مجموعات:

  1. دفاع الاستخدام العادل: الادعاء بأن تدريب الذكاء الاصطناعي هو استخدام تحويلي بموجب المادة 107 من قانون حقوق النشر. الإشارة إلى Google Books (كتابة المؤلفين ضد Google، 2015) حيث تم اعتبار مسح ملايين الكتب للبحث استخداماً عادياً.
  1. لا نفاذ يعني لا انتهاك: الحجة أنه بمجرد التدريب، لا "يحتفظ" النموذج بالأعمال المحمية بحقوق النشر، لذا فإن النتائج ليست نسخاً. نجح هذا جزئياً في دعاوى GitHub Copilot، حيث لاحظ القاضي جون س. تيجار في نوفمبر 2023 أن المدعين واجهوا صعوبة في إثبات النسخ المباشر.
  1. شراكات الترخيص: وقعت OpenAI صفقات مع Associated Press وAxel Springer وFinancial Times في 2023-2024 لترخيص المحتوى. عادة ما تدفع هذه الاتفاقيات 5-10 ملايين دولار سنوياً لكل ناشر رئيسي، وهي جزء مما تستحقه البيانات التدريبية فعلياً لكنها كافية لإنشاء سرد "فاعلين جيدين".
  1. لوم الإنترنت المفتوح: تجادل الشركات بأنها جمعت البيانات المتاحة للجمهور، والتي تعاملت المحاكم معها تاريخياً بشكل مختلف عن المحتوى المحمي بجدار الدفع. عادة لا ينطبق قانون الاحتيال وإساءة استخدام الكمبيوتر (CFAA) على جمع البيانات من الويب العام (hiQ Labs ضد LinkedIn، الدائرة التاسعة 2022).

لكن هنا حيث تصبح الأمور غريبة: نشر باحثون من جامعة كارنيجي ميلون ومعهد ألين للذكاء الاصطناعي ورقة بعنوان "استخراج بيانات التدريب القابلة للتوسع من النماذج اللغوية (الإنتاج)" في نوفمبر 2023. أظهروا أن GPT-3.5 يمكن تحفيزه لاستعادة نصوص كاملة من هاري بوتر، مما يؤكد أن النماذج تحفظ قطعًا محمية بحقوق النشر، وليس مجرد أنماط إحصائية. قانون الاتحاد الأوروبي AI، الذي دخل حيز التنفيذ في أغسطس 2024، يطلب من مطوري الذكاء الاصطناعي نشر ملخصات مفصلة لبيانات التدريب المحمية بحقوق النشر. المادة 53 تفرض بشكل خاص الشفافية حول المحتوى المستخدم، مما يوفر لأصحاب الحقوق خارطة طريق للمقاضاة. تقدم اليابان نهجاً مخالفاً: قانون حقوق النشر الخاص بها في المادة 30-4، المعدل في 2019، يسمح صراحةً بتدريب الذكاء الاصطناعي على الأعمال المحمية بحقوق النشر للاستخدام غير التعبيري. ولهذا قامت Stability AI بنقل عمليات كبيرة إلى طوكيو في 2023. ومع ذلك، لا تزال المحاكم اليابانية تحظر المخرجات التي تستنسخ "التعبير" عن الأعمال الأصلية، مما يخلق خطاً غامضاً بين التعلم والنسخ الذي يعكس نقاش الاستخدام العادل في الولايات المتحدة.