OpenAI متهمة باستخدام كتب مقرصنة من LibGen لتدريب نماذج الذكاء الاصطناعي

واجهت OpenAI، بالتعاون مع Microsoft، اتهامات جديدة من رابطة المؤلفين الأمريكية، بشأن استخدام أعمال أدبية محمية بحقوق النشر لتدريب نماذج الذكاء الاصطناعي، دون الحصول على إذن أصحابها ودون الإفصاح عن مصادر البيانات بشكل واضح.
بحسب الوثائق المقدمة للمحكمة، تدّعي الرابطة أن OpenAI قامت بتنزيل كتب عبر موقع Library Genesis (LibGen) الشهير بتوفير الكتب بشكل غير قانوني، واستخدمتها ضمن مجموعات تدريب بيانات سُميت لاحقًا بأسماء “Books1” و”Books2″، بدلاً من الأسماء الأصلية “Libgen1” و”Libgen2″، في ما اعتبرته محاولة لإخفاء مصدر المواد.
وأضافت رابطة المؤلفين الأمريكية أن OpenAI أقدمت على حذف مجموعات البيانات المتعلقة بهذه الكتب في عام 2022 خشية التبعات القانونية.
مع ذلك، تشير الوثائق إلى أن لدى الشركة إدراك تام بمخالفاتها، مستندة إلى مراسلات وتغريدات من موظفين سابقين وحاليين، بينها تدوينة للموظف Tarun Gogineni أشار فيها إلى هدفه في استخدام الذكاء الاصطناعي لاستكمال سلسلة روايات “A Song of Ice and Fire” للكاتب George R.R. Martin في حال وفاته، ما اعتبرته الرابطة دليلاً إضافياً على التوجه لاستبدال المؤلفين بأنظمة الذكاء الاصطناعي.
ويزعم مقدمو الدعوى أن هذا السلوك لا يندرج ضمن مفهوم “الاستخدام العادل”، خاصة وأن تدريب النماذج على أعمال مقرصنة يُشكل انتهاكًا صريحًا لحقوق النشر، فيما لم تصدر OpenAI تعليقًا رسمياً حيال هذه التفاصيل حتى الآن.
من جانبها، تطالب الرابطة المحكمة بإصدار حكم مختصر ضد OpenAI واعتبار استخدام هذه البيانات مخالفاً للقانون، مع تحميل Microsoft المسؤولية نظراً لإمكانية إشرافها على عمليات التدريب وتحقيق استفادة مباشرة منها.
يأتي ذلك في وقت أيدت فيه محاكم أمريكية سابقة إمكانية تدريب النماذج الذكية على أعمال منشورة بموجب الاستخدام العادل، لكن مع التشديد على عدم جواز تدريب النماذج على محتوى مقرصن أو منشور بشكل غير قانوني، ما يضع OpenAI وMicrosoft أمام تحدي قانوني جديد قد يؤثر على سياسات جمع البيانات في قطاع الذكاء الاصطناعي.
KioskNews shows a cleaned-up reading view extracted from the publisher’s page — the original always lives on their site, not ours.