وورلد برس عربي logo

الذكاء الاصطناعي وسرقة المحتوى تهديد الصحافة التقليدية

وثائق تكشف اعترافات صادمة من داخل OpenAI وMicrosoft بسرقة محتوى صحفي لتدريب الذكاء الاصطناعي ما يهدد مستقبل الصحافة والكتّاب ويطرح تساؤلات عن أخلاقيات التقنية وحقوق النشر في عصر الذكاء الاصطناعي وورلد برس عربي

ساتيا ناديلا رئيس مايكروسوفت يتحدث أمام شعاري OpenAI ومايكروسوفت في مؤتمر حول الذكاء الاصطناعي وسط جدل حقوق النشر.
حقوق الصورة: جاستن سوليفان / جيتي إيمدجز
التصنيف:تكنولوجيا
شارك الخبر:
FacebookTwitterLinkedInEmail

حين تُقرّ شركةٌ تقنية كبرى، في وثائق داخلية، بأنّ ما فعلته يُشكّل "سرقةً مذهلة وغير مسبوقة"، فإنّ ذلك لا يبقى مجرّد تفصيلٍ قانوني — بل يصبح سؤالاً جوهرياً عن مستقبل كلّ من يكتب وينشر على الإنترنت. هذا بالضبط ما كشفت عنه وثائق غير مُعتمة حديثاً في قضية حقوق النشر التي رفعتها صحيفة The New York Times ضدّ شركتَي OpenAI و Microsoft.

الوثائق الجديدة — التي رُفعت عنها السرية مؤخراً في إطار هذه الدعوى المرفوعة منذ ثلاث سنوات — لا تحتوي على اتهاماتٍ من طرف المدّعين فحسب، بل تتضمّن اعترافاتٍ من المديرين التنفيذيين أنفسهم، بعضها صادمٌ في صراحته.

"سرقة"... بكلمات موظفيهم

في يناير 2023، كتب Brent Hecht، مدير العلوم التطبيقية في Microsoft، أنّ عمليات جمع البيانات التي بنت عليها الشركتان نماذجهما تمثّل "سرقةً مذهلة وغير مسبوقة"، واصفاً إيّاها بأنّها "أكبر سرقةٍ للعمل البشري في تاريخ الإنسانية". هذه ليست عبارات نشطاء حقوق رقمية أو محامي دفاع؛ إنّها كلمات رجلٍ يعمل داخل المنظومة ذاتها.

الوثائق توضّح كيف جرى ذلك عملياً: تجاوزت الشركتان الجدران المدفوعة (paywalls) دون اكتشاف لسحب المحتوى واستخدامه في تدريب النماذج، وجرى تعمُّد حذف إشعارات حقوق النشر من بيانات التدريب حتى لا تُخرجها النماذج في نتائجها. بل إنّ وثائق الدعوى تُشير إلى أنّ موظفين في OpenAI ابتكروا "حيلةً للتحايل على الجدار المدفوع لـ The New York Times".

الأرقام تُعطي حجم المسألة: تحتوي مجموعات البيانات المستخدمة في منتصف مرحلة التدريب على أكثر من 91,692 نسخة من أعمال صحف The New York Times و Daily News ومركز التحقيقات الاستقصائية (Center for Investigative Reporting). ومجموعة البيانات المعروفة بـ Common Crawl وحدها تضمّنت أكثر من 2 مليون وثيقة من موقع nytimes.com. أمّا مجموعة بيانات "Project Mango" التي تشاركت فيها Microsoft مع OpenAI، فتحتوي على ما لا يقلّ عن 160,903 عملاً فريداً من ناشرين إخباريين.

Nadella يتحدّث عن الترخيص... بعد فوات الأوان

ما يزيد المشهد تعقيداً هو شهادة Satya Nadella، الرئيس التنفيذي لـ Microsoft، الذي أقرّ بأنّ "أيّ محتوى محمي بجدار مدفوع يجب أن يُرخَّص من قِبل أيّ جهة تريد استخدامه... للتأسيس أو التدريب". وذهب أبعد من ذلك حين صرّح: "لو كنتُ قد عُلِّمتُ بأنّ OpenAI قد جمعت وتدرّبت على معلوماتٍ كانت خلف جدارٍ مدفوع، لكنتُ استخدمتُ حقّ Microsoft في إلزام OpenAI بإعادة تدريب نماذجها".

هذه الشهادة مثيرةٌ للتساؤل: هل يعني ذلك أنّ Nadella لم يكن يعلم؟ أم أنّه يُقدّم روايةً تحمي الشركة قانونياً؟ الوثائق لا تُجيب بوضوح، لكنّها تُثبت أنّ Microsoft نقلت بيانات تدريب GPT-3 من OpenAI وتشاركتها عبر مشروعَي "Project Taxi" و"Project Mango".

وثيقةٌ داخلية في Microsoft لخّصت المعضلة بصراحةٍ نادرة: "من النادر جداً أن يُهدّد المنتج النهائي الأسس الاقتصادية لمورّديه الأساسيين، لكنّ هذا هو الوضع الذي أوجدناه لأعمالنا في نماذج اللغة الكبيرة فيما يخصّ 'سلسلة توريد المحتوى'".

التهديد الوجودي للصحافة... بأفواه أصحابه

لم يتوقّف الأمر عند الاعتراف بالسرقة، بل امتدّ إلى الاعتراف بالأضرار. Nick Turley، رئيس ChatGPT في OpenAI، وصف ما تُحدثه المنتجات الاستبدالية للذكاء الاصطناعي بأنّه "تهديدٌ وجودي" للناشرين، مضيفاً أنّ هذه المنتجات "تحلّ محلّهم إلى حدّ كبير"، وأنها "ستصبح بديلًا أكثر فأكثر كلما تحسّنت". وأقرّ Greg Brockman، رئيس OpenAI، بأنّ النماذج "ممتازةٌ في الأخبار".

الأرقام تُؤكّد هذا التقييم: أفضى Microsoft Copilot إلى انخفاضٍ في معدّلات النقر من نتائج Bing إلى نطاق The New York Times بلغ 93%. وفي يناير 2024، وصف Brent Hecht هذا الانخفاض بـ"حلقة الهلاك" (doom loop)، في إشارةٍ إلى دوّامةٍ تتراجع فيها الزيارات المباشرة للمصادر الأصلية كلّما أجاب الذكاء الاصطناعي على الأسئلة بدلاً من إحالة المستخدم إليها. وقد أقرّ Nadella نفسه بأنّ الشات بوت "يستبدل... تزويدك بالمعلومات مباشرةً على المنصة بدلاً من الحاجة إلى الذهاب إلى المصدر الأصلي".

وثيقةٌ داخلية في Microsoft أشارت أيضاً إلى أنّ الذكاء الاصطناعي قد يُعطّل توظيف منتجي البيانات أنفسهم — أي الكتّاب والصحفيين والمحرّرين الذين بنت عليهم هذه النماذج وجودها.

السياق القانوني: المعركة لم تُحسم بعد

من الناحية القانونية، لا تزال المسألة معلّقة. المحاكم الأمريكية كثيراً ما تميل نحو تفسيرٍ موسّع لمبدأ "الاستخدام العادل" (Fair Use)، الذي يُجيز الاستخدام المحدود للأعمال المحمية بحقوق النشر لأغراض كالنقد والتعليق والتحليل. غير أنّ هذا المبدأ يشترط ألّا يُحلّ الاستخدام الجديد محلّ السوق الأصلية للعمل — وهو بالضبط ما تُثبته الأرقام المذكورة. وقد تقدّمت إدارة ترامب بمذكّرة دفاعاً عن استخدام OpenAI للمحتوى المحمي دون ترخيص، مما يُضيف بُعداً سياسياً إلى المعركة القانونية.

OpenAI و Microsoft لم تُعلّقا على الوثائق الجديدة حين طُلب منهما ذلك.

ماذا يعني هذا لمن يكتب بالعربية؟

السؤال الذي يغيب عن معظم التغطيات الغربية هو: ماذا يعني هذا للناشرين والصحفيين خارج الفضاء الإنجليزي؟ إذا كانت صحيفةٌ بحجم The New York Times تُواجه انهياراً بنسبة 93% في معدّلات النقر، فما الذي ينتظر المنابر الإخبارية العربية التي تعمل بموارد أقلّ وحماية قانونية أضعف؟

الوثائق تُثبت أنّ Common Crawl — المستودع المجاني لبيانات الويب الذي يُستخدم على نطاقٍ واسع في تدريب النماذج — يحتوي على ملايين الوثائق من مختلف أنحاء الإنترنت. لا يوجد ما يُشير إلى أنّ المحتوى العربي استُثني من هذه العملية. وفي غياب أطر قانونية واضحة في معظم الدول العربية تُنظّم استخدام المحتوى الرقمي في تدريب نماذج الذكاء الاصطناعي، يبقى الناشر العربي أمام معادلةٍ غير متكافئة: يُنتج المحتوى، وتستهلكه الآلة، وتُعيد توزيع خلاصته دون إحالةٍ إلى المصدر.

القضية لم تُحسم بعد، والمحاكمة مستمرّة. لكنّ ما كشفته الوثائق غير المُعتمة يُغيّر طبيعة النقاش: لم يعد الأمر مجرّد تساؤلٍ عن ما إذا كانت هذه الممارسات تنتهك القانون، بل أصبح سؤالاً عمّن سيبقى قادراً على تمويل الصحافة بعد أن تنتهي المحاكم من إجابته.

أخبار ذات صلة

Loading...
طائرة هليكوبتر كهربائية صغيرة وطائرة بوينغ تابعة لشركة يونايتد في مطار، تعكس تطور تكنولوجيا الطيران وجهود FAA لتحسين إدارة حركة الجو بالذكاء الاصطناعي.

نظام إدارة المسارات الجوية الجديد: استثمار بـ 875 مليون دولار في الذكاء الاصطناعي

تعاني هيئة الطيران الفيدرالية الأمريكية نقصاً حاداً في مراقبي حركة الجو، وتراهن على برنامج ذكاء اصطناعي متطور لتحديث إدارة الرحلات وضمان السلامة. اكتشف كيف سيغير SMART مستقبل الطيران. اقرأ المزيد الآن!
تكنولوجيا
Loading...
رسم كاريكاتوري يُظهر مبدع المحتوى يستخدم رافعة لرفع صناعة التكنولوجيا، مشيراً إلى أهمية المحتوى في دعم تقنيات الذكاء الاصطناعي.

مسؤول في Microsoft يصف كشط بيانات الذكاء الاصطناعي بـ "أكبر سرقة عمل في التاريخ"

وثائق سرية تكشف أن Microsoft وOpenAI استخدمتا محتوى صحفي دون إذن، مهددة مستقبل الإعلام وحقوق النشر. اكتشف التفاصيل الصادمة وتأثير الذكاء الاصطناعي على الصحافة الآن!
تكنولوجيا
Loading...
شعار مكتوب عليه "AI-GENERATED" باللون الأحمر يدل على نص مولّد بواسطة الذكاء الاصطناعي، مرتبط بتقنية العلامات المائية في نماذج الذكاء الاصطناعي.

نماذج اللغة الكبرى تتجنب الإجابات الضارة عند استخدام العلامات المائية الرقمية

تكنولوجيا العلامات المائية SynthID-Text تعد خطوة نحو شفافية الذكاء الاصطناعي، لكن بحثاً جديداً يكشف تأثيرها على سلوك النماذج وقدرتها على قبول طلبات ضارة. اكتشف المزيد الآن!
تكنولوجيا
Loading...
غرفة معيشة بسيطة مع أريكة وطاولة صغيرة ونباتات، تظهر واجهة أداة Restyle لتعديل أثاث الغرف بالذكاء الاصطناعي من Pinterest.

Pinterest تطلق ميزة "إعادة التصميم" لتجديد غرفتك بالذكاء الاصطناعي

اكتشف كيف تتيح لك أداة Restyle الجديدة من Pinterest تعديل صور غرفتك باستخدام الذكاء الاصطناعي لتجربة ديكور فريدة قبل الشراء. جرب الآن وغيّر منزلك بأسلوبك الخاص!
تكنولوجيا
الرئيسيةأخبارسياسةأعمالرياضةالعالمعلومصحةتسلية