أحدث الأخبار

قضية نيويورك تايمز تكشف أزمة محتوى تهدد مستقبل الذكاء الاصطناعي

صفحة فيسبوك
تابع الآن
إكس (تويتر)
تابع على X
ثريدز
تابع الآن
قناة واتساب
انضم الآن


 كشفت وثائق جديدة مرتبطة بالقضية التي رفعتها صحيفة نيويورك تايمز ضد شركة OpenAI عن مخاوف داخلية لدى إدارة الشركة وشريكتها مايكروسوفت بشأن استخدام المحتوى الإخباري في تدريب نماذج الذكاء الاصطناعي، وما قد يترتب على ذلك من آثار تمتد إلى مستقبل صناعة المحتوى نفسها.

وأتاحت المحكمة الفدرالية للدائرة الجنوبية في نيويورك عددًا من المستندات التي كانت سرية في السابق ضمن الدعوى التي رفعتها الصحيفة في ديسمبر 2023، وذلك مع اقتراب بدء المحاكمة والبت في القضية.

وتشير الوثائق إلى أن موظفين في مايكروسوفت عبّروا عن مخاوفهم من أن OpenAI قد تكون بصدد تنفيذ ما وصفوه بأنه أكبر عملية سرقة للعمالة في التاريخ، محذرين من احتمال دخول الشركة في دورة سلبية تؤدي في نهاية المطاف إلى تراجع جودة المحتوى والمواد التي تعتمد عليها نماذج الذكاء الاصطناعي في التدريب.

وكشفت المستندات كذلك عن وجود مخاوف داخل OpenAI نفسها من التأثير الذي يمكن أن تحدثه أداة ChatGPT على صناعة الأخبار، إذ كانت إدارة الشركة تخشى أن يؤدي انتشار الأداة إلى ابتعاد المستخدمين عن قراءة الصحف والمواقع الإخبارية، وهو ما ورد في مذكرة داخلية تعود إلى يونيو 2023.

وفي يناير 2024، أشار برينت هيشت، رئيس قطاع العلوم التطبيقية في مايكروسوفت، خلال عرض تقديمي داخلي إلى أن أداة الذكاء الاصطناعي Copilot تسببت في انخفاض زيارات موقع نيويورك تايمز بنحو 93 بالمئة، وفق تقرير منفصل نشره موقع TechCrunch.

وقال هيشت إن من النادر أن يظهر منتج يتسبب في الإضرار بسلسلة الإمداد الخاصة به، لكنه رأى أن هذا هو الوضع الذي أوجدته نماذج الذكاء الاصطناعي، في إشارة إلى اعتماد هذه النماذج على المحتوى الذي تنتجه المؤسسات الإعلامية في الوقت الذي قد تؤثر فيه أدوات الذكاء الاصطناعي على زيارات تلك المؤسسات.

لكن مايكروسوفت أوضحت أن هذه المواقف لا تمثل موقف الشركة الرسمي، وقال المتحدث باسمها أليكس هوريك إن العرض التقديمي والمذكرات الداخلية التي كتبها هيشت لا تعكسان وجهة نظر مايكروسوفت، مؤكدًا أن موقف الشركة الرسمي موجود ضمن سجلات المحكمة.

وفي المقابل، اتخذ الرئيس التنفيذي لمايكروسوفت ساتيا ناديلا موقفًا مختلفًا بشكل مباشر، إذ أوضح خلال شهادة أدلى بها في جلسة استماع مطلع هذا العام أن تدريب نماذج الذكاء الاصطناعي على محتوى حصري يتطلب اشتراكًا مدفوعًا يحتاج إلى الحصول على ترخيص خاص.

وأضاف ناديلا أنه لو كان يعلم أن OpenAI استخدمت هذا النوع من المحتوى في تدريب نماذجها، لطلب إعادة تدريب النماذج من دونه، استنادًا إلى عقود الشراكة القائمة بين الشركتين.

ولا تتوقف المشكلة عند الخلاف حول استخدام المحتوى، إذ تكشف الوثائق عن مخاوف أوسع تتعلق بالتأثير الاقتصادي للذكاء الاصطناعي على المؤسسات الإعلامية، حيث يرى هيشت أن أدوات الذكاء الاصطناعي قد تضر بالنموذج الاقتصادي الذي تعتمد عليه نسبة كبيرة من الصحف والمواقع حول العالم.

وتسمح أدوات الذكاء الاصطناعي للمستخدم بالوصول إلى المعلومات بسرعة ودون الحاجة دائمًا إلى زيارة الموقع الذي نشر المحتوى الأصلي، وهو ما قد يؤثر في المؤسسات التي تعتمد على الاشتراكات المدفوعة، وكذلك المواقع التي تعتمد على الإعلانات كمصدر للإيرادات.

ومع تراجع الزيارات والإيرادات، قد تواجه بعض المؤسسات الإعلامية صعوبة أكبر في الاستمرار وإنتاج محتوى جديد عالي الجودة، وهنا تظهر المفارقة، فالذكاء الاصطناعي يحتاج إلى محتوى جيد لتدريب نماذجه، بينما يمكن أن تؤدي أدواته نفسها إلى إضعاف الجهات التي تنتج هذا المحتوى.

وكشفت مستندات المحكمة أيضًا عن اعتماد مطوري OpenAI على طريقة لتجاوز الاشتراكات المدفوعة في موقع نيويورك تايمز، حيث عرض الباحث في الشركة نيك رايدر هذه الطريقة على رئيسها غريغ بروكمان، الذي رد عليها بإعجاب.

وتشير الوثائق كذلك إلى أن موظفي الشركة طوروا أدوات خاصة لجلب المحتوى وملخصات الأخبار والمقالات المنشورة في نيويورك تايمز واستخدامها مباشرة في تدريب النماذج، بعد إزالة التحذيرات المرتبطة بحقوق الملكية من هذا المحتوى.

وتبرز هنا مشكلة أخرى تتعلق بمستقبل بيانات تدريب الذكاء الاصطناعي، إذ تعتمد قوة النماذج بشكل كبير على جودة البيانات التي تتدرب عليها، وكلما كانت البيانات أكثر جودة، زادت قدرة النماذج على تقديم نتائج أفضل.

ولهذا يخشى خبراء الذكاء الاصطناعي من أن يؤدي تراجع المحتوى عالي الجودة على الإنترنت إلى أزمة حقيقية في بيانات التدريب مستقبلًا، وهو ما دفع بعض الشركات إلى البحث عن مصادر أخرى، بما في ذلك الكتب والنصوص النادرة لاستخدامها في تطوير نماذجها.

كما تحاول بعض الشركات التعامل مع المشكلة من خلال تقطير النماذج الموجودة بالفعل والاستفادة من بياناتها في تدريب نماذج جديدة، إلا أن هذا الحل تبدو فائدته محدودة أمام الحاجة المستمرة إلى مصادر جديدة وعالية الجودة.

وبينما تستمر المعركة القانونية بين شركات الذكاء الاصطناعي وصناع المحتوى، سواء كانوا مؤسسات إعلامية مثل نيويورك تايمز أو مؤلفين وكتابًا في قضايا أخرى مرتبطة بشركات مثل Anthropic وPerplexity، تكشف القضية عن مشكلة أوسع تتجاوز حقوق استخدام المحتوى، وهي كيفية الحفاظ على تدفق المحتوى عالي الجودة الذي تعتمد عليه نماذج الذكاء الاصطناعي في الوقت الذي تعيد فيه هذه النماذج تشكيل طريقة وصول الناس إلى المعلومات.

التعليقات

نستخدم ملفات تعريف الارتباط لضمان حصولك على أفضل تجربة.