ما الذي تغيّر
وفقًا لتقرير نشرته ذا فيرج، يطالب عالم الرياضيات أندرياس توم بأدلة تثبت أن محادثاته مع ChatGPT لم تدخل في بيانات تدريب OpenAI ولم تؤثر في عملها بشأن المجموعات غير السوفيقية. وأقرت OpenAI بأن النتيجة اعتمدت بدرجة كبيرة على عمل توم وغابور كون، ثم عدّلت بهدوء صياغة عرضها بعد تعرضها للانتقاد؛ ويأتي هذا النزاع عقب تحدٍّ سابق من عالم الرياضيات تريستان باكماستر.
لماذا يهم هذا الأمر
لا يقتصر السؤال المهم على ما إذا كانت OpenAI قد نسخت برهانًا. بل يتعلق أيضًا بما إذا كان بوسع الباحثين مناقشة أعمال غير مكتملة بأمان مع نظام للذكاء الاصطناعي، في وقت لا يستطيعون فيه معرفة ما يحدث لتلك المحادثات لاحقًا.
يقول توم إن OpenAI أجابت عن سؤال أضيق نطاقًا، وهو ما إذا كان الباحثون قد وصلوا مباشرة إلى محادثاته. لكن ذلك لا يحسم ما إذا كانت تلك التفاعلات قد دخلت في بيانات التدريب أو أثرت في طريقة استدلال النظام. وقد قالت OpenAI سابقًا إن أي بيانات مستخدمين محددة لم يُطّلع عليها قبل صدور نتيجتها بشأن معادلات نافيييه, ستوكس، لكن هذا التصريح لا يعالج القلق الأوسع الذي أثاره توم.
وينشأ عن ذلك اختلال واضح. فقد يمتلك الباحثون الأفكار غير المنشورة، بينما تمتلك OpenAI السجلات ومجموعات البيانات والإعدادات التقنية اللازمة لإثبات ما حدث. وإذا استمر هذا الغموض، فقد يتوقف علماء الرياضيات عن إدخال أعمالهم الجارية في ChatGPT. وقد تشدد الجامعات ومجموعات البحث أيضًا قواعدها المتعلقة بالبحوث السرية، فتتخلى عن بعض المساعدة التي يوفرها الذكاء الاصطناعي مقابل سيطرة أوضح على الأفكار غير المنشورة.
ويمتد الأثر إلى ما هو أبعد من هذا النزاع. فالنتائج الرياضية التي يولدها الذكاء الاصطناعي في المستقبل ستحتاج إلى أكثر من إجابة مثيرة للإعجاب وإعلان مصقول. وسيصبح إسناد الفضل وقابلية إعادة الإنتاج ومصدر البيانات جزءًا من النتيجة نفسها. وهذا يرفع عبء الإثبات الواقع على OpenAI، ويمنح ميزة للمنافسين القادرين على توفير حدود أوضح للتفاعلات البحثية.
تقييم الأثر
بالنسبة إلى علماء الرياضيات المستقلين، يتمثل الخطر المباشر في مسألة عملية: فقد تنطوي مشاركة تقنية واعدة مع نظام للذكاء الاصطناعي على احتمال غير واضح لإعادة استخدامها لاحقًا. وإذا لم تتمكن OpenAI من توضيح مسارات البيانات ذات الصلة، فقد يحجم الباحثون عن مشاركة الأساليب غير المنشورة، مما يقلل المدخلات المتخصصة المتاحة لأنظمتها خلال الأسابيع والأشهر المقبلة.
أما بالنسبة إلى OpenAI، فالكلفة تتمثل في المصداقية. إذ إن التحدي العلني الثاني، إلى جانب تعديل العرض الخاص بالمجموعات غير السوفيقية، يجعلان التطمينات المبهمة أقل فائدة. وقد تتطلب الإعلانات المستقبلية إسنادًا أكثر اكتمالًا وتفاصيل عن المصدر التقني قبل أن يقتنع الباحثون بالادعاءات.
وتواجه المؤسسات الأكاديمية مفاضلة خلال فترة تمتد من ستة إلى 12 شهرًا. فقد تضع قيودًا رسمية على إدخال البحوث السرية في أدوات الذكاء الاصطناعي التجارية، فتحمي الأعمال غير المنشورة لكنها تحد من الوصول إلى المساعدة المفيدة. ويمكن قطع هذه السلسلة إذا قدمت OpenAI أدلة قابلة للتحقق بصورة مستقلة، تعالج كلاً من الوصول المباشر إلى النظام والاستخدام الأوسع لبيانات التدريب.
السيناريوهات
الأرجح
توقعاتنا (استنتاج مبني على مؤشرات): ستواجه OpenAI مطالب مستمرة بتفسير مصدر البيانات، بينما سيصبح علماء الرياضيات أكثر حذرًا في مشاركة الأعمال غير المنشورة عبر ChatGPT خلال الأشهر المقبلة. ويكون هذا السيناريو هو الأرجح إذا واصلت OpenAI معالجة محادثات بعينها من دون شرح مسارات بيانات التدريب الأوسع، وإذا أثار مزيد من الباحثين مخاوف مماثلة.
وسيتمثل التغيير العملي في ارتفاع عبء التحقق المحيط بكل إعلان رياضي كبير. وستحتاج العروض المستقبلية إلى إسناد أوضح وأدلة بشأن حدود الأنظمة المعنية.
السيناريو الإيجابي
إذا نشرت OpenAI وثائق قابلة للتدقيق تغطي استخدام بيانات التدريب والوصول إلى الأنظمة والمساهمات الرياضية السابقة، فقد يستأنف الباحثون الاستخدام الاستكشافي لأدواتها ضمن حدود أوضح. كما أن الإسناد المتسق للأعمال التي أنجزها رياضيون مثل توم وكون سيجعل تقييم النتائج المستقبلية أسهل.
ويتوقف هذا المسار على أدلة تحسم حالة عدم اليقين المركزية، لا على تطمين عام آخر بشأن الوصول المباشر إلى محادثات محددة.
السيناريو السلبي
إذا أبلغ علماء رياضيات إضافيون عن تجارب مماثلة، وظلت OpenAI عاجزة عن شرح كيفية التعامل مع التفاعلات غير المنشورة، فقد يسحب الباحثون والمؤسسات مزيدًا من الأعمال الرياضية غير المكتملة من أنظمتها خلال فترة تمتد من ستة إلى 12 شهرًا.
وسيؤدي ذلك إلى تقليص مجموعة التفاعلات المتخصصة المتاحة لـ OpenAI، مع زيادة التدقيق والكلفة المرتبطة بسمعتها فيما يخص ادعاءاتها الرياضية. وسيكون إصدار الجامعات أو مجموعات البحث قيودًا رسمية علامة على انتقال النزاع من خلاف حول إسناد الفضل إلى مسألة تتعلق بسياسة البحث.
ما الذي ينبغي مراقبته لاحقًا
- ما إذا كانت OpenAI ستنشر شرحًا تقنيًا يوضح ما إذا كان يمكن أن تدخل تفاعلات المستخدمين في بيانات التدريب أو تؤثر في أنظمة الاستدلال.
- ما إذا كان عالم رياضيات آخر سيحدد تفاعلًا أو تقنية أو مسألة إسناد محددة مرتبطة بنتيجة أعلنتها OpenAI.
- ما إذا كان الإعلان الرياضي الكبير المقبل من OpenAI سيتضمن تفاصيل عن الإسناد وإفصاحات عن مصدر البيانات.
التعليقات
لا توجد تعليقات بعد.