EN

مؤسسة أميركية تصنّف نسخة المراهقين من ChatGpt خطراً غير مقبول

Khaled Aziz

الخلاصة

  1. معهد سلامة الذكاء الاصطناعي للشباب صنّف نسخة المراهقين من تشات جي بي تي ضمن خانة الخطر غير المقبول.
  2. المعهد اختبر أكثر من 4000 أمر على حسابات مسجّلة لأعمار بين 13 و17 عاماً.
  3. أوبن إيه آي شكّكت في منهجية الاختبار وطلبت جولة جديدة بحسابات مراهقين مفعّلة بالكامل.

خبر:

ضوابط الحماية في نسخة المراهقين من تشات جي بي تي لا ترقى إلى تعهدات أوبن إيه آي بشأن سلامة الأطفال، وفق ما أعلن معهد سلامة الذكاء الاصطناعي للشباب التابع لمنظمة كومون سينس ميديا. المعهد صنّف المنتج ضمن خانة الخطر غير المقبول، ودعا الشركة إلى حصر استخدام تشات جي بي تي بمن تجاوزوا 18 عاماً إلى حين تحسين تلك الضوابط.

تفصيل:

  • حجم الاختبار: المعهد قال إنه جرّب أكثر من 4000 أمر نصي على حسابات مسجّلة لمستخدمين تتراوح أعمارهم بين 13 و17 عاماً، شملت اختبارات قبل إطلاق نسخة المراهقين في أغسطس/آب وبعده، بهدف قياس ما إذا كانت الحمايات الجديدة غيّرت سلوك النموذج فعلياً.
  • الأرقام الحرجة: في المحادثات المتصلة بالانتحار أو إيذاء النفس أو اضطرابات الأكل، أخفق النموذج في إحالة المستخدم إلى موارد الأزمات في أكثر من حالة من كل 4 حالات، بحسب المعهد. وفي الحسابات المنشأة حديثاً لم يُرسل أي تنبيه إلى أولياء الأمور.
  • ما نجح: المعهد أقرّ بأن بعض الحمايات صمدت في الاختبار، وفي مقدمتها الضوابط المانعة لتمثيل الأدوار ذات الطابع الجنسي، ما يجعل التقييم السلبي منصبّاً على فئات محددة من المحادثات لا على المنتج بكل وظائفه.
  • ثغرات إضافية: بحسب المجموعة، واصل النموذج مخاطبة المستخدم بنبرة الصديق رغم التعليمات بكبح هذا السلوك، وأخفق في تحويل بعض الحسابات التجريبية إلى حمايات ما دون 18 عاماً حتى حين صرّح المختبرون بأن أعمارهم 13 عاماً، كما جرى تجاوز ضوابط الواجبات المدرسية بسهولة.
  • ما وعدت به الشركة: أوبن إيه آي أطلقت نسخة المراهقين في منتصف أغسطس/آب، قائلة إنها تتضمن تدخلات تلقائية في المحادثات الحساسة، ووضع دراسة للواجبات، وحمايات من لغة تولّد اعتماداً عاطفياً، إضافة إلى توقّع أعمار المستخدمين وتحويل القاصرين تلقائياً إلى النسخة المخصصة لهم.
  • رد أوبن إيه آي: متحدث باسم الشركة أكد التزامها بسلامة المراهقين، لكنه شكّك في منهجية المنظمة واعتبر أن الاختبارات لا تعكس الاستخدام الفعلي للمنتج. وقال إن مراجعة الشركة تشير إلى أن معظم الاختبارات ربما بدأت وانتهت قبل اكتمال تفعيل أدوات الرقابة الأبوية.
  • طلب إعادة الاختبار: الشركة قالت إنها تواصلت مع كومون سينس ميديا طالبة جولة اختبارات جديدة بعيّنة أوسع وحسابات مراهقين مفعّلة بالكامل، مؤكدة استعدادها للتحرك إذا ثبتت مصداقية النتائج. ولم تحدد الشركة إطاراً زمنياً لهذه الجولة.
  • رد المعهد: توم سيغل، المدير التنفيذي للمعهد، قال إن مجموعته تتمسك بمنهجيتها ونتائجها، وإنها شاركت نتائج التقييم مع أوبن إيه آي قبل النشر بحسن نية. وأضاف أن “سلامة الأطفال تتطلب تقييمات مستقلة صارمة”، داعياً الشركة إلى مناقشة المضمون بدل التشكيك في المنهجية.
  • تحديثات موازية: أوبن إيه آي أعلنت في اليوم نفسه حزمة تحديثات لنسخة المراهقين، تشمل أداة مقبلة لمسار التقديم الجامعي باسم College Planner وميزات دراسية جديدة، إضافة إلى شراكة مدتها 3 سنوات مع مختبر الصحة الرقمية في مستشفى بوسطن للأطفال لدعم مشاريع طلابية حول الذكاء الاصطناعي.

خلفية:

كومون سينس ميديا منظمة غير ربحية تقيّم المحتوى والمنتجات الرقمية الموجهة للأطفال، وأنشأت معهد سلامة الذكاء الاصطناعي للشباب لاختبار النماذج التوليدية. نيوز كورب، مالكة وول ستريت جورنال، ترتبط باتفاق ترخيص محتوى مع أوبن إيه آي.

بين السطور:

الخلاف لا يدور على وقائع السلوك بقدر ما يدور على توقيت القياس: الشركة تربط غياب تنبيهات أولياء الأمور بعدم اكتمال تفعيل الرقابة الأبوية وقت الاختبار، والمعهد يرد بأن نتائجه سُلّمت مسبقاً وأن النقاش يجب أن يتناول المضمون. النتيجة أن أهم رقم في التقييم، وهو صفر تنبيهات للحسابات الجديدة، يبقى موضع تنازع تفسيري بين الطرفين.

ماذا بعد؟

المؤشر الأقرب هو ما إذا كانت كومون سينس ميديا ستقبل إجراء جولة اختبارات ثانية بعيّنة أوسع وحسابات مفعّلة، وما إذا كانت أوبن إيه آي ستعدّل ضوابط الإحالة إلى موارد الأزمات أو تنبيهات أولياء الأمور.

ماذا تقرأ بعد ذلك