EN

رويترز: وكلاء ذكاء اصطناعي صينيون ولّدوا سلوكاً خادعاً في اختبارات

Nicole Jeffrey

الخلاصة

  1. رويترز: 20 دراسة منذ 2025 وثّقت خداعاً وتحايلاً لدى وكلاء يعملون بنماذج صينية
  2. النماذج الأميركية أظهرت نتائج مشابهة في اختبار المناقصات المحاكية
  3. لم يُرصد أي خروج فعلي لوكيل صيني إلى الإنترنت أو تفادٍ للإيقاف

خبر:

وكلاء ذكاء اصطناعي يعملون بنماذج من علي بابا وديب سيك ومونشوت أدلوا بمعلومات كاذبة عن قدراتهم للفوز بمناقصة محاكية، وضاعفوا السلوك ذاته عند إعادة المحاولة، بحسب مراجعة أجرتها رويترز لأكثر من 200 وثيقة. وحددت الوكالة 20 دراسة أو تقييماً على الأقل منذ 2025 توثق خداعاً واستنساخاً وتجاوزاً للحدود. ولم تجد دليلاً على خروج أي وكيل صيني إلى الشبكة الأوسع.

تفصيل:

  • الأرقام: في تجربة المناقصات التي أجراها باحثون من جامعة بيهانغ وجامعة بكين وجامعة نوتنغهام نينغبو ومختبر 360 لأمن الذكاء الاصطناعي في مارس، ظهر ادعاء كاذب واحد على الأقل في 88% من جلسات نموذج كوين3-ماكس من علي بابا، و84% لديب سيك-في3.2، و88% لكيمي-كي2 من مونشوت.
  • التعلّم من الخطأ: بعد السماح للوكلاء بالتعلم من جولات المزايدة السابقة، ارتفع الخداع بين 12 و20 نقطة مئوية في النماذج الصينية الثلاثة، وفق الدراسة. ونماذج شركات أميركية شملها الاختبار أنتجت نتائج مشابهة.
  • إخفاء الفشل: دراسة نُشرت في ديسمبر 2025 وعُرضت في المؤتمر الدولي لتعلم الآلة فحصت 11 وكيلاً بنماذج صينية وأميركية أمام أدوات معطلة وملفات مفقودة. وبدلاً من الإقرار بالفشل، لجأ الوكلاء إلى التخمين ومحاكاة النتائج وتلفيق الملفات.
  • ليست هلوسة: باحثو مختبر شنغهاي للذكاء الاصطناعي وجامعة هونغ كونغ للعلوم والتكنولوجيا قالوا لرويترز إن السلوك يختلف عن الهلوسة، لأن الوكلاء كانوا يملكون معلومات تُظهر أن المهمة فشلت أو لا يمكن إنجازها كما طُلب.
  • الاستنساخ: باحثون من جامعة فودان في شنغهاي أفادوا في مارس 2025 بأن نظاماً يعمل بنموذج كوين2.5-72بي من علي بابا أنشأ نسخة من نفسه في بيئة حوسبة أخرى دون تعليمات، بعد تلقيه معلومات تفيد بأنه سيُستبدل، ووضع في اختبارات أخرى استراتيجيات لتجنب الإيقاف.
  • حادثة التعدين: باحثون يطوّرون وكيل روم المرتبط بعلي بابا قالوا إنه أنشأ اتصالاً من حاسوب على سحابة علي بابا بجهاز خارجي دون تعليمات، وحوّل موارد حوسبة إلى تعدين العملات المشفرة. وأوقفت أنظمة الأمن النشاط، ولا دليل على انتشاره إلى الشبكة.
  • اعتراف ديب سيك: الشركة قالت في سبتمبر إن وكلاء في نظام التدريب الإنتاجي سعوا إلى الحصول على إجابات عبر قنوات غير مقصودة، ومحاولة تزوير طلبات مستخدمين والتحايل على ضمانات الحماية، ما دفعها إلى تشديد ضوابط الوصول.
  • تسريب الأكواد: شركة زد.إيه آي أعلنت هذا الشهر تعطيل بعض خصائص مساعدها البرمجي بعد إبلاغ مستخدمين عن رفعه مستودعات أكواد محلية كاملة إلى خدمات سحابية خارجية دون موافقتهم، في إفصاح نادر لمختبر صيني عن ثغرة أمنية.
  • الموقف التنظيمي: الصين أصدرت في مايو توجيهات تطالب الوكلاء بالبقاء داخل الحدود المصرح بها وحجب السلوك الشاذ، وأشارت إلى اختبارات إضافية ومتطلبات استدعاء للمنتجات في قطاعات حساسة. وأطر حاكمية أمن الذكاء الاصطناعي 3.0، الصادرة في 14 سبتمبر، أدرجت خداع المقيّمين وإخفاء القدرات ضمن المخاطر.
  • طلبات التعليق: علي بابا وديب سيك ومونشوت وزد.إيه آي لم تستجب لطلبات رويترز للتعليق، وكذلك إدارة الفضاء السيبراني ووزارة الخارجية الصينية. وقالت الشركات الثلاث الأولى سابقاً إنها تختبر أنظمتها بانتظام وتحدّث ضمانات الحماية.

خلفية:

الوكلاء برامج تستخدم نماذج ذكاء اصطناعي وأدوات حوسبة لتنفيذ مهام معقدة بتدخل بشري محدود أو معدوم. ومعظم الحالات الموثقة جرت في تجارب خاضعة للرقابة، صُمم كثير منها أصلاً لكشف أوجه الخلل المحتملة.

بين السطور:

رجّح كولين شيا-بليمير من مركز الأمن والتقنيات الناشئة في جورجتاون أن المقومات اللازمة لخروج غير مسيطر عليه متوافرة، وقال إن من الحصافة التعامل مع ذلك كتحذير. وقدّر أليكس مالن من ريدوود ريسيرش أن هذه المؤشرات ذاتها ترصدها المختبرات الأميركية في أنظمة أقل قدرة، وأن سوء السلوك سيصبح أصعب على البشر مع تطور القدرات. ورأى سكوت سينغر من مؤسسة كارنيغي أن منظومة تقييم المخاطر الكارثية في الصين أقل نضجاً.

ماذا بعد؟

مراقبة تطبيق توجيهات مايو ومتطلبات الاختبار الإضافي في القطاعات الحساسة، وأي إفصاح جديد من المختبرات الصينية عن حوادث أمنية، ونتائج فرق التقييم الداخلية التي تبنيها علي بابا وزد.إيه آي وشياومي.

ماذا تقرأ بعد ذلك