EN

أنثروبيك تعزل المعرفة الخطرة داخل نماذج الذكاء الاصطناعي

Sanaa AL Falasi

1- كشفت أنثروبيك تقنية “GRAM” لعزل المعارف الحساسة في وحدات قابلة للإزالة من النموذج.
2- التقنية تستهدف مجالات مثل علم الفيروسات والأمن السيبراني والفيزياء النووية دون التأثير الكبير على الأداء العام.
3- إذا نجحت على نطاق واسع، فقد تغيّر طريقة إدارة مخاطر الذكاء الاصطناعي بدلاً من تقييد النماذج بالكامل.

أعلنت شركة أنثروبيك، بالتعاون مع AE Studio، تطوير تقنية تدريب جديدة باسم “Gradient-Routed Auxiliary Modules (GRAM)”، تتيح فصل المعارف الحساسة داخل وحدات مستقلة يمكن حذفها أو تفعيلها بحسب الحاجة، مع الحفاظ على أداء النموذج في المهام العامة، بحسب الشركة.

تفصيل:

•⁠ ⁠آلية العمل: توزع التقنية المعرفة الحساسة على وحدات عصبية صغيرة مخصصة لكل مجال، مثل علم الفيروسات أو الأمن السيبراني أو الفيزياء النووية.

•⁠ ⁠عند الإزالة: قالت أنثروبيك إن حذف الوحدة يجعل النموذج يتصرف كما لو أنه لم يتدرب على تلك المعرفة، بينما يعيد تفعيلها القدرات كاملة.

•⁠ ⁠نتائج الاختبار: اختُبرت التقنية على نماذج يتراوح حجمها بين 50 مليون و5 مليارات معامل، وأظهرت إزالة القدرات الحساسة مع بقاء الأداء العام قريباً من المستوى الأساسي، بحسب الشركة.

•⁠ ⁠السياق التنظيمي: رأت أنثروبيك أن GRAM قد توفر بديلاً لفرض قيود على النماذج كاملة، عبر منح صلاحيات وصول مختلفة وفق نوع المستخدم والجهة المستفيدة.

•⁠ ⁠قيود الدراسة: أكد الباحثون أن العمل لا يزال أولياً ولم يُطبَّق بعد على نماذج الإنتاج، كما لم يُثبت بعد نجاحه مع النماذج العملاقة.

ماذا بعد؟

ستتجه الأنظار إلى ما إذا كانت أنثروبيك ستدمج GRAM في نماذجها التجارية، وإلى نتائج مراجعة المجتمع البحثي لقدرة التقنية على العمل مع نماذج الذكاء الاصطناعي المتقدمة.

 

ماذا تقرأ بعد ذلك

واشنطن وطهران تقتربان من حرب أوسع بعد مقتل جنود أمريكيين

الليلة 8 : الحرب نحو منعطف أخطر والسعودية وقطر في قائمة الأهداف