الخلاصة
- دراسة لـالإيكونوميست قارنت 1.2 مليون كلمة بشرية وآلية عبر 4 نماذج لغوية كبرى.
- النتيجة: علامة الشرطة المائلة الطويلة تراجعت، والسمة الأبرز صارت مفردات لاتينية طويلة وجمل مطوّلة بترقيم قليل.
- الأثر: أدوات كشف النصوص قد تفقد فاعليتها مع اقتراب أسلوب النماذج من الكتابة البشرية.
خبر:
مفردات طويلة ومصطلحات علمية وجمل مطوّلة شبه خالية من الترقيم صارت السمات الأوضح للنصوص التي تولّدها النماذج اللغوية الكبرى، بحسب دراسة أجرتها الإيكونوميست على 55,940 جملة و1.2 مليون كلمة. وخلصت الدراسة إلى أن الشرطة المائلة الطويلة، التي اشتهرت كدليل على الكتابة الآلية، لم تعد مؤشراً موثوقاً بعد التحديثات الأخيرة للنماذج.
تفصيل:
- منهجية الدراسة: طلبت الإيكونوميست من شات جي بي تي وكلود وجيميناي وغروك إعادة كتابة مقالاتها دون تصفّح الإنترنت، انطلاقاً من ملخصات آلية استُخدمت كتوجيه. ولم يوضح النص عدد المقالات المشمولة ولا إصدارات النماذج المستخدمة بالتحديد.
- ضوابط المقارنة: لتفادي التقاط خصائص أسلوب المجلة نفسها، قوبلت النصوص الآلية بمواد صحفية من سي إن إن ونيويورك تايمز وواشنطن بوست، وبمقتطفات من روايات ناجحة نُشرت بين 1950 و2022. ولم تُذكر أسماء الروايات.
- المفردات: وفق الدراسة، تراجع استخدام كلمات مثل التوغّل والنسيج الثري، وحلّت محلها مفردات متعددة المقاطع مثل مهم ومتزايد وتبعات، إضافة إلى مفردات نادرة ومصطلحات علمية مثل معيار ومنهجية، وإلى تحويل الأفعال إلى أسماء. وبرزت هذه السمات لدى جيميناي وكلود خصوصاً.
- الترقيم: بيّنت الدراسة أن كلود وحده يستخدم الشرطة المائلة الطويلة أكثر من الكتّاب البشر، بينما يستخدمها شات جي بي تي أقل من أي كاتب آخر في العيّنة. ولم تحدد الدراسة تاريخ التحديثات التي أحدثت هذا التحول.
- بنية الجملة: تستخدم النماذج فواصل ونقاطاً منقوطة أقل من البشر، وأقواساً شبه غائبة، جزئياً لأنها تكتب جملاً أطول ولا تنقل عن خبراء. وأكثر كلماتها تكراراً هي حرف العطف. ولم يُذكر متوسط طول الجملة بالأرقام.
- الأدوات البلاغية: تلجأ النماذج إلى تراكيب متكررة من نوع ليس هذا بل ذاك، وليس فقط بل أيضاً، وتجميع الأفكار في ثلاثيات. ويسجّل شات جي بي تي وكلود استخداماً أعلى لهذه التراكيب لكل 1000 جملة مقارنة بباقي النماذج وبالبشر.
- أدوات الكشف: تقول شركة بانغرام إن دقتها تبلغ 99.98%، وقد عملت مع منصة التدوين سبستاك على أداة كشف. لكن الإيكونوميست وصفت هذه الأدوات بالصندوق الأسود الذي يعطي نتائج إيجابية خاطئة دون تفسير أسبابه، ولم تنشر بيانات مستقلة تتحقق من نسبة الدقة المعلنة.
- رأي اللغويين: قالت كارولينا رودنيتسكا، اللغوية في جامعة غدانسك، إنه لا يوجد أسلوب واحد للكتابة الآلية كما لا يوجد أسلوب بشري واحد. وأشار تومي يوزيك من جامعة ولاية فلوريدا إلى أن النماذج تتدرب على الكتابة البشرية والتعليقات البشرية فتتبنّى ما يعجب الناس.
- جدل الجوائز: أُثيرت مزاعم بأن نصاً مولّداً بالذكاء الاصطناعي فاز بجائزة الكومنولث للقصة القصيرة هذا العام، ونفت مؤسسة الكومنولث هذه المزاعم. ولم يُعلن عن أي تحقيق مستقل في الواقعة ولا عن اسم النص المعني.
- حجم الظاهرة: بحسب أحد التقديرات الواردة في التقرير، تساهم النماذج اللغوية في صياغة أكثر من ثلث المواقع الإلكترونية الجديدة، وتُستخدم في كتابة مقالات الطلبة وربما الأوراق العلمية. ولم تُسمَّ الجهة التي أنتجت هذا التقدير.
بين السطور:
ترى الدراسة أن كل تحديث يقرّب النصوص الآلية من الكتابة البشرية، ما يجعل السمات المرصودة الآن — المفردات اللاتينية الطويلة وقلة الترقيم — مؤشرات مؤقتة لا قواعد ثابتة. وبما أن أدوات مثل بانغرام تعمل كصندوق أسود دون تفسير نتائجها، فإن تراجع الفوارق الأسلوبية يضعف أساس الكشف نفسه، وفق ما أشار إليه يوزيك من تعلّم النماذج من التغذية البشرية.
ماذا بعد؟
المؤشر الأهم هو التحديثات المقبلة للنماذج الأربعة ومدى بقاء دقة أدوات الكشف مثل بانغرام عندها، إضافة إلى أي بيانات مستقلة تتحقق من نسبة 99.98% المعلنة.