الخلاصة
- OpenAI تطلق تحديثاً يتيح إنشاء مستندات وعروض وجداول عبر أوامر صوتية داخل ChatGPT Work.
- الوضع الصوتي صار يشغّل الإضافات والتطبيقات المتصلة على الويب وآيفون وأندرويد.
- التحديث ينقل الصوت من أداة سؤال وجواب إلى واجهة تحكم بوكيل ذكي.
خبر:
صار بإمكان مستخدم ChatGPT أن يطلب بصوته إنشاء مستند أو عرض تقديمي أو جدول بيانات، وتشغيل تطبيق متصل، ضمن تحديث أطلقته OpenAI لتجربة المحادثات الصوتية. وبحسب سجل إصدارات ChatGPT، وصلت المحادثات الصوتية إلى بيئة Work على الويب والهواتف، ودعمت الإضافات والتطبيقات المتصلة على آيفون وأندرويد.
تفصيل:
- جوهر التحديث: الميزة الأبرز هي دمج المحادثات الصوتية مع ChatGPT Work، وهي بيئة OpenAI المخصصة للمهام الطويلة متعددة الخطوات وإنتاج ملفات ومخرجات نهائية، بدل الاكتفاء بالرد على استفسارات المستخدم داخل الواجهة العامة للتطبيق.
- المهام المدعومة: بحسب الشركة، يستطيع المستخدم أن يطلب صوتياً إنشاء مستند أو عرض تقديمي أو جدول بيانات، أو التعامل مع تطبيق متصل، أو استخدام متصفح سحابي لتنفيذ مهمة على الويب.
- استمرار التنفيذ: إذا أنهى المستخدم المحادثة الصوتية بينما المهمة قيد التنفيذ، يمكن للتطبيق مواصلة العمل عليها في الوضع النصي، ما يسمح ببدء المهمة صوتياً أثناء التنقل واستكمالها لاحقاً من جهاز آخر.
- الإضافات والتطبيقات: أوضحت OpenAI أن المستخدم صار قادراً خلال المحادثة الصوتية على مطالبة ChatGPT باستخدام إضافة متاحة في حسابه، بما في ذلك خدمات البريد الإلكتروني والتقويم ومنصة Slack للتواصل بين فرق العمل.
- ضوابط الصلاحيات: تبقى صلاحيات الوصول والقيود المطبقة على كل تطبيق كما هي، وفق الشركة. أما الإجراءات الحساسة التي تتطلب موافقة المستخدم فتظهر على الشاشة للمراجعة، ولا تكفي الموافقة الصوتية لتنفيذها.
- النماذج المستخدمة: تستفيد تجربة Voice من نماذج عائلة GPT-6 الثلاثة: Astra وSol وLuna. وقدمت OpenAI نموذج Astra في وقت سابق من سبتمبر، قبل أن تضيف في 22 سبتمبر نموذجي Sol وLuna إلى نمطي الاستخدام Work وCodex.
- فارق تقني: تشير وثائق OpenAI إلى تمييز بين نموذج الصوت ونموذج الاستدلال؛ فتجربة Live تعمل بواسطة GPT-Live-1 أو GPT-Live-1 mini بحسب خطة الاشتراك، بينما يمكن لـVoice الاستعانة بنماذج أخرى عند الحاجة إلى البحث أو الاستدلال.
- الصوت والنص معاً: طورت الشركة طريقة عرض نتائج المحادثات الصوتية، بحيث يستمع المستخدم إلى الرد ويتابع محتواه المكتوب داخل المحادثة في الوقت نفسه، مع الانتقال بين الكتابة والتحدث دون بدء محادثة جديدة.
- الاشتراكات: بحسب OpenAI، يستطيع مستخدمو خطتي Free وGo استخدام المحادثات الصوتية مع الإضافات التي تدعمها خططهم، بينما يتطلب الوضع الصوتي داخل Work صلاحية الوصول إلى Voice وWork معاً، أي الاشتراك في باقة Plus أو Pro.
خلفية:
كانت المساعدات الصوتية التقليدية تركز على أوامر محددة وبسيطة. ومع هذا التحديث تحاول OpenAI جعل الصوت نقطة البداية لمهام تتضمن البحث وجمع المعلومات واستخدام أدوات وخدمات مختلفة قبل الوصول إلى النتيجة النهائية.
بين السطور:
يشير ربط الصوت ببيئة Work وبالتطبيقات المتصلة إلى رهان على تحويل التحدث إلى واجهة رئيسية للتعامل مع الوكلاء الأذكياء، خصوصاً على الهواتف. وإبقاء الإجراءات الحساسة رهن موافقة تظهر على الشاشة يظهر حدود هذا الرهان: كلما اتسعت صلاحيات الوكيل، صار التأكيد المرئي شرطاً لا يغني عنه الأمر الصوتي.
ماذا بعد؟
ما يستحق المتابعة: توسيع الوصول إلى الوضع الصوتي داخل Work خارج باقتي Plus وPro، وإضافة نماذج جديدة إلى عائلة GPT-6، واتساع قائمة التطبيقات المتصلة المدعومة داخل المحادثات الصوتية.