تشات جي بي تي
تشات جي بي تي يضيف ميزات صوتية جديدة لتنفيذ المهام تلقائيًا أعلنت شركة OpenAI عن إطلاق مجموعة جديدة من الميزات الصوتية ذات الطابع الوكيلي داخل تطبيق تشات جي بي تي على الهواتف، في خطوة توسع نطاق استخدام الأوامر الصوتية من مجرد إجراء محادثات والحصول على إجابات إلى توجيه الذكاء الاصطناعي لتنفيذ مهام متعددة الخطوات.

وتتيح المزايا الجديدة للمستخدم التحدث إلى تشات جي بي تي وطلب تنفيذ أعمال عملية، مثل إنشاء المستندات والعروض التقديمية، أو العمل مع التطبيقات المتصلة، أو استخدام المتصفح السحابي، بدلًا من الاكتفاء بطرح الأسئلة وانتظار الرد.
وتأتي هذه الخطوة ضمن توجه OpenAI لتحويل تشات جي بي تي من مساعد يعتمد بصورة أساسية على المحادثة إلى أداة قادرة على تنفيذ سير عمل كامل نيابة عن المستخدم. وتؤكد الشركة أن ميزة Voice أصبحت متاحة داخل Work على الويب والهواتف، ما يسمح للمستخدم ببدء المهمة صوتيًا ومتابعة تنفيذها من خلال واجهة العمل.
وسيتمكن المستخدمون الذين لديهم إمكانية الوصول إلى Work من استخدام الأوامر الصوتية لطلب إنشاء مستند أو عرض تقديمي أو جدول بيانات، إلى جانب الاستفادة من التطبيقات المتصلة والقدرات التي يوفرها المتصفح داخل Work.
وتدعم الميزة أيضًا استمرار المهمة بعد انتهاء المحادثة الصوتية، إذ يمكن أن تنتقل المهمة غير المكتملة إلى وضع النص حتى يواصل تشات جي بي تي تنفيذها أو عرض نتائجها للمستخدم.
وبحسب تقرير نشره موقع TechCrunch، فإن إطلاق هذه القدرات على الهواتف يمثل توسعًا للوظائف التي سبق أن وصلت إلى تطبيقات سطح المكتب، ويمنح المستخدمين طريقة أكثر مرونة للتحكم في مهام الذكاء الاصطناعي أثناء التنقل.
تجربة صوتية أكثر تكاملًا
تسعى OpenAI من خلال التحديث الجديد إلى جعل المحادثة الصوتية أكثر ارتباطًا بالمهام التي ينفذها تشات جي بي تي، بحيث لا تكون المحادثة مجرد وسيلة للتواصل مع النموذج، وإنما تصبح وسيلة لإعطائه التعليمات ومتابعة سير العمل.
وتوفر المحادثات الصوتية مخرجات نصية أكثر ثراءً، بينما يستطيع مستخدمو الخطط التي تدعم المزايا المناسبة الانتقال بين التفاعل الصوتي والنصي بصورة أكثر سلاسة. وهذا يعني أن المستخدم يمكنه بدء مهمة أثناء وجوده خارج المنزل باستخدام صوته، ثم العودة إليها لاحقًا من خلال النص أو جهاز آخر.
وتكتسب هذه الإمكانية أهمية خاصة في المهام التي تحتاج إلى أكثر من خطوة. فعلى سبيل المثال، بدل كتابة تعليمات تفصيلية لإنشاء مستند أو إعداد عرض تقديمي، يستطيع المستخدم شرح المطلوب شفهيًا، ثم يترك لتشات جي بي تي مهمة تنظيم الخطوات وتنفيذها ضمن الأدوات المتاحة له.
وتوضح OpenAI أن Voice في Work متاح على الويب والهواتف، بينما تعتمد إمكانية استخدامه على الخطة التي يمتلكها المستخدم وإمكانية الوصول إلى Work. كما تنطبق على التطبيقات المتصلة الأذونات والقيود نفسها الموجودة عند استخدامها بطرق أخرى.
وتأتي هذه القدرات في وقت يتزايد فيه الاعتماد على الصوت باعتباره وسيلة طبيعية للتفاعل مع مساعدي الذكاء الاصطناعي. فبدل التوقف لكتابة تعليمات طويلة على شاشة الهاتف، يستطيع المستخدم شرح طلبه بصوته، وهو ما قد يكون أكثر ملاءمة أثناء التنقل أو عند التعامل مع مهام تحتاج إلى تعليمات متتابعة.
كما تواصل OpenAI تطوير تجربة Voice نفسها، حيث يمكن لتشات جي بي تي استخدام النماذج المتاحة في Voice عندما يحتاج إلى البحث أو التعامل مع أسئلة تتطلب قدرًا أكبر من الاستدلال، مع اختلاف النماذج وحدود الاستخدام بحسب الخطة.
وتسمح تجربة Voice أيضًا باستخدام النص والصور ضمن المحادثة نفسها، بحيث لا يضطر المستخدم إلى إنهاء المحادثة الصوتية للانتقال إلى طريقة أخرى من التفاعل.
امتداد لقدرات الوكلاء إلى الهواتف
تمثل إضافة Voice إلى Work على الهواتف امتدادًا لقدرات الوكلاء التي بدأت OpenAI في تقديمها على أجهزة الكمبيوتر. وكانت الشركة قد أضافت في وقت سابق إمكانية استخدام الصوت للتحكم في مهام داخل Work وCodex على سطح المكتب، بما يسمح للمستخدم بإعطاء تعليمات متعددة الخطوات ومتابعة تنفيذها.
ومع وصول التجربة إلى الهواتف، يصبح تنفيذ المهام أقل ارتباطًا بجهاز الكمبيوتر. ويمكن للمستخدم بدء المهمة أثناء وجوده خارج المنزل، ثم العودة إليها لاحقًا من الهاتف أو الكمبيوتر وفقًا لطبيعة العمل وإمكانات الحساب.
وتوضح OpenAI أن Work مصمم للتعامل مع المهام الطويلة والأكثر تعقيدًا، إذ يستطيع البحث وتحليل المعلومات والعمل عبر التطبيقات والملفات المتصلة وإنشاء مستندات وجداول بيانات وعروض تقديمية وتقارير ومواقع.
وتزداد أهمية هذا النوع من الوظائف مع توسع استخدام الذكاء الاصطناعي الوكيلي، حيث ينتقل التركيز من إنتاج إجابة واحدة إلى تنفيذ مجموعة من الخطوات للوصول إلى نتيجة نهائية.
فعلى سبيل المثال، يمكن أن يبدأ المستخدم بطلب إنشاء مستند، ثم يطلب تعديل محتواه، وبعد ذلك تحويل المعلومات إلى عرض تقديمي أو تنظيم البيانات داخل جدول، وذلك من خلال توجيهات متتابعة بدل تنفيذ كل خطوة يدويًا.
كما يمكن لتشات جي بي تي Work الاستفادة من التطبيقات المتصلة وفق الأذونات التي يمنحها المستخدم، ما يفتح المجال أمام تنفيذ مهام تعتمد على المعلومات الموجودة في خدمات أخرى. وتظل الصلاحيات وإمكانية تنفيذ الإجراءات مرتبطة بإعدادات الحساب والتطبيق المتصل.
وتشير هذه التطورات إلى أن OpenAI تعمل على جعل الهاتف واجهة للوصول إلى وكلاء الذكاء الاصطناعي بدل أن يكون مجرد شاشة لعرض إجابات تشات جي بي تي. فالمستخدم يستطيع التحدث إلى النظام، تحديد الهدف، ثم ترك مجموعة من خطوات التنفيذ للنظام وفق الأدوات والصلاحيات المتاحة.
وتأتي هذه الخطوة أيضًا في ظل منافسة قوية في سوق وكلاء الذكاء الاصطناعي. فقد عملت شركات أخرى على تطوير مساعدين قادرين على تنفيذ المهام عبر التطبيقات، مع التركيز على الانتقال السلس بين الهاتف والكمبيوتر.
وبالنسبة إلى OpenAI، فإن الجمع بين Voice وWork يمثل محاولة لربط التفاعل الطبيعي بالصوت مع القدرة على تنفيذ الأعمال المعقدة. فالصوت يوفر طريقة سهلة لإعطاء التعليمات، بينما توفر Work البيئة اللازمة لتنفيذ المهمة ومتابعة نتائجها.
ومع ذلك، فإن الاستفادة من هذه القدرات تعتمد على الصلاحيات التي يمنحها المستخدم للتطبيقات المتصلة، وعلى الأدوات التي يدعمها الحساب والخطة المستخدمة. كما أن بعض الإجراءات قد تتطلب مراجعة المستخدم أو موافقته قبل تنفيذها، خصوصًا عندما تتعلق بإجراءات حساسة أو تغييرات مهمة في الخدمات المتصلة.
وتكشف هذه الخطوة عن اتجاه واضح نحو جعل المحادثة الصوتية جزءًا من دورة العمل نفسها، وليس مجرد وسيلة للحصول على إجابات سريعة. فبدل أن يسأل المستخدم تشات جي بي تي عن كيفية إعداد مستند أو عرض تقديمي، يستطيع أن يطلب منه تنفيذ المهمة مباشرة ضمن البيئة التي توفرها Work.
وبذلك يصبح الهاتف وسيلة للتحكم في مجموعة من المهام الرقمية باستخدام الصوت، بينما يتولى الذكاء الاصطناعي تنظيم الخطوات وتنفيذها وفق الإمكانات المتاحة.
ومن المتوقع أن يستمر هذا الاتجاه مع تطور النماذج الوكيلة وزيادة قدرتها على استخدام التطبيقات والمتصفحات والملفات. وتراهن OpenAI على أن الجمع بين المحادثة الصوتية والقدرات الوكيلة يمكن أن يجعل تشات جي بي تي أكثر فائدة في الأعمال اليومية، خصوصًا للمستخدمين الذين يحتاجون إلى إنجاز مهام متعددة دون الانتقال يدويًا بين عدد كبير من التطبيقات.
- أطلقت OpenAI ميزات صوتية وكيلية جديدة داخل تشات جي بي تي على الهواتف
- تسمح المزايا الجديدة باستخدام الصوت لإعطاء تعليمات لتنفيذ مهام متعددة الخطوات
- يمكن استخدام Voice داخل Work على الويب والهواتف
- يمكن للمستخدم طلب إنشاء مستندات وعروض تقديمية وجداول بيانات باستخدام الأوامر الصوتية
- تدعم Work إمكانية استخدام التطبيقات المتصلة وفق الصلاحيات الممنوحة للحساب
- يمكن استخدام المتصفح ضمن Work لتنفيذ مهام رقمية مختلفة
- يمكن أن تستمر المهمة غير المكتملة بعد انتهاء المحادثة الصوتية باستخدام التفاعل النصي
- أصبحت المحادثات الصوتية تقدم مخرجات نصية أكثر ثراءً
- يمكن للمستخدمين الانتقال بين الصوت والنص أثناء العمل وفق المزايا المتاحة لخطة الحساب
- كانت قدرات التحكم الصوتي في المهام قد وصلت سابقًا إلى تطبيقات سطح المكتب
- يمثل إطلاقها على الهواتف توسعًا لقدرات وكلاء الذكاء الاصطناعي في تشات جي بي تي
- تتيح Work التعامل مع مهام طويلة ومعقدة بدل الاكتفاء بالإجابة عن الأسئلة
- تختلف المزايا وحدود الاستخدام بحسب خطة المستخدم وإمكانية الوصول إلى Work وVoice
- تظل صلاحيات التطبيقات المتصلة وإجراءات الموافقة والقيود الأمنية سارية عند استخدام Voice
- تتجه OpenAI إلى جعل تشات جي بي تي أداة قادرة على تنفيذ سير عمل كامل باستخدام الأوامر الصوتية




