تحديث جديد للتفاعل الصوتي في ChatGPT
نون - يمكن لمستخدمي ChatGPT التطلع إلى تحديث جديد من OpenAI. وسيتضمن التحديث، الذي من المقرر إطلاقه هذا الأسبوع، ميزات الوضع الصوتي الجديدة التي ستعمل على تحسين التفاعل الصوتي مع منصة الدردشة.
أكد سام ألتمان، مدير ومؤسس شركة OpenAI، موعد الإطلاق في رد على منشور على منصة X، مشيراً إلى أن الإصدار القادم سيبدأ الوصول الأولي لمشتركي الخدمة المدفوعة ChatGPT Plus في الأيام القليلة القادمة.
وكانت الشركة الناشئة قد أعلنت عن التحديث لأول مرة في شهر مايو وكان من المقرر أن يظهر على ChatGPT في شهر يونيو، لكن الشركة أجلت التحديث لضمان قدرتها على التعامل مع ملايين طلبات المستخدمين بشكل آمن وفعال.
سيوفر الجيل الجديد من الأوضاع الصوتية، الذي تم تقديمه في طراز GPT-4o لـ ChatGPT حواراً منطوقاً أكثر تعبيراً في الرد على استفسارات المستخدمين ومناقشاتهم.
ويسمح هذا التحديث لـ ChatGPT بتغيير صوته ليعكس شخصية معينة يطلبها المستخدم، مثل تقليد صوت رجل عجوز أو فتاة.
والميزة الثالثة هي الترجمة الفورية من لغة إلى لغة، والتي تتيح لشخصين يتحدثان لغتين مختلفتين أن يطلبا من ChatGPT أن يترجم لهما أثناء المحادثة.
كما أشارت الشركة في شهر مايو إلى أن ChatGPT تخطط لإضافة ميزات مرئية أثناء الحوار المنطوق هذا العام. وتشمل هذه الميزات بثاً مباشراً من كاميرا الهاتف والقدرة على إدراج صورة أو مقطع فيديو لمشاركة ما يظهر على شاشة الهاتف مع المنصة وطرح أسئلة صوتية حوله.
يأتي هذا التحديث بعد أيام فقط من إطلاق الشركة لطراز هاتف ذكي جديد هو GPT-4o mini. ويدعم GPT-4o mini حالياً معالجة النصوص والصور، ولكن مثل الإصدار السابق من GPT-4o الذي تم إطلاقه في مايو/أيار الماضي، فإنه يدعم معالجة الوسائط المتعددة MultiModal وسيكون قادراً على معالجة مقاطع الفيديو والصوت في الفترة القادمة.
يعد GPT-4o أرخص بنسبة 60% من GPT-3.5Turbo، مما يجعله أرخص على مستوى المطورين.
وفقًا لـ OpenAI، سيكون GPT-4o mini أول نموذج ذكاء اصطناعي للشركة يستخدم تقنية جديدة تسمى التسلسل الهرمي للتعليمات.
هذه التقنية تجعله أقل عرضة لهجمات الحقن الفوري وهجمات كسر الحماية (الهجمات التي تنتهك التعليمات التي يقدمها المطور أو محاولة إجباره على الاستجابة بمعلومات تنتهك معايير وقواعد استخدام OpenAI
