أعلنت "OpenAI" إطلاق نموذجها الصوتي الجديد GPT-Live-1 لتشغيل ميزة المحادثات الصوتية في ChatGPT.
ويهدف ذلك إلى جعل التفاعل مع مساعدها الذكي أقرب إلى الحديث مع شخص حقيقي، مع تحسينات تشمل تقليل المقاطعات، وفهم التوقفات الطبيعية أثناء الكلام، والاستجابة بنحو أكثر سلاسة.
وقالت الشركة إن النموذج الجديد يُعد أكثر نماذجها الصوتية تطورًا حتى الآن؛ إذ يستطيع تلقائيًا الاستعانة بأفضل نماذجها النصية، مثل GPT-5.5، عند الحاجة إلى الاستدلال أو البحث عبر الويب، ثم يعود مباشرة إلى المحادثة لعرض النتائج دون أن يشعر المستخدم بانقطاع في الحوار.
ويتيح نموذج "GPT-Live-1" أيضًا، عرض معلومات مرئية مولدة بالذكاء الاصطناعي في أثناء المحادثات المتعلقة بالطقس أو الأسهم أو الرياضة، مثل نتائج المباريات أو توقعات الطقس الأسبوعية، لتوفير تجربة أكثر تفاعلية.
وكانت الإصدارات السابقة من المحادثات الصوتية تعتمد على نموذج يعمل وفق أسلوب تبادل الأدوار، مما كان يؤدي أحيانًا إلى إجابات أقل دقة أو حوار أقل طبيعية.
أما النموذج الجديد فيعتمد على بنية تُسمى Full Duplex، وهي تمكّنه من الاستماع والتحدث في الوقت نفسه، مع معالجة المدخلات وإنتاج الردود بصورة متزامنة ومستمرة.
💬 التعليقات (0)