الرئيسيةالتكنولوجياOpenAI تطلق GPT-Live للتفاعل الصوتي ..الـ Ai يتكلم ويستمع في نفس الوقت

OpenAI تطلق GPT-Live للتفاعل الصوتي ..الـ Ai يتكلم ويستمع في نفس الوقت

spot_imgspot_imgspot_imgspot_img
spot_imgspot_imgspot_imgspot_img

تدفع OpenAI التفاعل الصوتي مع الذكاء الاصطناعي خطوة أبعد من فكرة المساعد الذي ينتظر انتهاء المستخدم من الكلام قبل بدء الإجابة، فالبنية الهندسية لنظام GPT-Live الذي يعتمد على نموذج صوتي مزدوج الاتجاه يستطيع الاستماع والتحدث في الوقت نفسه، والهدف هو إزالة التأخير الذي يجعل المحادثة مع الأنظمة الذكية مختلفة عن الحوار البشري الطبيعي، مع الاحتفاظ بإمكانية الاستعانة بنماذج أكثر قوة عندما تحتاج المحادثة إلى بحث أو استدلال أعمق أو تنفيذ أدوات.

قد يهمك أيضًا: إنفيديا تستثمر مليار دولار فى Naver وتوسع نفوذها داخل كوريا الجنوبية

وفقًا تقرير هندسي نشره مدونة OpenAI ، ألغى GPT-Live ما يعرف بكاشف الدور من المسار الصوتي الأساسي وأصبح تدفق الصوت مستمرًا من المستخدم إلى النموذج والعكس، ويمكن للنظام الاستعانة بنموذج مثل GPT-5.5 لتنفيذ البحث أو المهام الأكثر تعقيدًا دون إيقاف الحوار الصوتي، كما أعادت الشركة خلال 6 أشهر تصميم أجزاء من الاستدلال وإدارة السياق ونقل الوسائط للوصول إلى زمن استجابة يقل عن ثانية في التفاعلات المناسبة، مع استخدام WebRTC للحفاظ على استقرار تدفق الصوت حتى عند وجود فقد في بعض حزم البيانات أو تغيرات في الاتصال.

الأهم من تحسين سرعة الحديث هو أن هذه البنية تفتح الطريق أمام تحول الصوت إلى واجهة تشغيل مباشرة لوكلاء الذكاء الاصطناعي، إذ تشير التفاصيل المنشورة إلى أن التقنية تدعم بالفعل قدرات في ChatGPT Voice تشمل التحكم في الكمبيوتر وتنسيق عمل الوكلاء داخل تطبيق سطح المكتب، كما ستشكل الأساس لواجهة GPT-Live API المرتقبة، وإذا نجحت هذه الهندسة على نطاق واسع فقد تنتقل المنافسة من سؤال أي نموذج يقدم أفضل إجابة نصية إلى سؤال أي نظام يستطيع إدارة حوار مستمر وتنفيذ مهام متعددة أثناء الحديث بطريقة أقرب إلى التفاعل مع مساعد بشري حقيقي.

spot_imgspot_imgspot_imgspot_img
مقالات ذات صلة
spot_imgspot_imgspot_imgspot_img
- Advertisment -spot_imgspot_imgspot_imgspot_img

الأكثر شهرة

- Advertisment -spot_imgspot_imgspot_imgspot_img

احدث التعليقات