أصبح التحدث مع ChatGPT أكثر سلاسة وطبيعية بفضل وضع الصوت الجديد، الذي يعتمد على نموذج GPT-Live القادر على الاستماع والتحدث في الوقت نفسه، ما يقلل من المقاطعات ويجعل الحوار أقرب إلى المحادثة مع شخص حقيقي.
في النسخة الأولى من Voice Mode التي أطلقتها OpenAI عام 2023، كانت المحادثة الصوتية تعتمد على 3 أنظمة منفصلة؛ الأول يحول كلام المستخدم إلى نص، والثاني يولد الإجابة باستخدام نموذج لغوي، والثالث يحول الإجابة إلى صوت، ثم قدمت الشركة Advanced Voice Mode باستخدام نموذج متعدد الوسائط، لتحسين سرعة وطبيعية المحادثات.
أما الآن، فيعتمد ChatGPT على نموذج GPT-Live لإدارة المحادثات الصوتية، مع ما تصفه OpenAI ببنية Full-Duplex، التي تسمح للنموذج بالاستماع والتحدث في الوقت نفسه، وهذا يعني أن ChatGPT أصبح أقل عرضة لاعتبار التوقف القصير أثناء حديثك نهاية للجملة والبدء في الرد قبل أن تنتهي من كلامك.
من أبرز التغييرات أن ChatGPT يمكنه أحيانًا إصدار ردود صوتية قصيرة أثناء حديث المستخدم، مثل «ممم» أو «أجل»، على غرار الطريقة التي يتفاعل بها الأشخاص أثناء المحادثات الطبيعية، كما يستطيع GPT-Live الاستعانة بنماذج أخرى أكثر قدرة، مثل GPT-5.5، في الخلفية عندما يحتاج السؤال إلى قدر أكبر من التفكير أو البحث، مع استمرار المحادثة الصوتية دون انقطاع واضح.
يتوفر GPT-Live عبر تطبيق ChatGPT على أجهزة iPhone وAndroid، وكذلك من خلال متصفح الويب، ولبدء المحادثة، اضغط على أيقونة الصوت التي تظهر على شكل موجة صوتية في أقصى يمين مربع الكتابة.
– إذا كانت هذه أول مرة تستخدم فيها المحادثات الصوتية، سيطلب منك ChatGPT السماح للتطبيق باستخدام ميكروفون الجهاز.
– بعد الدخول إلى وضع الصوت، ستظهر دائرة عائمة متحركة على الشاشة، ويمكنك بدء التحدث بشكل طبيعي.
– كما يظل وضع الصوت نشطًا حتى إذا انتقلت إلى تطبيق آخر أو قمت بقفل شاشة الهاتف.
يمكن للمستخدمين تغيير مستوى ذكاء نموذج الصوت من خلال الضغط على أيقونة الإعدادات الموجودة أعلى الشاشة، وتتوفر 3 مستويات:
– Instant: للحصول على ردود سريعة، وهو الوضع الافتراضي.
– Medium: يوفر وقتًا إضافيًا قليلًا للتفكير مقابل إجابات أكثر تعمقًا.
– High: مخصص للمحادثات والأسئلة الأكثر تعقيدًا، مع منح النموذج وقتًا أكبر للتفكير.
وبحسب التقرير، فإن تخصيص مستوى الذكاء غير متاح حاليًا في نسخة GPT-Live-1 mini، وبالتالي تقتصر هذه الميزة على الخطط المدفوعة.
تصفح أيضًا: بيتكوين تهبط لأدنى مستوياتها في 22 شهرا مع تصاعد رهانات رفع الفائدة الأمريكية
يحصل مستخدمو ChatGPT Pro وPlus وGo على نموذج GPT-Live-1، بينما يستطيع مستخدمو الخطة المجانية استخدام GPT-Live-1 mini، ويحل GPT-Live محل نموذج Advanced Voice السابق باعتباره الخيار الافتراضي للمحادثات الصوتية.
أبرز ما يميز GPT-Live هو أنه يقلل الإحساس بأنك تتحدث مع نظام آلي، فبدلًا من انتظار ChatGPT حتى ينتهي من الرد قبل أن تبدأ الحديث من جديد، يمكنك مقاطعته أو مواصلة الحديث بصورة أكثر طبيعية، كما أصبح النموذج أقل ميلًا إلى مقاطعة المستخدم لمجرد وجود توقف قصير أثناء الكلام، وهو ما يجعل المحادثات الطويلة أكثر سلاسة.
تجعل سرعة استجابة GPT-Live منه أداة مناسبة أيضًا للترجمة أثناء المحادثات المباشرة، وخلال المحادثة، يمكنك التمرير إلى أسفل الشاشة لعرض النص المكتوب لكل ما يقوله المستخدم وChatGPT، وإذا رأى ChatGPT أن السؤال يحتاج إلى عنصر بصري، يمكنه أيضًا إنشاء عنصر تفاعلي Widget بجانب الرد الصوتي لمساعدة المستخدم في فهم الإجابة.
يبدأ GPT-Live افتراضيًا بمستوى Instant، وهو مصمم للتعامل مع الأسئلة اليومية مع إعطاء الأولوية لسرعة الرد، لكن النموذج يستطيع في الخلفية إحالة عمليات البحث أو الأسئلة التي تحتاج إلى تفكير أعمق إلى نماذج أكثر قدرة، بينما يستمر الحوار الصوتي، أما إذا كنت تستخدم Voice Mode لمناقشة موضوعات معقدة بشكل متكرر، فيمكن الانتقال إلى Medium أو High للحصول على وقت أكبر للتفكير، ورغم أن ذلك قد يضيف ثانية أو ثانيتين إلى زمن الاستجابة، فإن التجربة تظل طبيعية نسبيًا.
رغم التحسينات الكبيرة، لا يدعم GPT-Live حاليًا مشاركة الشاشة أو مشاركة الفيديو، وإذا لم تكن راضيًا عن النموذج الجديد، يمكنك العودة إلى نموذج الصوت السابق من خلال إعدادات ChatGPT، ثم الدخول إلى Voice واختيار نموذج مختلف.
ومن المكان نفسه، يمكنك تغيير صوت ChatGPT، وتحديد اللغة، وكذلك جعل Voice Mode هو الوضع الافتراضي عند تشغيل التطبيق.




