أصبح التحدث مع ChatGPT أكثر سلاسة وطبيعية بفضل وضع الصوت الجديد، الذي يعتمد على نموذج GPT-Live القادر على الاستماع والتحدث في الوقت نفسه، مما يقلل من المقاطعات ويجعل الحوار أقرب إلى المحادثة مع شخص حقيقي.

GPT-Live.. خطوة جديدة في المحادثات الصوتية

في النسخة الأولى من وضع الصوت التي أطلقتها OpenAI عام 2023، كانت المحادثة الصوتية تعتمد على ثلاثة أنظمة منفصلة؛ الأول يحول كلام المستخدم إلى نص، والثاني يولد الإجابة باستخدام نموذج لغوي، والثالث يحول الإجابة إلى صوت. ثم قدمت الشركة وضع الصوت المتقدم باستخدام نموذج متعدد الوسائط لتحسين سرعة وطبيعية المحادثات. أما الآن، فيعتمد ChatGPT على نموذج GPT-Live لإدارة المحادثات الصوتية، مع ما تصفه OpenAI ببنية Full-Duplex، التي تسمح للنموذج بالاستماع والتحدث في الوقت نفسه. وهذا يعني أن ChatGPT أصبح أقل عرضة لاعتبار التوقف القصير أثناء حديثك نهاية للجملة والبدء في الرد قبل أن تنتهي من كلامك.

ChatGPT قد يقول «ممم» و«أجل» أثناء حديثك

كيف تبدأ محادثة صوتية مع ChatGPT؟

يتوفر GPT-Live عبر تطبيق ChatGPT على أجهزة iPhone وAndroid، وكذلك من خلال متصفح الويب. لبدء المحادثة، اضغط على أيقونة الصوت التي تظهر على شكل موجة صوتية في أقصى يمين مربع الكتابة. إذا كانت هذه أول مرة تستخدم فيها المحادثات الصوتية، سيطلب منك ChatGPT السماح للتطبيق باستخدام ميكروفون الجهاز. بعد الدخول إلى وضع الصوت، ستظهر دائرة عائمة متحركة على الشاشة، ويمكنك بدء التحدث بشكل طبيعي. كما يظل وضع الصوت نشطًا حتى إذا انتقلت إلى تطبيق آخر أو قمت بقفل شاشة الهاتف.

3 مستويات لذكاء النموذج الصوتي

يمكن للمستخدمين تغيير مستوى ذكاء نموذج الصوت من خلال الضغط على أيقونة الإعدادات الموجودة أعلى الشاشة. تتوفر 3 مستويات:
– Instant: للحصول على ردود سريعة وهو الوضع الافتراضي.
– Medium: يوفر وقتًا إضافيًا قليلًا للتفكير مقابل إجابات أكثر تعمقًا.
– High: مخصص للمحادثات والأسئلة الأكثر تعقيدًا مع منح النموذج وقتًا أكبر للتفكير. وبحسب التقرير، فإن تخصيص مستوى الذكاء غير متاح حاليًا في نسخة GPT-Live-1 mini، وبالتالي تقتصر هذه الميزة على الخطط المدفوعة.

ما الفرق بين الخطط؟

يحصل مستخدمو ChatGPT Pro وPlus وGo على نموذج GPT-Live-1، بينما يستطيع مستخدمو الخطة المجانية استخدام GPT-Live-1 mini. ويحل GPT-Live محل نموذج Advanced Voice السابق باعتباره الخيار الافتراضي للمحادثات الصوتية.

المحادثات أصبحت أكثر طبيعية

أبرز ما يميز GPT-Live هو أنه يقلل الإحساس بأنك تتحدث مع نظام آلي. بدلاً من انتظار ChatGPT حتى ينتهي من الرد قبل أن تبدأ الحديث من جديد، يمكنك مقاطعته أو مواصلة الحديث بصورة أكثر طبيعية. كما أصبح النموذج أقل ميلًا إلى مقاطعة المستخدم لمجرد وجود توقف قصير أثناء الكلام مما يجعل المحادثات الطويلة أكثر سلاسة.

ميزة مهمة للترجمة الفورية

تجعل سرعة استجابة GPT-Live منه أداة مناسبة أيضًا للترجمة أثناء المحادثات المباشرة. وخلال المحادثة يمكنك التمرير إلى أسفل الشاشة لعرض النص المكتوب لكل ما يقوله المستخدم وChatGPT. وإذا رأى ChatGPT أن السؤال يحتاج إلى عنصر بصري، يمكنه أيضًا إنشاء عنصر تفاعلي بجانب الرد الصوتي لمساعدة المستخدم في فهم الإجابة.

ماذا لو كان السؤال معقدًا؟

يبدأ GPT-Live افتراضيًا بمستوى Instant وهو مصمم للتعامل مع الأسئلة اليومية مع إعطاء الأولوية لسرعة الرد. لكن النموذج يستطيع في الخلفية إحالة عمليات البحث أو الأسئلة التي تحتاج إلى تفكير أعمق إلى نماذج أكثر قدرة بينما يستمر الحوار الصوتي. أما إذا كنت تستخدم وضع الصوت لمناقشة موضوعات معقدة بشكل متكرر، فيمكن الانتقال إلى Medium أو High للحصول على وقت أكبر للتفكير. ورغم أن ذلك قد يضيف ثانية أو ثانيتين إلى زمن الاستجابة، فإن التجربة تظل طبيعية نسبيًا.

هل توجد قيود على GPT-Live؟

رغم التحسينات الكبيرة، لا يدعم GPT-Live حاليًا مشاركة الشاشة أو مشاركة الفيديو. وإذا لم تكن راضيًا عن النموذج الجديد يمكنك العودة إلى النموذج السابق من خلال إعدادات ChatGPT ثم الدخول إلى Voice واختيار نموذج مختلف. ومن المكان نفسه يمكنك تغيير صوت ChatGPT وتحديد اللغة وكذلك جعل وضع الصوت هو الوضع الافتراضي عند تشغيل التطبيق.