التخطي إلى المحتوى

أصبح استخدام ChatGPT بالصوت أكثر سلاسة وطبيعية بفضل وضع الصوت الجديد المعتمد على نموذج GPT-Live، وهو نموذج مصمم للتعامل مع المحادثة بطريقة قريبة من الكلام البشري؛ يستمع أثناء الرد ويتابع الحوار في نفس اللحظة، ما يقلل التوقفات المتكررة ويجعل تجربة المحادثة أقرب إلى “مقابلة” حقيقية بدل كونها تبادلًا آليًا بين تسجيل ونص ثم إجابة ثم تحويل إلى صوت.

## GPT-Live.. تطور مهم في المحادثات الصوتية
في النسخة الأولى من Voice Mode التي أطلقتها OpenAI خلال 2023، كانت المحادثة الصوتية تُدار عبر 3 مراحل منفصلة: تحويل صوت المستخدم إلى نص، ثم توليد الإجابة عبر نموذج لغوي، وبعدها تحويل النص إلى صوت. لاحقًا، جاءت Advanced Voice Mode لتتحسن السرعة والطبيعية عبر نموذج متعدد الوسائط.

في المقابل، يعتمد GPT-Live حاليًا على نموذج واحد يدير المحادثة الصوتية بفعالية أكبر وفق ما تصفه OpenAI كبنية Full-Duplex (استماع وتحدث في آن واحد). عمليًا، يعني ذلك أن ChatGPT أقل عرضة لأن “يُفسر” توقفًا قصيرًا على أنه نهاية الجملة ويبدأ الرد قبل أن تكمل كلامك.

## لماذا تبدو الردود طبيعية أكثر؟
من العلامات الواضحة أن GPT-Live قد يصدر أحيانًا تفاعلات صوتية قصيرة أثناء حديث المستخدم، مثل «ممم» أو «أجل»، وهي طريقة شبيهة بتصرف البشر أثناء الاستماع. الهدف ليس مجرد الصوت، بل تعزيز الإحساس بالتواصل المستمر وعدم قطع تدفق الحوار.

كما يمكن للنظام عند الحاجة إلى تفكير أعمق أو بحث إضافي—بدون أن يتوقف الصوت بشكل واضح—الاستعانة بنماذج أكثر قدرة في الخلفية (مثل GPT-5.5 حسب ما تشير إليه التقارير)، بحيث تظل المحادثة سلسة حتى مع الأسئلة المعقدة.

## كيف تبدأ محادثة صوتية مع ChatGPT؟
يمكنك الوصول إلى GPT-Live عبر تطبيق ChatGPT على أجهزة iPhone وAndroid، وكذلك من خلال متصفح الويب. وللبدء:
1) افتح ChatGPT.
2) اضغط على أيقونة الصوت (موجة صوتية) الموجودة غالبًا في أقصى يمين مربع الكتابة.
3) إذا كانت هذه أول مرة تستخدم فيها المحادثات الصوتية، سيطلب منك التطبيق السماح بالوصول إلى الميكروفون.
4) بعد تفعيل وضع الصوت ستظهر دائرة عائمة متحركة، ابدأ الحديث بشكل طبيعي.
5) يبقى وضع الصوت نشطًا عادةً حتى إذا انتقلت إلى تطبيق آخر أو قمت بقفل الشاشة (قد تختلف التفاصيل حسب نظام التشغيل وإعدادات الأذونات).

## 3 مستويات لذكاء نموذج الصوت
يوفر GPT-Live للمستخدمين خيار تغيير “مستوى الذكاء” الخاص بالنموذج عبر الإعدادات من أعلى الشاشة، وتتوفر 3 مستويات:
– Instant: للحصول على ردود سريعة، وهو الوضع الافتراضي.
– Medium: يوازن بين السرعة والعمق، ويمنح النموذج وقتًا إضافيًا قليلًا لرد أكثر تفصيلًا.
– High: للأسئلة الأكثر تعقيدًا، يمنح وقتًا أكبر للتفكير، وقد يرفع زمن الاستجابة قليلًا مقابل إجابات أدق.

وتشير التقارير إلى أن تخصيص مستوى الذكاء غير متاح حاليًا في نسخة GPT-Live-1 mini، وبالتالي تكون هذه الميزة مرتبطة غالبًا بالخطط المدفوعة.

## ما الفرق بين الخطط؟
– مستخدمو الخطط Pro وPlus وGo يحصلون على نموذج GPT-Live-1.
– مستخدمو الخطة المجانية يمكنهم استخدام GPT-Live-1 mini.

كذلك، يحل GPT-Live محل نموذج Advanced Voice السابق ليصبح الخيار الافتراضي للمحادثات الصوتية.

## تجربة المحادثة: أقل مقاطعة وأكثر سلاسة
التحسين الأساسي في GPT-Live هو تقليل الإحساس بأنك تتحدث مع “نظام” يحتاج إلى أن ينتهي تمامًا قبل أن تسمح له بمواصلة الحوار. يمكنك مقاطعة ChatGPT أو متابعة كلامك عندما تحتاج، وسيستمر النظام بالتعامل مع تدفق الحديث بشكل طبيعي أكثر.

وبفضل انخفاض حساسية النظام لفكرة أن التوقف القصير يعني نهاية الرد، تصبح المحادثات الطويلة—سواء نقاشات أو شرح خطوات—أكثر سلاسة وأقل تشويشًا.

## ميزة مهمة: الترجمة الفورية مع النصوص والـ Widgets
تساعد سرعة الاستجابة في جعل وضع الصوت مناسبًا أيضًا للترجمة أثناء المحادثات المباشرة. أثناء الحديث، يمكنك التمرير للأسفل لعرض النص المكتوب لما تقوله أنت وما يقوله ChatGPT.

وفي حال احتاج الرد إلى عنصر بصري لفهم أفضل، قد يقوم GPT-Live بإنشاء Widget تفاعلي بجانب الرد الصوتي، بما يدعم متابعة المعنى بدل الاقتصار على الصوت فقط.

## ماذا لو كان سؤالك معقدًا؟
يبدأ GPT-Live افتراضيًا بوضع Instant، وهو الأفضل للأسئلة اليومية التي تحتاج إلى سرعة. لكن عندما يكون السؤال يتطلب تحليلًا أو بحثًا أو وقتًا أكبر للفهم، يمكن للنظام—في الخلفية—تحويل المعالجة إلى نماذج أكثر قدرة دون أن تنقطع تجربة الصوت بشكل مزعج.

إذا كنت تتناول موضوعات معقدة باستمرار (مثل الدراسة، البرمجة، التخطيط، أو نقاشات تقنية)، فقد يكون من الأفضل اختيار Medium أو High للحصول على وقت أكبر للتفكير. قد يضيف ذلك ثانية أو ثانيتين إلى زمن الاستجابة، لكن التجربة تبقى طبيعية نسبيًا مقارنة بالانتظار الطويل في أنظمة صوت تقليدية.

## قيود حالية على GPT-Live
رغم التطور، لا يدعم GPT-Live حاليًا مشاركة الشاشة أو مشاركة الفيديو. لذلك تظل الاستفادة من الصور/المحتوى البصري مرتبطة بالميزات الأخرى داخل ChatGPT (إن كانت متاحة لحسابك) أو عبر إدخال النص/وصف ما تريد شرحه.

## كيفية العودة أو تخصيص إعدادات الصوت
إذا لم تكن راضيًا عن GPT-Live، يمكنك الرجوع إلى نموذج الصوت السابق من خلال إعدادات ChatGPT ثم الدخول إلى Voice واختيار نموذج مختلف.

ومن نفس المكان يمكنك أيضًا:
– تغيير صوت ChatGPT.
– تحديد اللغة.
– جعل Voice Mode هو الوضع الافتراضي عند تشغيل التطبيق.

في النهاية، يقدم GPT-Live نقلة عملية في “طبيعية” المحادثات الصوتية: استماع وتحدث متزامنان، ومرونة أعلى مع المقاطعة، وردود تفاعلية قصيرة، مع خيارات للمستوى بين السرعة والدقة—وكل ذلك يجعل الدردشة الصوتية أكثر واقعية للاستخدام اليومي والترجمة ومتابعة النقاشات المعقدة نسبيًا.

التعليقات

اترك تعليقاً

لن يتم نشر عنوان بريدك الإلكتروني. الحقول الإلزامية مشار إليها بـ *