بدأت شركة أوبن إيه آي في 24 سبتمبر 2026 الطرح التجاري الواسع لميزتها المرتقبة 'الوضع الصوتي المتقدم' (AVM) لجميع مشتركي باقتي ChatGPT Plus وChatGPT Team. ويمثل هذا التحديث قفزة نوعية في طرق التفاعل الصوتي بين الإنسان وأنظمة الذكاء الاصطناعي.

وعلى خلاف الأنظمة السابقة التي كانت تعتمد على تحويل الصوت إلى نصوص ثم معالجتها وإعادة نطقها، يعمل الوضع الصوتي المتقدم مباشرة ضمن بنية GPT-4o العصبية متعددة الوسائط. ويتيح هذا التعامل الفوري إدراك نبرات الصوت الخافتة وسرعة الكلام وفترات التوقف بدقة متناهية.

معالجة صوتية أصلية وتفاعل فوري بدون تأخير

ويتيح التحديث للمستخدمين الاختيار من بين تسعة أصوات طبيعية ومصممة بعناية، من بينها Arbor وMaple وSol وSpruce، والتي تتنوع بين المحادثات الودية والنقاشات الأكاديمية والمهنية. كما يمكن للمستخدم مقاطعة الذكاء الاصطناعي أثناء حديثه لتعديل مسار الفكرة بكل سلاسة.

ودمجت الشركة أيضاً التعليمات المخصصة ضمن النموذج الصوتي، بحيث يتذكر شات جي بي تي أسلوب المخاطبة المفضل للمستخدم وسرعة الإلقاء المفضلة عبر الجلسات المتكررة.

“يوفر الوضع الصوتي المتقدم طبيعية تفاعلية لم تكن ممكنة من قبل. فمن خلال معالجة الصوت أصلياً، يستشعر GPT-4o الفروق الدقيقة والنبرات ليقدم كلاماً بشرياً سلساً.”

ضوابط الأمان الصارمة والجدول الزمني للتوفر العالمي

وفرضت الشركة معايير أمان مشددة لتفادي سوء الاستخدام، حيث تم تزويد النظام بمرشحات آنية تمنع محاولات استنساخ أصوات الشخصيات العامة أو تشغيل مقاطع موسيقية تخضع لحقوق الطبع والنشر.

وسيستمر تفعيل الميزة تدريجياً عبر تطبيقات الهواتف الذكية لنظامي iOS وAndroid خلال الأيام القادمة، تمهيداً لفتحها لاحقاً لقطاعات التعليم والمؤسسات الكبرى.

Sources