OpenAI pada 24 September 2026 secara resmi mengumumkan peluncuran luas fitur Advanced Voice Mode (AVM) bagi para pelanggan layanan berbayar ChatGPT Plus dan ChatGPT Team. Pembaharuan ini membawa lompatan besar dalam evolusi komunikasi suara interaktif antara manusia dan kecerdasan buatan.

Tidak seperti sistem suara generasi sebelumnya yang memisahkan proses transkripsi suara ke teks, pemrosesan bahasa, dan konversi teks ke audio kembali, mode ini bekerja langsung pada jaringan saraf multimoda bawaan GPT-4o. Hal tersebut memungkinkan asisten menangkap intonasi emosional, nada bisikan, dan jeda secara alami tanpa latensi yang mengganggu.

Arsitektur Audio Asli dan Interaksi Percakapan Responsif

Pengguna dapat memilih sembilan varian suara sintesis baru seperti Arbor, Maple, Sol, dan Spruce yang dirancang untuk kebutuhan obrolan santai maupun diskusi kerja profesional. Keunggulan utamanya adalah pengguna dapat memotong pembicaraan asisten di tengah kalimat secara mulus.

Sistem ini juga diselaraskan dengan instruksi kustom pengguna, sehingga asisten dapat menyesuaikan gaya bahasa, aksen, dan tingkat keramahan sesuai kebutuhan personal pengguna.

“Advanced Voice Mode menghadirkan kelancaran bercakap yang sebelumnya mustahil. Dengan memproses audio secara langsung, GPT-4o menangkap nuansa, jeda, dan nada bicara secara alami.”

Protokol Keamanan Ketat dan Distribusi Bertahap Global

Aspek keamanan menjadi fokus utama peluncuran ini. OpenAI menyematkan filter cerdas real-time yang memblokir upaya menghasilkan suara figur publik tanpa izin atau memainkan materi musik berhak cipta.

Penyebaran fitur dilakukan bertahap di aplikasi seluler iOS dan Android dalam beberapa hari ke depan, sebelum nantinya diperluas ke akun perusahaan dan lembaga pendidikan tinggi.

Sources