OpenAI a officiellement lancé le 24 septembre 2026 le déploiement massif de son Mode Vocal Avancé (AVM) pour les utilisateurs payants abonnés à ChatGPT Plus et ChatGPT Team. Cette mise à jour majeure transforme la communication vocale avec l'intelligence artificielle en un dialogue instantané et vivant.

Contrairement aux systèmes vocaux classiques qui fragmentent le processus entre reconnaissance de la parole, traitement textuel et resynthèse, le Mode Vocal Avancé s'appuie sur le réseau neuronal omnimodal direct de GPT-4o. Cette chaîne de traitement continue permet au modèle de percevoir les variations acoustiques, le rythme et les respirations.

Architecture audio native et fluidité conversationnelle inédite

L'application met à disposition neuf voix distinctes aux timbres riches, dont de nouvelles options nommées Arbor, Maple, Sol et Spruce. Les utilisateurs peuvent désormais couper la parole à l'assistant de façon naturelle pour corriger ou réorienter l'échange sans attendre la fin de la réponse.

Les instructions personnalisées de l'utilisateur sont également prises en compte lors des sessions vocales, assurant une parfaite cohérence avec le profil et les attentes de chaque interlocuteur.

“Le Mode Vocal Avancé offre un naturel conversationnel qui était impensable auparavant. En traitant le son nativement, GPT-4o perçoit les nuances et les silences avec une grande précision.”

Dispositifs de sécurité et calendrier de déploiement international

Le laboratoire californien a renforcé ses garde-fous pour parer aux risques d'usurpation vocale et de reproduction non autorisée de contenus musicaux ou de voix de personnalités publiques.

Cette phase de distribution se poursuivra au cours des prochains jours sur iOS et Android, avant de s'étendre prochainement aux clients institutionnels et aux campus universitaires.

Sources