A OpenAI deu início oficial em 24 de setembro de 2026 à liberação massiva do Modo de Voz Avançado (AVM) para seus assinantes dos planos ChatGPT Plus e ChatGPT Team. O lançamento marca uma evolução significativa na comunicação por voz entre usuários e sistemas de inteligência artificial.
Diferente dos métodos convencionais que convertem voz em texto antes de gerar uma resposta sintética, o Modo de Voz Avançado opera nativamente na arquitetura neural do GPT-4o. Esse processamento ponta a ponta preserva microdetalhes acústicos, entonações afetivas e pausas respiratórias sem latência perceptível.
Arquitetura nativa omnimodal e interrupções em tempo real
Os assinantes contam com nove vozes sintetizadas com alta expressividade, incluindo novas variantes batizadas de Arbor, Maple, Sol e Spruce. Um dos recursos mais elogiados é a capacidade de interromper o assistente no meio de uma frase, ajustando o rumo da conversa naturalmente.
A tecnologia também incorpora as instruções personalizadas do usuário, mantendo a coerência sobre tom de voz preferido, brevidade e vocabulário técnico durante o diálogo.
“O Modo de Voz Avançado proporciona uma naturalidade conversacional nunca vista. Ao processar o áudio nativamente, o GPT-4o compreende entonações, pausas e tons de forma fluida.”
Diretrizes de segurança e expansão internacional gradual
Para mitigar riscos de segurança, a OpenAI implementou salvaguardas que impedem a reprodução de trechos musicais com direitos protegidos e bloqueiam imitações da voz de terceiros.
O recurso chegará progressivamente aos smartphones com iOS e Android ao longo dos próximos dias, preparando o terreno para futuros planos educacionais e corporativos.




Comments (0)
Log in to join the discussion.