OpenAI Revoluciona ChatGPT com Nova Voz em Tempo Real A OpenAI anunciou o lançamento da família de modelos GPT-Live, que promete transformar a experiência de interagir com o ChatGPT por voz. A nova ferramenta, denominada ChatGPT Voice, foi desenvolvida para

OpenAI Revoluciona ChatGPT com Nova Voz em Tempo Real

A OpenAI anunciou o lançamento da família de modelos GPT-Live, que promete transformar a experiência de interagir com o ChatGPT por voz. A nova ferramenta, denominada ChatGPT Voice, foi desenvolvida para proporcionar conversas em tempo real com um nível de naturalidade inédito, aproximando a inteligência artificial da comunicação humana.

A grande novidade é a arquitetura “full-duplex”, que permite que a IA ouça e fale simultaneamente, sem interrupções. Isso significa que o ChatGPT poderá processar o que você diz enquanto você ainda está falando, além de identificar pequenas pausas ou hesitações, como um “hmmm” durante o raciocínio, tornando o diálogo muito mais fluído.

Essa tecnologia inovadora possibilita que o próprio ChatGPT peça um tempo para buscar informações ou processar dados complexos antes de responder. Conforme informação divulgada pela OpenAI, o GPT-Live delega tarefas mais exigentes ao seu modelo mais avançado, o GPT-5.5, permitindo que a conversa continue sem pausas abruptas, resultando em respostas mais aprimoradas e resultados visuais, como demonstrações de previsão do tempo e mapas.

Duas Versões para Ampliar o Acesso

Inicialmente, o ChatGPT Voice será disponibilizado em duas versões: GPT-Live-1 e GPT-Live-1 mini. A versão mais completa, GPT-Live-1, estará acessível para os usuários dos planos pagos do ChatGPT, enquanto o modelo simplificado, GPT-Live-1 mini, será oferecido aos usuários de planos gratuitos. A implantação global começou nesta quarta-feira (08/07) e estará disponível para acesso via web, iOS e Android.

Interações Mais Dinâmicas e Inteligentes

A capacidade “full-duplex” do GPT-Live permite que a IA tome decisões de interação diversas vezes por segundo. Isso se traduz em uma experiência onde a IA não interrompe o usuário, respeitando seu ritmo de fala e pensamento. A IA também pode expressar a necessidade de um tempo para raciocinar ou buscar informações, simulando uma conversa humana mais autêntica.

Um dos destaques é a capacidade do GPT-Live de acionar recursos de busca na web, raciocínio complexo ou processamento avançado. Ao identificar a necessidade de tais tarefas, ele as delega ao GPT-5.5, o modelo multimodal mais recente da OpenAI. Enquanto o GPT-5.5 trabalha, o GPT-Live mantém a conversa ativa com o usuário, garantindo um fluxo contínuo e dinâmico.

Novas Funcionalidades e Limitações

O ChatGPT Voice com GPT-Live promete conversas mais naturais, com melhorias na audição, respostas mais precisas e a capacidade de gerar resultados visuais. A OpenAI demonstrou o potencial da ferramenta com exemplos de tradução instantânea de inglês para hindi e a geração de respostas visuais para pedidos de previsão do tempo e informações sobre jogos da Copa do Mundo.

Apesar dos avanços significativos, a OpenAI alerta sobre algumas limitações. O novo ChatGPT Voice pode apresentar sotaques não nativos e falhas na fluência em determinados idiomas. Adicionalmente, o uso do assistente em modo voz não será compatível com o compartilhamento de tela ou vídeo ativado no momento.

Seja o primeiro a receber notícias e cursos gratuitos