← Tecnologia
Tecnologia

OpenAI lança novo modelo de voz para deixar ChatGPT mais humano e natural

Os modelos GPT-Live têm arquitetura “full-duplex”, podendo ouvir e falar simultaneamente, sem interromper o usuário

OpenAI lança novo modelo de voz para deixar ChatGPT mais humano e natural
Resumo
  • A OpenAI lançou a família de modelos GPT-Live para o ChatGPT Voice, permitindo interações de voz em tempo real mais naturais.
  • Os modelos GPT-Live têm arquitetura “full-duplex”, podendo ouvir e falar simultaneamente, sem interromper o usuário.
  • O GPT-Live delega tarefas complexas ao GPT-5.5, possibilitando conversas mais fluídas e respostas aprimoradas.

A OpenAI anunciou, nesta quarta-feira (08/07), a família de modelos GPT-Live, que será responsável pelo ChatGPT Voice, como é chamada a ferramenta de conversa por voz em tempo real com o ChatGPT. A promessa da empresa é que as interações passem mais a sensação de um bate-papo real.

Inicialmente, serão duas versões: GPT-Live-1 e GPT-Live-1 mini. A primeira será usada nas versões pagas do ChatGPT, enquanto usuários de planos gratuitos terão acesso ao modelo simplificado. A novidade terá uma liberação gradual no mundo todo a partir desta quarta (08/07) e estará disponível na web, iOS e Android.

Leia no AINotícia: Tecnologia: Panorama da Semana – GPT-5.6, Crise de Memória e Novidades do Gmail

O que muda com o GPT-Live?

Ilustração com o logo do ChatGPT ao centro. Na parte inferior direita, o logotipo do "tecnoblog" é visível.
GPT-5.5 vai ficar encarregado de tarefas “pesadas” (ilustração: Vitor Pádua/Tecnoblog)

Os modelos GPT-Live contam com arquitetura “full-duplex”, o que significa que eles podem ouvir e falar ao mesmo tempo. A OpenAI explica que essa técnica permite tomar decisões de interação diversas vezes por segundo. Leia também: Hora de economizar: selecionamos os melhores iPhones Apple em promoção na Amazon

Graças a essa tecnologia, um dos diferenciais do GPT-Live é a capacidade de não interromper o usuário quando ele para e pensa durante uma fala, bem como identificar pequenos sinais da fala, como aquele “hmmm” que fazemos durante um raciocínio. A própria inteligência artificial pode pedir um tempo para buscar informações ou raciocinar antes de dar uma resposta.

Quais são as novidades do ChatGPT Voice?

O GPT-Live é capaz de acionar recursos de busca na web, raciocínio ou processamento complexo. Ao identificar que tais tarefas são necessárias, ele as delega ao GPT-5.5, mais recente modelo multimodal da OpenAI. Enquanto o “colega” faz o trabalho, o GPT-Live pode seguir conversando com o usuário.

Com isso, a OpenAI promete conversas mais naturais, com respostas melhores, audição aprimorada e resultados visuais. O ChatGPT Voice também tem três níveis de inteligência: quanto mais poder de raciocínio, maior o tempo necessário para dar uma resposta.

Em uma das demonstrações feitas pela OpenAI, o GPT-Live-1 funcionou como um intérprete, traduzindo instantaneamente para o hindi o que era dito em inglês. No material de divulgação, também há exemplos de respostas visuais para pedidos de previsão do tempo, jogos da Copa do Mundo e mapas. Mais de tecnologia

Apesar dos avanços, há também limitações. A OpenAI avisa que o novo ChatGPT Voice pode ter sotaque não-nativo e falhas na fluência em alguns idiomas. Além disso, não será possível usar o assistente em modo voz com o compartilhamento de tela ou vídeo ativado. Leia também: Caiu aí? ChatGPT fica fora do ar nesta quarta-feira (19)

Relacionados

OpenAI anuncia aposentadoria de modelos antigos do ChatGPT
OpenAI lança GPT-5.2 em tempo recorde e esquenta disputa com Gemini 3
GPT-5.4 chega com capacidade nativa de usar computadores

Responde

O que é a OpenAI? Conheça a história e os fundadores da criadora do ChatGPT
ChatGPT: o que é, para que serve e como funciona a tecnologia de IA generativa
O que é NLP? Saiba como funciona o Processamento de Linguagem Natural
Como mudar a voz no Discord [Text-to-Speech]

Escrito

Giovanni Santa Rosa

Giovanni Santa Rosa

Repórter

Giovanni Santa Rosa é formado em jornalismo pela ECA-USP e cobre ciência e tecnologia desde 2012. Foi editor-assistente do Gizmodo Brasil e escreveu para o UOL Tilt e para o Jornal da USP. Cobriu o Snapdragon Tech Summit, em Maui (EUA), o Fórum Internacional de Software Livre, em Porto Alegre (RS), e a Campus Party, em São Paulo (SP). Atualmente, é autor no Tecnoblog.

Hora de economizar: selecionamos os melhores iPhones Apple em promoção na Amazon
Tecnologia

Hora de economizar: selecionamos os melhores iPhones Apple em promoção na Amazon

Ler matéria →

Leia também