A OpenAI disponibilizou o modelo ChatGPT Live-1 na sua API, permitindo que programadores integrem agentes de voz em aplicações e fluxos de trabalho empresariais por 0,05 USD por minuto na camada de voz. Este modelo, que estreou no ChatGPT em julho, consegue ouvir e falar em simultâneo, delegando tarefas de raciocínio mais complexo a modelos de backend como o GPT-6 Astra ou alternativas de terceiros.
Além disso, o lançamento representa uma evolução face às arquiteturas de voz tradicionais, que combinam reconhecimento de fala, um modelo de linguagem e síntese de voz, um processo em que cada transferência adiciona latência e pode prejudicar o ritmo da conversa. Por conseguinte, o GPT-Live-1 processa áudio de entrada e saída num único modelo, respondendo a interrupções e confirmações em tempo real, enquanto encaminha tarefas complexas para o backend.
Ganhos de desempenho e adoção precoce por empresas
De acordo com a OpenAI, o GPT-Live-1 registou uma melhoria de 30 pontos percentuais no benchmark Full Duplex Bench em relação ao GPT-Realtime-2.1, com a latência de troca de turnos a cair de 1,41 segundos para 0,798 segundos. Quando combinado com o GPT-6 Astra (esforço de raciocínio médio), o modelo ocupa o primeiro lugar no Tau3, um benchmark de inteligência para agentes de voz em tarefas de ponta a ponta, alcançando 86,2% de taxa de aprovação em cenários de atendimento ao cliente por voz, contra 45,7% do seu antecessor.
Neste contexto, várias empresas já integraram o modelo em produção. A Yelp anunciou a integração do GPT-Live-1 no Yelp Host, o seu assistente de voz para restaurantes, e no Hatch, plataforma de comunicação para empresas de serviços. O Yelp Host já realizou mais de um milhão de chamadas desde outubro de 2025, e os testes iniciais com o novo modelo mostraram melhores taxas de resolução de chamadas e menos transferências.
ChatGPT da OpenAI continua a apresentar recursos novos
Simultaneamente, a plataforma de aprendizagem de línguas Speak relatou uma redução de quase 80% nas interrupções durante pausas de reflexão dos utilizadores, em comparação com sistemas baseados em turnos anteriores.
Quanto à acessibilidade empresarial, os programadores podem combinar o GPT-Live-1 com o modelo de backend da sua escolha (a OpenAI sugeriu o Luna para tarefas de alto volume, como agendamentos, e o Astra para raciocínio complexo) pagando apenas a taxa de 0,05 USD por minuto na camada de voz, além dos custos padrão do backend. Para empresas, a OpenAI destacou o produto Presence, lançado em julho, que utiliza o GPT-Live-1 para alimentar agentes de voz através de um programa gerido, em vez de acesso self-service.
Fica ainda mais conectado:
- Galaxy Z Fold8 Ultra, Z Fold8 e Z Flip8: é simples mudar de smartphone
- Philips Baristina é a nova gama de máquinas de café em Portugal
- Razer Reclusa X Mini 65% é o novo teclado gaming mecânico por 69,99 €

