• Home
  • Tecnologia
  • OpenAI lança modelos de áudio para tarefas de voz em tempo real
Ícone do aplicativo ChatGPT exibido na tela de um smartphone

OpenAI lança modelos de áudio para tarefas de voz em tempo real

A OpenAI apresentou, nesta quinta-feira (7), três modelos de áudio para sua plataforma de desenvolvedores, com o objetivo de tornar agentes de software baseados em voz mais conversacionais e capazes de completar tarefas em tempo real.

O lançamento da interface de programação de aplicações (API, na sigla em inglês) leva a criadora do ChatGPT além da transcrição e chat, direcionando para agentes que podem ouvir, traduzir e agir durante conversas ao vivo.

  • Os novos modelos são GPT-Realtime-2, GPT-Realtime-Translate e GPT-Realtime-Whisper, disponíveis para teste no playground de desenvolvedores da OpenAI;
  • O GPT-Realtime-2 foi projetado para gerenciar solicitações mais complexas, chamar ferramentas, lidar com interrupções e manter contexto em sessões de voz mais longas;
  • O segundo modelo suporta tradução de mais de 70 idiomas para 13 idiomas de saída, direcionado para suporte ao cliente, educação e outros ambientes;
  • O GPT-Realtime-Whisper fornece conversão de fala para texto ao vivo, permitindo que legendas, notas de reuniões e atualizações de fluxo de trabalho sejam geradas enquanto o palestrante fala.
Novos modelos são GPT-Realtime-2, GPT-Realtime-Translate e GPT-Realtime-Whisper, disponíveis para teste no playground de desenvolvedores da OpenAI – Imagem: Primakov/Shutterstock

Leia mais:

Clientes da OpenAI e preços dos novos modelos

Entre os clientes testando os modelos estão o marketplace imobiliário online Zillow, a agência de viagens online Priceline e a empresa europeia de telecomunicações Deutsche Telekom. Os preços do GPT-Realtime-2 começam em US$ 32 (R$ 158,26) por milhão de tokens de entrada de áudio, o GPT-Realtime-Translate custa US$ 0,034 (R$ 0,17) por minuto e o GPT-Realtime-Whisper US$ 0,017 (R$ 0,084) por minuto.

GPT-Fone? Rumores sobre celular da OpenAI estão aumentando

OpenAI pode estar desenvolvendo seu primeiro produto de hardware: um smartphone voltado ao ChatGPT. De acordo com o analista de cadeia de suprimentos Ming-Chi Kuo, o projeto está sendo acelerado, com previsão de início da produção em massa no começo de 2027.

Leia a matéria completa aqui

O post OpenAI lança modelos de áudio para tarefas de voz em tempo real apareceu primeiro em Olhar Digital.

Related Posts

Confira o Olhar Digital News na íntegra (01/07/2026)

Veja os destaques do Olhar Digital News desta quarta-feira: Cientistas desenvolvem célula sintética que se reproduz sozinha Cientistas…

PorByME tec jul 2, 2026

Resultado da Lotofácil de hoje: veja números e ganhadores do concurso 3724 (quarta, 1º/07)

Quer saber resultados de todas as loterias? Clique aqui! O sorteio do concurso 3724 da Lotofácil acontece na noite da quarta-feira (1º), às 21h.…

PorByME tec jul 2, 2026

Fire TV Stick, Roku e mais: uma seleção de ofertas para turbinar seu streaming

Se você ainda usa o streaming direto pela Smart TV sem nenhum dispositivo externo, talvez esteja perdendo desempenho…

PorByME tec jul 2, 2026

Olhar do Amanhã: IA vira policial e denuncia crime para autoridades

A Polícia Civil do Espírito Santo prendeu preventivamente um homem de 36 anos que usou o ChatGPT para…

PorByME tec jul 2, 2026