GPT-Live-1 explicado — Voz full-duplex, não um motor de resumo

Resumo — Em 2026-09-15, a OpenAI colocou o GPT-Live-1 na API em 2026-09-10: ouve e fala ao mesmo tempo, turnos de ~0,8s vs ~1,4s no GPT-Realtime-2.1, US$ 0,05 por minuto na camada de voz front-end. Mantém a conversa. Não arquiva o que a reunião da semana passada decidiu.

Evento · 2026-09-10 Full duplex Teste abaixo

File the recap. Keep the live call.

Paste a podcast, lecture, or meeting URL — BibiGPT turns it into chapters, a transcript, and follow-up Q&A.

Adicionar BibiGPT como fonte preferida no Google Veja mais BibiGPT nas Principais notícias e nas respostas com IA.

Fatos-chave (leitura de 90 segundos)

Em 2026-09-15, a OpenAI colocou o GPT-Live-1 na API em 2026-09-10: voz full-duplex, turnos de 0,798s vs 1,41s no GPT-Realtime-2.1, US$ 0,05/min na camada front-end. O raciocínio mais profundo é delegado. É um produto de conversa ao vivo, não um motor de resumo.

Features

O que a OpenAI lançou em 2026-09-10

Números públicos do anúncio da API e da documentação para desenvolvedores da OpenAI — não uma alegação de que o BibiGPT roda este modelo.

Full duplex: ouvir enquanto fala

O GPT-Live-1 raciocina sobre o áudio de entrada e de saída em um único modelo. Quem liga pode interromper, fazer backchannel ou mudar de direção sem a pausa de um walkie-talkie. Isso é uma chamada ao vivo, não um resumo.

Turnos de ~0,8s, US$ 0,05/min front-end

A OpenAI reporta turnos de 0,798 segundos vs 1,41 segundos no GPT-Realtime-2.1. A camada de voz custa US$ 0,05 por minuto, cobrada por segundo. Modelos backend e ferramentas são cobrados à parte.

12 vozes, só áudio e texto

Vozes de lançamento: Quartz, Ripple, Vesper, Willow, Stone, Gleam, Meridian, Bossa, Tempo, Beacon, Delta, Cinder. Entradas e saídas são áudio e texto. A entrada de imagem da linha Realtime não está nesta ficha.

Por que uma camada de voz ao vivo ainda deixa um buraco de notas

Uma interrupção mais fluida não coloca timestamp na decisão da semana passada. O trabalho de conhecimento ainda precisa de um arquivo que você possa buscar na próxima terça.

Falar ao vivo não é um arquivo pesquisável

O GPT-Live-1 mantém a conversa enquanto um backend consulta coisas. Depois da chamada, você ainda precisa de capítulos, uma transcrição e uma citação que consiga achar de novo. Esse trabalho é assíncrono.

Reuniões já comem ~30% da semana

Laxis State of Meetings 2026: knowledge workers passam por 21,7 reuniões por semana, cerca de 30% da semana de trabalho. Um turno mais rápido não reduz essa pilha. Um resumo com timestamps reduz.

Podcasts são limitados por tempo, não por oferta

Edison Infinite Dial 2026: ouvintes de podcast nos EUA têm média de 8 horas e 24 minutos por semana em 6,8 shows. Os episódios que sobram precisam de uma mesa de triagem, não de outra voz ao vivo. Um resumo decide qual hora vale a pena ouvir.

5 mudanças-chave (leitura de 90 segundos)

Mudanças principais do lançamento da API GPT-Live-1 da OpenAI em 2026-09-10.

  1. 1

    Full duplex em vez de turnos

    Um único modelo raciocina sobre o áudio de entrada e de saída juntos. Interrupções, pausas e backchannels ficam na mesma sessão. O GPT-Realtime-2.1 esperava o turno terminar.

  2. 2

    Turnos de ~0,8s, interatividade 80,1%

    A OpenAI reporta turnos de 0,798s vs 1,41s no GPT-Realtime-2.1, e interatividade 80,1% no Full Duplex Bench v1.5 vs 45,4%. Esses scores são as evals da OpenAI, reafirmadas aqui, não um teste que rodamos.

  3. 3

    US$ 0,05/min front-end; backend à parte

    Sessões de voz custam US$ 0,05 por minuto, cobradas por segundo. Raciocínio mais profundo e ferramentas vão para um backend que você escolhe e paga à parte. O preço de lista é da OpenAI, não um SKU do BibiGPT.

  4. 4

    12 vozes; só áudio e texto

    Quartz, Ripple, Vesper, Willow, Stone, Gleam, Meridian, Bossa, Tempo, Beacon, Delta, Cinder. Transcrições ASR nativas e texto de resposta. Sem entrada de imagem ou vídeo nesta ficha.

  5. 5

    Delegação, não um arquivo de resumo

    O GPT-Live-1 pode continuar falando enquanto um backend consulta um pedido ou executa uma ferramenta. Depois da sessão, você ainda precisa de capítulos e uma transcrição que consiga buscar na semana que vem. Esse é o caminho do BibiGPT, não uma integração do GPT-Live-1.

3 cenários típicos para usuários do BibiGPT

Onde uma camada de voz ao vivo ajuda — e onde um fluxo de notas ainda faz o trabalho.

Você apresenta ou edita um podcast semanal

Ouvintes nos EUA têm média de 8 horas e 24 minutos por semana em 6,8 shows (Edison Infinite Dial 2026). Uma API de voz ao vivo não faz a triagem do backlog. Gere capítulos primeiro, depois decida qual hora vale a pena ouvir completa.

Você passa por mais de 20 reuniões por semana

Laxis 2026: 21,7 reuniões por semana, cerca de 30% da semana de trabalho. Uma interrupção de 0,8 segundos é útil na chamada. Na próxima terça você ainda precisa da frase que foi decidida. Arquive a gravação; busque na transcrição.

Você já tem uma gravação de aula

Cole a URL. Pegue capítulos antes de dar play, pule para um timestamp, exporte Markdown. O GPT-Live-1 não precisa estar no circuito. O fluxo de notas já roda nos arquivos que você tem.

Páginas relacionadas do BibiGPT

O fluxo de notas é o produto. O blog tem o método longo. Esta página tem o evento.

Fontes

As alegações de lançamento vêm do anúncio da OpenAI e de cobertura independente. Última atualização 2026-09-15. Não é uma alegação de integração.

O que é o GPT-Live-1?

O que é o GPT-Live-1?

O GPT-Live-1 é a API de voz full-duplex da OpenAI, liberada para desenvolvedores em 2026-09-10. Full duplex significa que o modelo ouve e fala ao mesmo tempo, como uma ligação telefônica e não como um walkie-talkie. Ele cuida do turno ao vivo. Não arquiva um resumo pesquisável da chamada.

Adorado por criadores, estudantes e pesquisadores

Por que as pessoas usam o BibiGPT todos os dias para transformar vídeos em texto.

Mais de 50.000 usuários no mundo todo confiam

★★★★★

“Colo um link e recebo legendas limpas em segundos — economizo horas de redigitação toda semana.”

Maya R.

Criadora de conteúdo · Reaproveita vídeos curtos

★★★★★

“Exportar a transcrição me deixa revisar palavras novas no meu ritmo, sem pausar o vídeo o tempo todo.”

Daniel K.

Estudante de idiomas · Estuda com vídeos reais

★★★★★

“Texto preciso e com marcação de tempo que posso citar diretamente. Sem perceber, virou parte do meu fluxo diário.”

Priya S.

Pesquisadora · Cita palestras públicas

Perguntas frequentes

Tire qualquer dúvida.

Popular guides

Fique com a chamada ao vivo. Arquive o resumo.

Cole um podcast, uma aula ou uma gravação de reunião no BibiGPT. Você recebe capítulos, uma transcrição pesquisável e Q&A de acompanhamento. O GPT-Live-1 cuida da interrupção. As notas ainda precisam de um timestamp.