Qwen3.8-Omni-Flash explicado

Em 2026-09-26: a equipe Qwen da Alibaba lançou o Qwen3.8-Omni-Flash em 2026-09-18 — omni nativo (texto/imagem/áudio/vídeo entram, texto sai), contexto 1M. Para tirar capítulos de uma reunião ou vídeo longo, cole o link — você não precisa integrar a API omni sozinho.

Lançamento · 2026-09-18 Omni nativo · contexto 1M Teste abaixo

Get the notes, skip the omni API

Paste a long-form video or meeting URL — BibiGPT turns it into chapters, a transcript, and follow-up Q&A.

Adicionar BibiGPT como fonte preferida no Google Veja mais BibiGPT nas Principais notícias e nas respostas com IA.

Fatos-chave (leitura de 90 segundos)

Em 2026-09-26: a equipe Qwen da Alibaba lançou o Qwen3.8-Omni-Flash em 2026-09-18 — omni nativo (texto/imagem/áudio/vídeo→texto), contexto 1M, +26% em média vs Qwen3.5-Omni-Plus em 30 avaliações. Última atualização: 2026-09-26.

Features

O que é de fato o Qwen3.8-Omni-Flash

Em 2026-09-18, a equipe Qwen publicou o Qwen3.8-Omni-Flash: um modelo omni nativo que consome texto, imagem, áudio e vídeo e só devolve texto. Já está no Qwen AI e no Alibaba Cloud Model Studio. Não é o peso Flash-Next de texto de 2026-08-26.

Omni nativo: quatro entradas, saída de texto

A Qwen diz que o mesmo stack aceita texto, imagem, áudio e vídeo e escreve texto. Não é a mesma coisa que Qwen3.8-Flash (MoE texto/multimodal) nem Qwen3-ASR (só reconhecimento de fala).

Contexto 1M, saída máxima 131K

A documentação fixa janela de um milhão de unidades e saída máxima de 131K. Cabe a transcrição de uma reunião longa de uma vez. A janela larga não arquiva capítulos nem timestamps por você.

Benchmarks do fabricante vs Qwen3.5-Omni-Plus

A Qwen afirma +26% em média em 30 avaliações vs Qwen3.5-Omni-Plus, e AliMeeting DER / cpWER de 88.11 / 89.61 para 3.35 / 17.18. São números do fabricante, não testes do BibiGPT.

O que isso significa para quem trabalha com reuniões e vídeo longo

Uma API omni mais barata ajuda equipes que já usam Alibaba Cloud. Ela não entrega a um estudante notas com timestamp a partir de um upload de duas horas no Bilibili ou uma gravação de stand-up. Essa segunda metade é o produto BibiGPT.

Você não deveria cabear o Model Studio omni sozinho

Cole um link e receba capítulos, transcrição e Q&A de acompanhamento. O BibiGPT suporta Qwen3.8 Omni Flash para notas de conteúdo longo — você não precisa escolher a receita omni.

Pode ingerir áudio e vídeo; ainda precisa de um caderno

Colocar áudio e vídeo no modelo é útil. Uma reunião de noventa minutos ainda precisa de timestamps e exportação. Uma chamada barata que nunca arquiva é dinheiro jogado fora; o resumo com capítulos é o documento que você vai buscar na semana que vem.

Não é Qwen3.8-Flash nem Gemini 3.8 Flash

Qwen3.8-Flash é o MoE texto/multimodal de agosto. Gemini 3.8 Flash é o contraste da Google em áudio/vídeo no mesmo período. Qwen3-ASR é reconhecimento de fala. Esta página cobre só o evento Omni-Flash de 2026-09-18. Uma intenção, uma URL.

5 mudanças-chave (90 segundos)

Fatos centrais do lançamento Qwen3.8-Omni-Flash de 2026-09-18.

  1. 1

    Disponível em 2026-09-18 no Qwen AI e Model Studio

    A Qwen publicou Qwen3.8-Omni-Flash nesse dia no Qwen AI e Alibaba Cloud Model Studio (id DashScope qwen3.8-omni-flash). É um SKU omni gerenciado, não um drop de pesos Flash-Next open-source.

  2. 2

    Omni nativo: texto, imagem, áudio, vídeo→texto

    Um modelo aceita quatro entradas e escreve texto. Não é o mesmo trabalho que Qwen3.8-Flash (MoE texto/multimodal) nem Qwen3-ASR (reconhecimento de fala).

  3. 3

    Contexto 1M, saída máxima 131K

    A documentação da Qwen fixa janela de um milhão de unidades. O LiteLLM no mesmo dia lista saída máxima 131K. Uma reunião longa cabe em uma chamada; depois você ainda precisa de capítulos.

  4. 4

    Benchmarks do fabricante vs Qwen3.5-Omni-Plus e Gemini 3.8 Flash

    A Qwen afirma +26% em média em 30 avaliações, AliMeeting DER/cpWER 88.11/89.61 → 3.35/17.18, pontuações áudio/vídeo próximas ao Gemini 3.8 Flash. Números do fabricante, aqui para contexto.

  5. 5

    Preço internacional US$ 0,15 / US$ 0,47 por milhão de unidades

    O LiteLLM lista entrada US$ 0,15, cache US$ 0,016, saída US$ 0,47; entrada de vídeo ~89% mais barata que Qwen3.5-Omni-Plus. Confirme no Model Studio antes de orçar.

3 cenários típicos para usuários do BibiGPT

Onde o SKU omni nativo da Qwen importa — e onde o resumidor é o produto de verdade.

Você já ajusta o Model Studio sozinho

Usa Qwen3.8-Omni-Flash no seu stack para compreensão omni. Depois cola a aula ou o stand-up no BibiGPT para alguém receber capítulos, não um bloco de texto cru.

Você só quer notas de vídeo longo ou reunião

Um upload de duas horas no Bilibili ou uma gravação de stand-up não precisa de um briefing de API omni. Cole a URL, exporte transcrição, continue perguntando. Esse é o caminho BibiGPT.

Você compara os SKUs Qwen deste mês

Qwen3.8-Flash é o MoE texto de agosto. Qwen3-ASR é reconhecimento de fala. Gemini 3.8 Flash é o contraste áudio/vídeo da Google. Esta página é só Omni-Flash. Um evento da família de modelos, uma URL.

Ferramentas BibiGPT relacionadas

Fluxos de atas e notas de vídeo longo que combinam com este lançamento.

Fontes

As especificações desta página vêm do anúncio da Qwen de 2026-09-18 e da nota do LiteLLM no mesmo dia.

  • A Qwen lançou Qwen3.8-Omni-Flash em 2026-09-18: omni nativo (texto/imagem/áudio/vídeo→texto), contexto 1M, no Qwen AI e Alibaba Cloud Model Studio. A Qwen afirma +26% em média vs Qwen3.5-Omni-Plus em 30 avaliações, AliMeeting DER/cpWER 88.11/89.61 → 3.35/17.18.

    Qwen — Qwen3.8-Omni-Flash ↗
  • A nota do LiteLLM de 2026-09-18 lista id qwen3.8-omni-flash, contexto 1M, saída máxima 131K, preços internacionais US$ 0,15 / US$ 0,016 cache / US$ 0,47 por milhão de unidades, e entrada de vídeo ~89% mais barata que Qwen3.5-Omni-Plus.

    LiteLLM — Qwen3.8-Omni-Flash day-0 ↗

Termos nesta página

O que é um modelo omni nativo?

Um modelo omni nativo ingere vários meios no mesmo stack — aqui texto, imagem, áudio e vídeo — e devolve uma resposta de texto. Não é uma cadeia «primeiro ASR, depois modelo de texto». Qwen3.8-Omni-Flash na documentação é esse tipo de stack.

Para que serve a janela de contexto 1M em atas?

Um milhão de unidades permite, em princípio, colocar uma transcrição longa mais instruções em uma única chamada. Não gera capítulos, timestamps nem exportações buscáveis na semana que vem. Isso é trabalho do produto de notas.

Adorado por criadores, estudantes e pesquisadores

Por que as pessoas usam o BibiGPT todos os dias para transformar vídeos em texto.

Mais de 50.000 usuários no mundo todo confiam

★★★★★

“Colo um link e recebo legendas limpas em segundos — economizo horas de redigitação toda semana.”

Maya R.

Criadora de conteúdo · Reaproveita vídeos curtos

★★★★★

“Exportar a transcrição me deixa revisar palavras novas no meu ritmo, sem pausar o vídeo o tempo todo.”

Daniel K.

Estudante de idiomas · Estuda com vídeos reais

★★★★★

“Texto preciso e com marcação de tempo que posso citar diretamente. Sem perceber, virou parte do meu fluxo diário.”

Priya S.

Pesquisadora · Cita palestras públicas

Perguntas frequentes

Tire qualquer dúvida.

Popular guides

Pule a API omni e pegue as anotações

Cole um link do YouTube, Bilibili, podcast ou reunião. O BibiGPT devolve capítulos, transcrição e Q&A de acompanhamento. Última atualização: 2026-09-26.