Qwen3.8-Omni-Flash explicado

Al 2026-09-26: el equipo Qwen de Alibaba lanzó Qwen3.8-Omni-Flash el 2026-09-18 — omni nativo (texto/imagen/audio/video entran, texto sale), contexto 1M. Para sacar capítulos de una reunión o un video largo, pega el enlace — no tienes que conectar tú la API omni.

Lanzamiento · 2026-09-18 Omni nativo · contexto 1M Prueba abajo

Get the notes, skip the omni API

Paste a long-form video or meeting URL — BibiGPT turns it into chapters, a transcript, and follow-up Q&A.

Añade BibiGPT como fuente preferida en Google Verás más BibiGPT en Noticias destacadas y en las respuestas con IA.

Hechos clave (lectura de 90 segundos)

Al 2026-09-26: el equipo Qwen de Alibaba lanzó Qwen3.8-Omni-Flash el 2026-09-18 — omni nativo (texto/imagen/audio/video→texto), contexto 1M, +26% de media frente a Qwen3.5-Omni-Plus en 30 evaluaciones. Última actualización: 2026-09-26.

Features

Qué es realmente Qwen3.8-Omni-Flash

El 2026-09-18, el equipo Qwen publicó Qwen3.8-Omni-Flash: un modelo omni nativo que consume texto, imagen, audio y video y solo devuelve texto. Ya está en Qwen AI y Alibaba Cloud Model Studio. No es el peso Flash-Next de texto del 2026-08-26.

Omni nativo: cuatro entradas, salida de texto

Qwen dice que el mismo stack acepta texto, imagen, audio y video y escribe texto. No es lo mismo que Qwen3.8-Flash (MoE texto/multimodal) ni Qwen3-ASR (solo reconocimiento de voz).

Contexto 1M, salida máxima 131K

La documentación fija una ventana de un millón de unidades y salida máxima de 131K. Cabe la transcripción de una reunión larga de una sola vez. La ventana ancha no archiva capítulos ni marcas de tiempo por ti.

Benchmarks del fabricante vs Qwen3.5-Omni-Plus

Qwen afirma +26% de media en 30 evaluaciones frente a Qwen3.5-Omni-Plus, y AliMeeting DER / cpWER de 88.11 / 89.61 a 3.35 / 17.18. Son cifras del fabricante, no pruebas de BibiGPT.

Qué implica si trabajas con reuniones y video largo

Una API omni más barata ayuda a equipos que ya usan Alibaba Cloud. No le entrega a un estudiante notas con marcas de tiempo desde un upload de dos horas en Bilibili o una grabación de stand-up. Esa segunda mitad es el producto BibiGPT.

No deberías cablear Model Studio omni tú solo

Pega un enlace y obtén capítulos, transcripción y Q&A de seguimiento. BibiGPT admite Qwen3.8 Omni Flash para notas de contenido largo — no tienes que elegir la receta omni.

Puede ingerir audio y video; aún necesitas un cuaderno

Meter audio y video en el modelo es útil. Una reunión de noventa minutos sigue necesitando marcas de tiempo y exportación. Una llamada barata que nunca archiva es dinero tirado; el resumen con capítulos es el documento que podrás buscar la semana que viene.

No es Qwen3.8-Flash ni Gemini 3.8 Flash

Qwen3.8-Flash es el MoE texto/multimodal de agosto. Gemini 3.8 Flash es el contraste de Google en audio/video del mismo periodo. Qwen3-ASR es reconocimiento de voz. Esta página cubre solo el evento Omni-Flash del 2026-09-18. Una intención, una URL.

5 cambios clave (90 segundos)

Hechos centrales del lanzamiento Qwen3.8-Omni-Flash del 2026-09-18.

  1. 1

    Disponible el 2026-09-18 en Qwen AI y Model Studio

    Qwen publicó Qwen3.8-Omni-Flash ese día en Qwen AI y Alibaba Cloud Model Studio (id DashScope qwen3.8-omni-flash). Es un SKU omni gestionado, no un drop de pesos Flash-Next open-source.

  2. 2

    Omni nativo: texto, imagen, audio, video→texto

    Un modelo acepta cuatro entradas y escribe texto. No es el mismo trabajo que Qwen3.8-Flash (MoE texto/multimodal) ni Qwen3-ASR (reconocimiento de voz).

  3. 3

    Contexto 1M, salida máxima 131K

    La documentación de Qwen fija ventana de un millón de unidades. LiteLLM el mismo día lista salida máxima 131K. Una reunión larga cabe en una llamada; después aún necesitas capítulos.

  4. 4

    Benchmarks del fabricante vs Qwen3.5-Omni-Plus y Gemini 3.8 Flash

    Qwen afirma +26% de media en 30 evaluaciones, AliMeeting DER/cpWER 88.11/89.61 → 3.35/17.18, puntuaciones audio/video cercanas a Gemini 3.8 Flash. Cifras del fabricante, aquí para contexto.

  5. 5

    Precio internacional $0.15 / $0.47 por millón de unidades

    LiteLLM lista entrada $0.15, caché $0.016, salida $0.47; entrada de video ~89% más barata que Qwen3.5-Omni-Plus. Confirma en Model Studio antes de presupuestar.

3 escenarios típicos para usuarios de BibiGPT

Dónde importa el SKU omni nativo de Qwen — y dónde el resumidor es el producto real.

Ya ajustas Model Studio tú mismo

Usas Qwen3.8-Omni-Flash en tu stack para comprensión omni. Luego pegas la clase o el stand-up en BibiGPT para que alguien reciba capítulos, no un bloque de texto crudo.

Solo quieres notas de un video largo o una reunión

Un upload de dos horas en Bilibili o una grabación de stand-up no necesita un informe de API omni. Pega la URL, exporta transcripción, sigue preguntando. Ese es el camino BibiGPT.

Comparas los SKU Qwen de este mes

Qwen3.8-Flash es el MoE texto de agosto. Qwen3-ASR es reconocimiento de voz. Gemini 3.8 Flash es el contraste audio/video de Google. Esta página es solo Omni-Flash. Un evento de familia de modelos, una URL.

Herramientas BibiGPT relacionadas

Flujos de actas y notas de video largo que encajan con este lanzamiento.

Fuentes

Las especificaciones de esta página vienen del anuncio de Qwen del 2026-09-18 y la nota de LiteLLM del mismo día.

  • Qwen lanzó Qwen3.8-Omni-Flash el 2026-09-18: omni nativo (texto/imagen/audio/video→texto), contexto 1M, en Qwen AI y Alibaba Cloud Model Studio. Qwen afirma +26% de media frente a Qwen3.5-Omni-Plus en 30 evaluaciones, AliMeeting DER/cpWER 88.11/89.61 → 3.35/17.18.

    Qwen — Qwen3.8-Omni-Flash ↗
  • La nota de LiteLLM del 2026-09-18 lista id qwen3.8-omni-flash, contexto 1M, salida máxima 131K, precios internacionales $0.15 / $0.016 caché / $0.47 por millón de unidades, y entrada de video ~89% más barata que Qwen3.5-Omni-Plus.

    LiteLLM — Qwen3.8-Omni-Flash day-0 ↗

Términos en esta página

¿Qué es un modelo omni nativo?

Un modelo omni nativo ingiere varios medios en el mismo stack — aquí texto, imagen, audio y video — y devuelve una respuesta de texto. No es una cadena «primero ASR, luego modelo de texto». Qwen3.8-Omni-Flash en la documentación es ese tipo de stack.

¿Para qué sirve la ventana de contexto 1M en actas?

Un millón de unidades permite, en principio, meter una transcripción larga más instrucciones en una sola llamada. No genera capítulos, marcas de tiempo ni exportaciones buscables la semana que viene. Eso es trabajo del producto de notas.

Preferido por creadores, estudiantes e investigadores

Por qué la gente usa BibiGPT cada día para convertir vídeos en texto.

Más de 50 000 usuarios en todo el mundo confían en nosotros

★★★★★

“Pego un enlace y obtengo subtítulos limpios en segundos: me ahorra horas de transcripción cada semana.”

Maya R.

Creadora de contenido · Reutiliza vídeos cortos

★★★★★

“Exportar la transcripción me permite repasar vocabulario a mi ritmo en lugar de pausar el vídeo constantemente.”

Daniel K.

Estudiante de idiomas · Estudia con vídeos reales

★★★★★

“Texto preciso con marcas de tiempo que puedo citar directamente. Sin darme cuenta, ya es parte de mi rutina diaria.”

Priya S.

Investigadora · Cita charlas públicas

Preguntas frecuentes

Resolvemos cualquier duda.

Popular guides

Salta la API omni y llévate las notas

Pega un enlace de YouTube, Bilibili, podcast o reunión. BibiGPT devuelve capítulos, transcripción y Q&A de seguimiento. Última actualización: 2026-09-26.