GLM-5.3-Flash 解读——Ox Alpha 正名,不是复盘引擎

要点:截至 2026-10-09,Z.ai 于 2026-08-26 发布 GLM-5.3-Flash。隐身预览 Ox Alpha 就是这个模型。它接收文字、图片和视频,输出文字,上下文 1,048,576。Z.ai 标价百万输入 $0.15、百万输出 $0.50。推理始终开启。它是编程与长任务模型。它不会把长视频归档成可搜索的复盘。

发布 · 2026-08-26 百万输入 $0.15 / 百万输出 $0.50 下方可试用

File the recap. Keep the model card.

Paste a podcast, lecture, or meeting URL — BibiGPT turns it into chapters, a transcript, and follow-up Q&A.

把 BibiGPT 设为 Google 优先来源 在热门报道和 AI 概览里看到更多 BibiGPT。

核心事实(90 秒速读)

截至 2026-10-09,Z.ai 于 2026-08-26 发布 GLM-5.3-Flash。Ox Alpha 就是这个模型。文字、图片和视频进,文字出,上下文 1,048,576。Z.ai 标价每百万字 $0.15 / $0.50。推理始终开启。面向编程和长任务,不是总结引擎。

Features

Z.ai 在 2026-08-26 实际发布了什么

公开事实来自 GLM-5.3-Flash 模型卡片,不是「BibiGPT 由这个模型运行」的声明。

Ox Alpha 就是这个模型

名为 Ox Alpha 的隐身预览,后来公开为 Z.ai 的 GLM-5.3-Flash。正名发布日是 2026-08-26。旧名字下的免费预览已经结束。

文字、图片、视频进,文字出

GLM-5.3-Flash 是原生多模态模型。它接收文字、图片和视频,输出文字。上下文窗口是 1,048,576。推理始终开启、不能关掉;默认力度是 max。

Z.ai 标价每百万字 $0.15 / $0.50

截至 2026-10-09 的公开模型卡片,Z.ai 标价百万输入 $0.15、百万输出 $0.50。其他托管方标价不同,有的低于这张牌价打折。那是托管方价格,不是 BibiGPT 的套餐。

长上下文模型仍然留着笔记缺口

编程和长任务模型不会给上周的讲座打时间戳。知识工作仍然需要一份下周二还能搜到的文件。

模型卡片不是可搜索的档案

GLM-5.3-Flash 被定位为高效编程和长程任务。录音已经存在之后,你仍然需要章节、文字稿,以及下次还能找到的那句话。这件事是事后做的。

会议已经吃掉大约 30% 的一周

Laxis《2026 会议现状》:知识工作者每周 21.7 场会议,大约占工作周的 30%。更低的调用价格不会把这堆会议变小。带时间戳的复盘会。

播客缺的是时间,不是供给

Edison Infinite Dial 2026:美国播客听众平均每周听 8 小时 24 分钟,关注 6.8 档节目。听不完的节目需要分诊台,不需要再一张模型卡片。总结决定哪一小时值得完整听完。

5 个关键事实(90 秒速读)

来自 GLM-5.3-Flash 公开模型卡片的标题事实,核对日 2026-10-09。

  1. 1

    2026-08-26 发布

    Z.ai 以正式名称发布 GLM-5.3-Flash。公开卡片上的模型 id:z-ai/glm-5.3-flash。

  2. 2

    Ox Alpha 就是这个模型

    隐身预览 Ox Alpha 后来公开为 GLM-5.3-Flash。旧名字下的免费预览已经结束。

  3. 3

    文字、图片和视频进

    原生多模态输入,文字输出,上下文 1,048,576。推理始终开启、不能关闭。默认力度是 max。

  4. 4

    Z.ai 标价 $0.15 / $0.50

    截至 2026-10-09,Z.ai 标价百万输入 $0.15、百万输出 $0.50。其他托管方标价不同,含折扣。那是托管方价格,不是 BibiGPT 套餐。

  5. 5

    长任务模型,再加上笔记流程

    卡片把 GLM-5.3-Flash 定位为高效编程和长程任务。讲座或播客已经是文件之后,你仍然需要下周还能搜到的章节。那是 BibiGPT 的路径,不是 GLM-5.3-Flash 接入。

BibiGPT 用户的 3 个典型场景

长上下文模型帮得上的地方,以及笔记流程仍然要自己做的地方。

你在做一档周播客

美国听众平均每周听 8 小时 24 分钟,关注 6.8 档节目(Edison Infinite Dial 2026)。模型卡片不会给积压分诊。先生成章节,再决定哪一小时值得完整听完。

你一周要开 20 场以上的会

Laxis 2026:每周 21.7 场会,大约占工作周 30%。更低的调用价格对知识工作有用。下周二你仍然需要当时定下来的那句话。把录音归档,再搜文字稿。

讲座录音已经在手里

贴上链接。按下播放之前先拿到章节,跳到时间戳,导出 Markdown。GLM-5.3-Flash 不必在这条链路里。笔记流程处理的是你已经拥有的文件。

相关的 BibiGPT 页面

笔记流程才是产品。这一页只负责 2026-08-26 这次发布。

来源

发布说法来自公开模型卡片。最后更新 2026-10-09。不是接入声明。

GLM-5.3-Flash 是什么?

GLM-5.3-Flash 是什么?

GLM-5.3-Flash 是 Z.ai 于 2026-08-26 发布的原生多模态模型。隐身预览 Ox Alpha 就是它。它接收文字、图片和视频,输出文字,上下文 1,048,576。

深受创作者、学生和研究人员的喜爱

看看大家为什么每天都用 BibiGPT 把视频转成文字。

全球 50,000+ 用户的信赖之选

★★★★★

“贴上链接几秒钟就拿到干净的字幕文字,每周帮我省下好几个小时的手动整理时间。”

Maya R.

内容创作者 · 二次创作短视频

★★★★★

“导出逐字稿后我可以按自己的节奏复习生词,再也不用反复暂停视频了。”

Daniel K.

语言学习者 · 用真实视频学外语

★★★★★

“准确、带时间戳的文字可以直接引用,它已经悄悄成为我日常工作流的一部分。”

Priya S.

研究人员 · 引用公开演讲

常见问题解答

有问题?问我们!

热门文章

模型卡片留给它。复盘归档留给笔记。

把播客、讲座或会议录音贴进 BibiGPT。你得到章节、可搜索文字稿和追问。GLM-5.3-Flash 是 Z.ai 面向编程和长任务的多模态模型。笔记仍然需要时间戳。