GLM-5.3 与 GLM-5.3-Flash(智谱 Z.ai)
智谱(Z.ai)的 GLM-5 系列最新成果包括两个核心模型:GLM-5.3(顶级旗舰,主打 Agent 与长程任务)和 GLM-5.3-Flash(320B-A18B MoE 架构,原生多模态,AA 综合智能指数 57 分追平 Claude Opus 4.8,价格仅 Opus 4.8 的 20%)。GLM-5.3-Flash 于 2026-08-26 晚由智谱正式认领——其前身就是社区热传的「Ox Alpha 牛来模型」。本报告涵盖两个模型,方便理解智谱的完整产品布局。
一、公司速览
智谱 AI
- 公司全称:北京智谱华章科技有限公司(Zhipu AI / Z.ai)
- 成立时间:2019 年
- 总部:北京
- 官网:zhipuai.cn / z.ai
- 海外品牌:Z.ai(面向国际市场)
- 定位:通用人工智能公司,自研 GLM 系列大模型
核心方向
- GLM(General Language Model) 系列自研大模型
- GLM-5.3 + GLM-5.3-Flash 是当前主力旗舰
- 兼容 7 大国产芯片:华为昇腾、摩尔线程、海光、寒武纪、昆仑芯、沐曦、燧原 来源
- 海外品牌 Z.ai 提供订阅服务 + 模型 API
二、产品矩阵
模型层(GLM-5 系列)
| 模型 | 发布时间 | 定位 |
|---|---|---|
| GLM-5.3-Flash | 2026-08-26 晚 | 最新开源模型,320B-A18B MoE,原生多模态,AA 57 分追平 Opus 4.8 来源 |
| GLM-5.3 | 2026-08 | 顶级旗舰,同基座纯后训练,主打 Agent + 长程任务 来源 |
| GLM-5.2 | 2026 春季 | 上代基座 |
| GLM-5 | 2026 早期 | 第五代基座 |
| GLM-4 系列 | 2024-2025 | 上一代系列 |
| 视觉模型 | 持续更新 | 多模态能力,30 万亿 token 多模态语料训练 来源 |
产品层
| 产品 | 定位 |
|---|---|
| Z.ai(智谱清言) | 对话产品,C 端入口 |
| GLM Coding Plan | 编程订阅服务 |
| Z.ai API | 模型 API,企业级调用 |
| BigModel 开放平台 | 智谱国内主品牌 |
三、GLM-5.3-Flash(最新模型,重点)
3.1 真实身份:Ox Alpha 牛来模型
GLM-5.3-Flash = 之前匿名的「Ox Alpha」(社区戏称「牛来模型」)
- 智谱为了收集真实用户反馈,把这个模型以 Ox Alpha 匿名身份在 OpenRouter、OpenCode 上做公测 来源
- 上线期间一举登顶并刷新 OpenRouter 双平台历史纪录来源
- 2026-08-26 晚智谱正式认领 来源
3.2 架构:320B-A18B MoE
| 参数 | 值 |
|---|---|
| 总参数 | 320B |
| 激活参数 | 18B |
| 架构 | MoE(混合专家) |
| 原生多模态 | ✅ 图片、视频、文件、文本 |
3.3 关键性能
| 评测 | 表现 |
|---|---|
| AA 综合智能指数(Artificial Analysis) | 57 分来源 |
| 对标对象 | 追平 Claude Opus 4.8来源 |
| 价格 | 仅为 Opus 4.8 的 20%(降 97.5%) 来源 |
| 对比 DeepSeek | 价格约为 DeepSeek 的一半 来源 |
意义:智能平权——用 Opus 4.8 20% 的价格获得同等的智能水平。
3.4 「同基座纯后训练」策略
GLM-5 系列(包括 GLM-5.3 和 GLM-5.3-Flash)的核心训练哲学:
- 不换基座,只做后训练
- 通过数十倍长程任务环境训练
- 智能上限大幅提升
- 训练成本低、迭代快
3.5 国产芯片推理
3.6 多模态输入支持
- 图片
- 视频
- 文件
- 文本
3.7 接入案例
金山办公灵犀专业版已经首发接入 GLM-5.3-Flash 来源。
四、GLM-5.3 顶级旗舰
4.1 技术路线:同基座、纯后训练
GLM-5.3 的最大特点是不换基座,只做后训练——这和主流大厂”换基座+后训练”路线不同。
- 优势:训练成本低、迭代快
- 效果:通过数十倍长程任务环境、超长后训练时间,让模型智能上限大幅提升 来源
4.2 开源协议
4.3 多模态预训练
最新视觉模型采用 30 万亿 token 多模态预训练语料——视觉能力不是外挂,而是在在 预训练阶段就把文本和视觉信息纳入统一模型 来源。
4.4 能力评测
| 基准 | GLM-5.2 | GLM-5.3 | 备注 |
|---|---|---|---|
| ExploitGym(2h) | 29 / 39 | 105 / 130 | 限时漏洞利用任务,开源 SOTA |
| ExploitGym(6h) | — | 130 / 247 | 闭源 Mythos 5: 181/247 |
| Agents’ Last Exam (CLI) | 23.8 | 28.5 | 开源第一 |
| GDPval-AA v2(44 职业) | — | 1,769 | Z.ai 评测中所有模型最高分 |
| Terminal-Bench 2.1 | — | 88.2 | 与闭源最前缘同水平 |
| Terminal Bench 3.0 | — | 开源第一 | 最新一代终端执行评测 来源 |
4.5 评测解读
- ExploitGym:考察模型在安全研究场景下限时找漏洞的能力——GLM-5.3 在 6 小时预算下能完成 130/247 个任务,离闭源最强只差 50 个
- Terminal-Bench 2.1 88.2 分:超过 GPT-5.5 的 82.7%、Claude Opus 4.7 的 69.4%,目前最强来源
- 长程任务能力:通过”数十倍长程任务环境”后训练,越往”利用链”上游走(更复杂的任务链),GLM-5.3 越强 来源
五、商业策略
5.1 GLM Coding Plan
2026 年推出,是智谱面向开发者的编程订阅服务 来源:
- 订阅制
- 包含 GLM-5.3 / GLM-5.3-Flash 等旗舰模型 API 配额
- 适合高频编码任务
5.2 海外品牌 Z.ai
- 服务海外用户
- 同样提供 GLM-5.3 等模型 API
- 美元结算,对标 OpenAI、Anthropic
5.3 价格策略(GLM-5.3-Flash 定价)
GLM-5.3-Flash 的「智能平权」定价 来源:
| 对标对象 | 价格对比 |
|---|---|
| Claude Opus 4.8 | Flash 仅为其 20%(降 97.5%) |
| DeepSeek | Flash 仅为其约一半 |
| 国产旗舰 | Flash 极具性价比 |
六、国内大模型横向对标
6.1 主流模型对比(2026 年 8 月)
| 模型 | 公司 | 上下文 | 开源 | 智能指数 | 价格优势 | Agent |
|---|---|---|---|---|---|---|
| GLM-5.3-Flash | 智谱 | 中长 | ✅ MIT | 57(追平 Opus 4.8) | 极致 | ⭐⭐⭐⭐ |
| GLM-5.3 | 智谱 | 中长 | ✅ MIT | 顶级 | 中等 | ⭐⭐⭐⭐⭐ |
| Doubao-Seed-Evolving | 字节 | 1M | ❌ | 75.5(SuperCLUE) | 低 | ⭐⭐⭐⭐⭐ |
| M3 | MiniMax | 1M | ✅ | 顶级 | 中等 | ⭐⭐⭐⭐⭐ |
| Kimi K3 | 月之暗面 | 4M | ✅ | 顶级 | 较高 | ⭐⭐⭐⭐⭐ |
| DeepSeek V4 | DeepSeek | 1M | ✅ MIT | 顶级 | 低 | ⭐⭐⭐⭐⭐ |
6.2 GLM-5.3 系列独特卖点
- GLM-5.3-Flash「智能平权」:Opus 4.8 同等智能、20% 价格 来源
- MIT 协议最宽松:商用、二次训练、修改、分发全开
- 海外 Z.ai 品牌接受度高
- 10 万张国产芯片承载:华为海光、摩尔线程等
- GLM-5.3 顶级旗舰:Terminal Bench 88.2 分全球领先
七、适合什么样的使用者
推荐用 GLM-5.3-Flash 的场景
- ✅ 极致成本成本敏感:Opus 4.8 20% 价格获得同等智能
- ✅ 需要原生多模态:图片、视频、文件、文本
- ✅ 海外业务:Z.ai 在国际市场接受度高
- ✅ 需要 MIT 协议:商用最自由
- ✅ 智能平权场景:让中小团队也能用上顶级智能
- ✅ 金山办公类生产力集成
推荐用 GLM-5.3 的场景
- ✅ 安全研究 / 漏洞分析:ExploitGym 表现突出
- ✅ 终端 / 命令行 Agent:Terminal Bench 88.2 分领先
- ✅ 需要二次训练:MIT 协议最自由
- ✅ 国产化部署:兼容 7 大国产芯片
- ✅ 海外业务:Z.ai 在国际市场接受度高
不太推荐用 GLM-5.3 系列的场景
- ❌ 需要 1M 超长上下文:Doubao Evolving / Kimi K3 更适合
- ❌ 极致顶级中文写作:MiniMax、Kimi 在中文场景可能更细腻
- ❌ 极致顶级代码生成 + 超长上下文:和 M3、K3 互有胜负
八、常见问题
Q1:GLM-5.3 和 GLM-5.3-Flash 是什么关系?
同一系列的两款模型:
| 模型 | 定位 | 关键差异 |
|---|---|---|
| GLM-5.3 | 顶级旗舰 | 主打 Agent + 长程任务,能力最强 |
| GLM-5.3-Flash | 开源最新 | 320B-A18B MoE,原生多模态,价格屠夫 |
两者共享 GLM-5 基座(“同基座纯后训练”策略)。
Q2:Ox Alpha 和 GLM-5.3-Flash 是什么关系?
Ox Alpha = GLM-5.3-Flash 的匿名马甲
- Ox Alpha 是智谱在 2026 年 8 月给 GLM-5.3-Flash 起的匿名代号
- 在 OpenRouter、OpenCode 上以匿名身份做公测
- 社区戏称「牛来模型」
- 2026-08-26 晚智谱正式认领 来源
Q3:GLM-5.3-Flash 真的能追平 Opus 4.8 吗?
在 AA 综合智能指数上是的:
但要记住:AA 57 分是综合评分,单项评测可能仍有差异。
Q4:GLM-5.3-Flash 的价格具体是多少?
公开数据:
Q5:MIT 协议意味着什么?
MIT 协议允许:
- ✅ 商用
- ✅ 修改
- ✅ 分发
- ✅ 私有使用
- 无需开源你的衍生作品
目前国产大模型里最宽松的协议之一。
Q6:智谱和 Z.ai 是什么关系?
- 智谱 AI(zhipuai.cn):中国主品牌
- Z.ai:面向海外市场的品牌
- 两者使用同一套 GLM 系列模型,API 接口略有不同
Q7:GLM-5.3 的 ExploitGym 强怎么解读?
ExploitGym 评测的是限时安全研究任务:给模型一个程序和漏洞描述,让它在限定时间内找出漏洞利用方法。GLM-5.3 在这个评测上开源第一,意味着它在自主探索+长链路推理上有独到优势。
九、延伸阅读
官方资源
Ox Alpha / GLM-5.3-Flash 相关
第三方分析
- 掘金深度技术解读
- 智谱认领 Pony Alpha 36kr
- Quasar Alpha - 匿名模型玩法汇总
- OX Alpha - 智谱最新匿名模型(含 GLM-5.3-Flash 真身)
十、一句话总结
智谱 GLM-5.3-Flash 是 2026 年「智能平权」维度的标杆——Ox Alpha 牛来模型的真实身份,AA 57 分追平 Claude Opus 4.8、320B-A18B MoE、原生多模态、价格仅 Opus 4.8 的 20%、10 万张国产芯片承载。MIT 协议、7 大国产芯片兼容、海外 Z.ai 品牌接受度高。如果你的项目需要顶级智能 + 极致性价比 + 原生多模态 + 国产化部署,GLM-5.3-Flash 是当前最值得认真考虑的国产开源模型。