GLM-5.3
⚠️ 2026-10-01 核实更正:本笔记此前有四处错误,已全部修正——
- 参数记错:GLM-5.3 是 744B 总 / 40B 激活(沿用 GLM-5.2 基座),此前记的 320B/18B 其实是 GLM-5.3-Flash 的参数
- 多模态归属错:GLM-5.3 仅支持文本,「GLM-5 系列首个原生多模态」指的是 GLM-5.3-Flash
- 定价全部过期:美元价已改为人民币,且 Flash 五折促销已于 2026-09-09 结束
- 能力描述夸大:官方明确 GLM-5.3 与 Claude Fable 5 仍有差距(Max 档 34.5% vs 39.5%)
产品介绍
GLM-5.3 是智谱 AI(Zhipu AI)2026 年 8 月发布的最新旗舰模型,8 月 19 日开放 API。它使用与 GLM-5.2 相同的基础模型,所有提升均来自后训练——不是新基座。
核心规格
| 项目 | 数值 |
|---|---|
| 模态 | ⚠️ 仅文本(不含图像/音频) |
| 上下文窗口 | 1M tokens |
| 最大输出 | 128K tokens |
| 总参数量 | 744B |
| 激活参数 | 40B |
| 思考模式 | 始终启用,不支持关闭 |
| 思考强度 | low / high / max(默认 max) |
| API 端点 | OpenAI Chat Completion:open.bigmodel.cn/api/paas/v4;OpenAI Response:/api/v1;Anthropic Message:/api/anthropic |
迁移提示:从 GLM-5.2 迁移时,若原来用 thinking.type: "disabled",必须先改为 enabled 并设 reasoning_effort: "low",否则请求失败。
定价(2026-10-01 官方核实,单位:元/百万 tokens)
| 模型 | 输入 | 输出 | 缓存命中 |
|---|---|---|---|
| GLM-5.3 | ¥8 | ¥28 | ¥2 |
| GLM-5.3-Flash | ¥0.8 | ¥2.8 | ¥0.23 |
⚠️ Flash 版五折促销(¥0.4/¥1.4)已于 2026-09-09 结束,现按上表原价计费。
GLM Coding Plan 已全量上线 GLM-5.3,编程体感较前代提升 50%。新版采用积分制配额,非高峰时段(含周末全天)仅消耗标准积分的 50%。
能力表现
编程(官方 Z.ai Code Bench 与公开基准)
| 基准 | GLM-5.2 | GLM-5.3 |
|---|---|---|
| Terminal-Bench 3.0 | 4.6 | 28.3 |
| DeepSWE v1.1 | 46.2 | 66.9 |
| Agents’ Last Exam | 23.8 | 28.5 |
内部 Z.ai Code Bench 上较 GLM-5.2 提升 50%。Max 档准确率 34.5%,每任务平均输出约 7.5 万 token(GLM-5.2 为 23.4% / 9.6 万 token)——准确率更高且更省 token。
与闭源模型对比(官方自述,非第三方)
| 对比 | 档位 | 准确率 | 平均输出 |
|---|---|---|---|
| GLM-5.3 | Max | 34.5% | ~7.5 万 |
| GLM-5.3 | High | 31.4% | ~5 万 |
| Claude Opus 4.8 | — | 29.5% | ~12 万 |
| Claude Fable 5 | Max | 39.5% | — |
官方明确承认与 Claude Fable 5 仍有差距。此前笔记写「比肩 Claude Fable 5」不准确——GLM-5.3 确实超过了 Opus 4.8(准确率更高、输出量少一半),但离 Fable 5 还有距离。
网络安全能力(意外涌现)
| 基准 | GLM-5.2 | GLM-5.3 | 对比 |
|---|---|---|---|
| CyberGym | 77.2% | 84.5% | 该基准当前最佳,超 Mythos 5(83.8%)、GPT-5.6 Sol(83.6%) |
| ExploitBench | 24.4% | 54.4% | 提升一倍以上,但 Mythos 5(78.0%)仍明显领先 |
| ExploitGym(2小时/6小时任务数) | 29 / 39 | 105 / 130 | Mythos 5 为 181 / 247 |
真实场景已落地:与中国多家安全团队合作,在 269 个项目中发现 2,436 个漏洞(含 1,097 个中高危),涵盖系统内核、操作系统、浏览器引擎、Web 应用、网络协议等。最长潜伏漏洞在代码库中藏了约 40 年。
⚠️ 三个容易被绕进去的认知
1. GLM-5.3 不是「首个原生多模态」
它只支持文本。GLM-5 系列首个原生多模态是 GLM-5.3-Flash(2026-08-26 上线并开源)。
2. 参数别记混
744B/40B 是 GLM-5.3;320B/18B 是 GLM-5.3-Flash。两者差 2 倍多,成本也差 10 倍。
3. 优势在网络安全,不在绝对能力
相比闭源旗舰(Claude Fable 5、Mythos 5)仍有差距,但漏洞发现能力已到开源 SOTA,且真实项目已在用。这是它最被低估的价值。
与 OX Alpha 的关系
2026-08-20 OpenRouter 上线匿名模型「Ox Alpha」,预览期免费、调用量冲上榜首。研究者通过分词器指纹发现与 GLM-5.3 高度吻合。
2026-08-26 智谱官方确认 Ox Alpha 即 GLM-5.3 预览版,权重正式发布,匿名模型改名 GLM-5.3-Flash 发布、不再免费。
用户的关联
- 曾把 GLM-5.3-Flash 绑到 WorkBuddy 当自定义模型(此前用 huny4),口碑好;Cline 渠道免费
- 主力模型组合中曾任「质量敏感活」位,现已由 DeepSeek V4.1 Flash 接手
相关笔记
- OX Alpha - 真实身份(已揭晓)
- Quasar Alpha - OpenRouter 匿名模型现象
- 智谱 - 出品公司
- OpenRouter - 接入渠道
- API Keys - 按量计费 Key(非套餐)
相关日记
- 2026-08-25 - 全员模型对比调研
- 2026-08-26 - Ox Alpha 身份揭晓
- 2026-09-02 - 绑定到 WorkBuddy;当时半价促销到 9-9
- 2026-10-01 - 核实更正参数、多模态归属、定价(美元改人民币),补充能力对比与安全能力实测