GLM-5.3

⚠️ 2026-10-01 核实更正:本笔记此前有四处错误,已全部修正——

  1. 参数记错:GLM-5.3 是 744B 总 / 40B 激活(沿用 GLM-5.2 基座),此前记的 320B/18B 其实是 GLM-5.3-Flash 的参数
  2. 多模态归属错:GLM-5.3 仅支持文本,「GLM-5 系列首个原生多模态」指的是 GLM-5.3-Flash
  3. 定价全部过期:美元价已改为人民币,且 Flash 五折促销已于 2026-09-09 结束
  4. 能力描述夸大:官方明确 GLM-5.3 与 Claude Fable 5 仍有差距(Max 档 34.5% vs 39.5%)

产品介绍

GLM-5.3 是智谱 AI(Zhipu AI)2026 年 8 月发布的最新旗舰模型,8 月 19 日开放 API。它使用与 GLM-5.2 相同的基础模型,所有提升均来自后训练——不是新基座。

核心规格

项目数值
模态⚠️ 仅文本(不含图像/音频)
上下文窗口1M tokens
最大输出128K tokens
总参数量744B
激活参数40B
思考模式始终启用,不支持关闭
思考强度low / high / max(默认 max)
API 端点OpenAI Chat Completion:open.bigmodel.cn/api/paas/v4;OpenAI Response:/api/v1;Anthropic Message:/api/anthropic

迁移提示:从 GLM-5.2 迁移时,若原来用 thinking.type: "disabled",必须先改为 enabled 并设 reasoning_effort: "low",否则请求失败。

定价(2026-10-01 官方核实,单位:元/百万 tokens)

模型输入输出缓存命中
GLM-5.3¥8¥28¥2
GLM-5.3-Flash¥0.8¥2.8¥0.23

⚠️ Flash 版五折促销(¥0.4/¥1.4)已于 2026-09-09 结束,现按上表原价计费。

GLM Coding Plan 已全量上线 GLM-5.3,编程体感较前代提升 50%。新版采用积分制配额,非高峰时段(含周末全天)仅消耗标准积分的 50%。

能力表现

编程(官方 Z.ai Code Bench 与公开基准)

基准GLM-5.2GLM-5.3
Terminal-Bench 3.04.628.3
DeepSWE v1.146.266.9
Agents’ Last Exam23.828.5

内部 Z.ai Code Bench 上较 GLM-5.2 提升 50%。Max 档准确率 34.5%,每任务平均输出约 7.5 万 token(GLM-5.2 为 23.4% / 9.6 万 token)——准确率更高且更省 token。

与闭源模型对比(官方自述,非第三方)

对比档位准确率平均输出
GLM-5.3Max34.5%~7.5 万
GLM-5.3High31.4%~5 万
Claude Opus 4.8—29.5%~12 万
Claude Fable 5Max39.5%—

官方明确承认与 Claude Fable 5 仍有差距。此前笔记写「比肩 Claude Fable 5」不准确——GLM-5.3 确实超过了 Opus 4.8(准确率更高、输出量少一半),但离 Fable 5 还有距离。

网络安全能力(意外涌现)

基准GLM-5.2GLM-5.3对比
CyberGym77.2%84.5%该基准当前最佳,超 Mythos 5(83.8%)、GPT-5.6 Sol(83.6%)
ExploitBench24.4%54.4%提升一倍以上,但 Mythos 5(78.0%)仍明显领先
ExploitGym(2小时/6小时任务数)29 / 39105 / 130Mythos 5 为 181 / 247

真实场景已落地:与中国多家安全团队合作,在 269 个项目中发现 2,436 个漏洞(含 1,097 个中高危),涵盖系统内核、操作系统、浏览器引擎、Web 应用、网络协议等。最长潜伏漏洞在代码库中藏了约 40 年。

⚠️ 三个容易被绕进去的认知

1. GLM-5.3 不是「首个原生多模态」
它只支持文本。GLM-5 系列首个原生多模态是 GLM-5.3-Flash(2026-08-26 上线并开源)。

2. 参数别记混
744B/40B 是 GLM-5.3;320B/18B 是 GLM-5.3-Flash。两者差 2 倍多,成本也差 10 倍。

3. 优势在网络安全,不在绝对能力
相比闭源旗舰(Claude Fable 5、Mythos 5)仍有差距,但漏洞发现能力已到开源 SOTA,且真实项目已在用。这是它最被低估的价值。

与 OX Alpha 的关系

2026-08-20 OpenRouter 上线匿名模型「Ox Alpha」,预览期免费、调用量冲上榜首。研究者通过分词器指纹发现与 GLM-5.3 高度吻合。

2026-08-26 智谱官方确认 Ox Alpha 即 GLM-5.3 预览版,权重正式发布,匿名模型改名 GLM-5.3-Flash 发布、不再免费。

用户的关联

  • 曾把 GLM-5.3-Flash 绑到 WorkBuddy 当自定义模型(此前用 huny4),口碑好;Cline 渠道免费
  • 主力模型组合中曾任「质量敏感活」位,现已由 DeepSeek V4.1 Flash 接手

相关笔记

相关日记

  • 2026-08-25 - 全员模型对比调研
  • 2026-08-26 - Ox Alpha 身份揭晓
  • 2026-09-02 - 绑定到 WorkBuddy;当时半价促销到 9-9
  • 2026-10-01 - 核实更正参数、多模态归属、定价(美元改人民币),补充能力对比与安全能力实测