闭源仅 API推理模型可商用 · MIT(承诺;权重未发布)

GLM-5.3
智谱 GLM-5.3 · Z.ai 智谱 · 发布 2026-08-14 · 当前代
GLM-5.2 同底座后训练加强版,权重承诺开源。
参数
744B 总 / 40B 激活
MOE
上下文
1M
输出 128K
价格 / 1M tok
$1.40 / $4.40
Z.ai 开放平台 · 2026-08-28
API 速度
API ≈72 tok/s
首 token 1.62s · Artificial Analysis
Arena Elo1484
2026-08-28
AA 综合指数60
2026-08-28
代码—
GPQA 推理91.7
2026-08-28
架构简图
- 类型
- MoE
- 注意力
- MLA + DSA 稀疏注意力(同 GLM-5.2)
- 层数
- 78
- 专家
- 256 · 激活 8 + 共享
- 隐藏维
- 6144
- 词表
- 154,880
官方明确「与 GLM-5.2 同一底座,所有提升来自后训练」,结构参数沿用 GLM-5.2(GitHub 标注 744B-A40B)。权重截至 2026-08-28 未发布,HF 页面为倒计时预告。
完善中
闭源模型,无自建选项,不提供显存表。
完善中
编程DeepSWE v1.1 66.9、Terminal-Bench 3.0 28.3、SWE-Marathon v1.1 42.5、Z.ai Code Bench 34.5(max)(官方)。
推理官方未单独披露;同底座参考 GLM-5.2。
AgentAgents' Last Exam 28.5;CyberGym 84.5、ExploitBench 54.4(官方)。
中文中文顶级。
逻辑能力
工程型推理:官方主张为开源最强编程模型,agent 类任务提升最大(DeepSWE 66.9、SWE-Marathon 42.5、Agents' Last Exam 28.5)。LMArena 文本榜 1484(第 15),AA 指数 60。考试型基准官方未单独披露,推测与 GLM-5.2 相近(同底座)。
亮点
- 1.承诺开源:官方称安全审查后两周内开源权重,HF 页面预告 2026-08-28;截至今日仍只有 API
- 2.同底座纯后训练:Z.ai Code Bench 比 GLM-5.2 提升 50%,DeepSWE v1.1 46.2→66.9,Terminal-Bench 3.0 4.6→28.3
- 3.网络安全能力突出:CyberGym 84.5、ExploitBench 54.4(GLM-5.2 为 24.4)
坑
- 1.权重尚未发布,本条目按 API-only 记录;开源后需重新核对文件与许可
- 2.推理不可关闭,只能调 reasoning_effort;max 档单题输出可达 ~75K token
- 3.漏洞利用能力被官方列为「意外涌现」,分阶段先向安全伙伴开放,企业合规需留意
适合:编程 agent(ZCode / Claude Code / OpenCode) · 漏洞发现与安全审计 · 等 GLM-5.2 开源用户升级
不适合:需要今天就能自建的场景(权重未发布) · 多模态(用 GLM-5.3-Flash)
| 基准 | 分数 | 来源 | 日期 | 证据 |
|---|---|---|---|---|
| LMArena Text Elo人类偏好 Elo | 1484 | LMArena Text (style control) | 2026-08-28 | 独立复测 |
| Artificial Analysis Intelligence IndexAA 综合指数 | 60 | Artificial Analysis Intelligence Index v3 | 2026-08-28 | 独立复测 |
| Artificial Analysis Intelligence IndexAA 综合指数 | 60 | Artificial Analysis (v4.1.1) | 2026-08-28 | 独立复测 |
| GPQA Diamond研究生级科学问答 | 91.7% | Artificial Analysis (v4.1.1) | 2026-08-28 | 独立复测 |
| Humanity's Last Exam人类最后考试 | 42.3% | Artificial Analysis (v4.1.1) | 2026-08-28 | 独立复测 |
| SciCode科学计算编程 | 56.5% | Artificial Analysis (v4.1.1) | 2026-08-28 | 独立复测 |
| Terminal-Bench终端 agent | 83.9% | Artificial Analysis · Terminal-Bench 2.1 | 2026-08-28 | 独立复测 |
| τ³-Bench Banking工具调用 agent(银行域) | 50.3% | Artificial Analysis · τ³-Bench Banking | 2026-08-28 | 独立复测 |
| LMArena Chinese Elo中文人类偏好 Elo | 1530 | LMArena Text · Chinese (style control) | 2026-08-28 | 独立复测 |
更新 2026-08-28 · 排名供选型参考,基准会饱和、会泄漏、会过时。