闭源仅 API推理模型可商用 · MIT(承诺;权重未发布)
Z.ai logo

GLM-5.3

智谱 GLM-5.3 · Z.ai 智谱 · 发布 2026-08-14 · 当前代

GLM-5.2 同底座后训练加强版,权重承诺开源。

参数
744B 总 / 40B 激活
MOE
上下文
1M
输出 128K
价格 / 1M tok
$1.40 / $4.40
Z.ai 开放平台 · 2026-08-28
API 速度
API ≈72 tok/s
首 token 1.62s · Artificial Analysis
Arena Elo1484
2026-08-28
AA 综合指数60
2026-08-28
代码
GPQA 推理91.7
2026-08-28
类型
MoE
注意力
MLA + DSA 稀疏注意力(同 GLM-5.2)
层数
78
专家
256 · 激活 8 + 共享
隐藏维
6144
词表
154,880

官方明确「与 GLM-5.2 同一底座,所有提升来自后训练」,结构参数沿用 GLM-5.2(GitHub 标注 744B-A40B)。权重截至 2026-08-28 未发布,HF 页面为倒计时预告。

完善中

Token Embedding词表 154,880× 78 层注意力:MLA + DSA 稀疏注意力KV 头 1 · head_dim 288路由top-8E1E2E3共享专家256 专家 · 激活 8 · d=6144LM Head744B / 40B 激活实线 = 已公开 · 虚线 = 未披露

闭源模型,无自建选项,不提供显存表。

完善中

编程DeepSWE v1.1 66.9、Terminal-Bench 3.0 28.3、SWE-Marathon v1.1 42.5、Z.ai Code Bench 34.5(max)(官方)。

推理官方未单独披露;同底座参考 GLM-5.2。

AgentAgents' Last Exam 28.5;CyberGym 84.5、ExploitBench 54.4(官方)。

中文中文顶级。

逻辑能力

工程型推理:官方主张为开源最强编程模型,agent 类任务提升最大(DeepSWE 66.9、SWE-Marathon 42.5、Agents' Last Exam 28.5)。LMArena 文本榜 1484(第 15),AA 指数 60。考试型基准官方未单独披露,推测与 GLM-5.2 相近(同底座)。

亮点
  1. 1.承诺开源:官方称安全审查后两周内开源权重,HF 页面预告 2026-08-28;截至今日仍只有 API
  2. 2.同底座纯后训练:Z.ai Code Bench 比 GLM-5.2 提升 50%,DeepSWE v1.1 46.2→66.9,Terminal-Bench 3.0 4.6→28.3
  3. 3.网络安全能力突出:CyberGym 84.5、ExploitBench 54.4(GLM-5.2 为 24.4)
  1. 1.权重尚未发布,本条目按 API-only 记录;开源后需重新核对文件与许可
  2. 2.推理不可关闭,只能调 reasoning_effort;max 档单题输出可达 ~75K token
  3. 3.漏洞利用能力被官方列为「意外涌现」,分阶段先向安全伙伴开放,企业合规需留意
适合:编程 agent(ZCode / Claude Code / OpenCode) · 漏洞发现与安全审计 · 等 GLM-5.2 开源用户升级
不适合:需要今天就能自建的场景(权重未发布) · 多模态(用 GLM-5.3-Flash)
基准分数来源日期证据
LMArena Text Elo人类偏好 Elo1484LMArena Text (style control)2026-08-28独立复测
Artificial Analysis Intelligence IndexAA 综合指数60Artificial Analysis Intelligence Index v32026-08-28独立复测
Artificial Analysis Intelligence IndexAA 综合指数60Artificial Analysis (v4.1.1)2026-08-28独立复测
GPQA Diamond研究生级科学问答91.7%Artificial Analysis (v4.1.1)2026-08-28独立复测
Humanity's Last Exam人类最后考试42.3%Artificial Analysis (v4.1.1)2026-08-28独立复测
SciCode科学计算编程56.5%Artificial Analysis (v4.1.1)2026-08-28独立复测
Terminal-Bench终端 agent83.9%Artificial Analysis · Terminal-Bench 2.12026-08-28独立复测
τ³-Bench Banking工具调用 agent(银行域)50.3%Artificial Analysis · τ³-Bench Banking2026-08-28独立复测
LMArena Chinese Elo中文人类偏好 Elo1530LMArena Text · Chinese (style control)2026-08-28独立复测

更新 2026-08-28 · 排名供选型参考,基准会饱和、会泄漏、会过时。