闭源仅 API推理模型多模态已被替代可商用 · Proprietary
xAI logo

Grok 4

xAI · 发布 2025-07-09 · 已被替代Grok 4.5

考试型推理顶级的闭源旗舰,价格与 Claude Sonnet 同档但更慢。

参数
未披露
上下文
256K
价格 / 1M tok
$3.00 / $15
xAI 定价页 · 2025-12-20
API 速度
API
无自建选项
Arena Elo1430
2025-12-20
AA 综合指数
真实仓库修 bug75
2025-12-20
GPQA 推理87.5
2025-12-20
类型
未披露
注意力
未披露
层数
未披露
专家
未披露
隐藏维
未披露
词表
未披露

完善中

Token Embedding未披露× ? 层注意力(未披露)FFN / MoE(未披露)厂商未公开内部结构LM Head参数未披露实线 = 已公开 · 虚线 = 未披露

闭源模型,无自建选项,不提供显存表。

完善中

完善中

逻辑能力

考试型推理顶级;工程型推理中上。

亮点
  1. 1.HLE 25.4%(无工具)、GPQA 87.5%
  2. 2.256K 上下文
  3. 3.Grok 4 Heavy 多 agent 变体
  1. 1.延迟高、吞吐低
  2. 2.代码 agent 生态弱
  3. 3.无自建
适合:科学推理 · 深度研究
不适合:低延迟产品
基准分数来源日期证据
LMArena Text Elo人类偏好 Elo1430LMArena Text (style control)2025-12-20独立复测
SWE-bench Verified真实仓库修 bug75%xAI 发布公告2025-12-20厂商公布
GPQA Diamond研究生级科学问答87.5%xAI 发布公告2025-12-20厂商公布
Humanity's Last Exam人类最后考试25.4%xAI 发布公告2025-12-20厂商公布
AIME 2025美国数学邀请赛91.7%xAI 发布公告2025-12-20厂商公布

更新 2025-12-20 · 排名供选型参考,基准会饱和、会泄漏、会过时。