闭源仅 API推理模型·可关多模态已被替代可商用 · Proprietary
xAI logo

Grok 3

xAI · 发布 2025-02-17 · 已被替代Grok 4

首个 LMArena 破 1400 的模型,Think 版 AIME 93%。

参数
未披露
上下文
128K(宣称 1M)
输出 16K
价格 / 1M tok
$3.00 / $15
xAI API 定价 · 2025-04-09
API 速度
API
无自建选项
Arena Elo1402
2025-02-19
AA 综合指数
竞赛编程57
2025-02-19
GPQA 推理75.4
2025-02-19
类型
未披露
注意力
未披露
层数
未披露
专家
未披露
隐藏维
未披露
词表
未披露

未披露。Colossus 20 万卡集群训练;Think 模式为推理版本,API 2025-04-09 开放。

完善中

Token Embedding未披露× ? 层注意力(未披露)FFN / MoE(未披露)厂商未公开内部结构LM Head参数未披露实线 = 已公开 · 虚线 = 未披露

闭源模型,无自建选项,不提供显存表。

完善中

完善中

逻辑能力

非推理版 GPQA 75.4%、LCB 57.0%;Think 版考试型推理进入第一梯队,工程型无官方数据。

亮点
  1. 1.LMArena Elo 1402("chocolate"),首个破 1400
  2. 2.Think 模式 AIME 2025 93.3%(cons@64)、GPQA 84.6%
  3. 3.DeepSearch 联网研究功能
  1. 1.官方图表 cons@64 与他家 pass@1 对比引发争议
  2. 2.API 上下文 131K,非宣称的 1M
  3. 3.API 比产品晚近两个月
适合:历史对照
不适合:新项目
基准分数来源日期证据
LMArena Text Elo人类偏好 Elo1402LMArena Text (style control)2025-02-19独立复测
LiveCodeBench竞赛编程57%xAI Grok 3 公告(非推理 pass@1;LCB 2024-10-01~2025-02-01)2025-02-19厂商公布
GPQA Diamond研究生级科学问答75.4%xAI Grok 3 公告(非推理 pass@1;LCB 2024-10-01~2025-02-01)2025-02-19厂商公布
MMMU多模态理解73.2%xAI Grok 3 公告(非推理 pass@1;LCB 2024-10-01~2025-02-01)2025-02-19厂商公布

更新 2026-08-28 · 排名供选型参考,基准会饱和、会泄漏、会过时。