闭源仅 API推理模型·可关多模态已被替代可商用 · Proprietary
Anthropic logo

Claude Opus 4.8

Claude 4.8 顶配(已被 Opus 5 取代) · Anthropic · 发布 2026-05-28 · 已被替代Claude Opus 5

Opus 4.x 末代,SWE-bench 88.6%,已被 Opus 5 取代

参数
未披露
上下文
1M
输出 125K
价格 / 1M tok
$5.00 / $25
Anthropic 官方定价 · 2026-08-28
API 速度
API
无自建选项
Arena Elo1481
2026-08-28
AA 综合指数
真实仓库修 bug88.6
2026-08-28
GPQA 推理93.6
2026-08-28
类型
未披露
注意力
未披露
层数
未披露
专家
未披露
隐藏维
未披露
词表
未披露

未披露。adaptive thinking 需显式开启;effort 默认 high;fast mode 2.5× 速度;官方已标 Legacy。

完善中

Token Embedding未披露× ? 层注意力(未披露)FFN / MoE(未披露)厂商未公开内部结构LM Head参数未披露实线 = 已公开 · 虚线 = 未披露

闭源模型,无自建选项,不提供显存表。

完善中

编程SWE-bench Verified 88.6%、SWE-bench Pro 69.2%、Terminal-Bench 2.1 74.6%(官方公告表,Vellum 转录)。

推理GPQA Diamond 93.6%、HLE(带工具)57.9%。

AgentOSWorld-Verified 83.4%、Finance Agent v2 53.9%。

中文中文可用,缺少独立中文评测。

逻辑能力

上一代旗舰水平:GPQA Diamond 93.6%、HLE(带工具)57.9%、GDPval-AA 1890(官方公告表,Vellum 转录)。相比 Opus 5,深度推理与长任务差距显著(Frontier-Bench 18.7 vs 43.3)。

亮点
  1. 1.SWE-bench Verified 88.6%、GPQA Diamond 93.6%、OSWorld-Verified 83.4%(官方公告表)
  2. 2.Fable 5 拒绝请求时的官方回退模型,仍在所有平台提供
  3. 3.与 Opus 5 同价 $5 / $25,思考默认关闭,迁移成本低
  1. 1.官方状态 Legacy:Frontier-Bench 仅 18.7%,不到 Opus 5 一半,新项目无理由选它
  2. 2.ARC-AGI-3 仅 1.5%,抽象推理明显落后
  3. 3.退役承诺仅到 2027-05-28,应尽快迁移
适合:Fable 5 回退目标 · 已有 Opus 4.x 提示词的存量系统
不适合:新项目 · 需要私有化部署的合规场景
基准分数来源日期证据
LMArena Text Elo人类偏好 Elo1481LMArena Text (style control)2026-08-28独立复测
SWE-bench Verified真实仓库修 bug88.6%Anthropic 发布公告2026-08-28厂商公布
GPQA Diamond研究生级科学问答93.6%Anthropic 发布公告2026-08-28厂商公布
Terminal-Bench终端 agent74.6%Anthropic 发布公告2026-08-28厂商公布

更新 2026-08-28 · 排名供选型参考,基准会饱和、会泄漏、会过时。