闭源仅 API推理模型·可关多模态已被替代可商用 · Proprietary
Claude Opus 4.8
Claude 4.8 顶配(已被 Opus 5 取代) · Anthropic · 发布 2026-05-28 · 已被替代 → Claude Opus 5
Opus 4.x 末代,SWE-bench 88.6%,已被 Opus 5 取代
参数
未披露
上下文
1M
输出 125K
价格 / 1M tok
$5.00 / $25
Anthropic 官方定价 · 2026-08-28
API 速度
API
无自建选项
Arena Elo1481
2026-08-28
AA 综合指数—
真实仓库修 bug88.6
2026-08-28
GPQA 推理93.6
2026-08-28
架构简图
- 类型
- 未披露
- 注意力
- 未披露
- 层数
- 未披露
- 专家
- 未披露
- 隐藏维
- 未披露
- 词表
- 未披露
未披露。adaptive thinking 需显式开启;effort 默认 high;fast mode 2.5× 速度;官方已标 Legacy。
完善中
闭源模型,无自建选项,不提供显存表。
完善中
编程SWE-bench Verified 88.6%、SWE-bench Pro 69.2%、Terminal-Bench 2.1 74.6%(官方公告表,Vellum 转录)。
推理GPQA Diamond 93.6%、HLE(带工具)57.9%。
AgentOSWorld-Verified 83.4%、Finance Agent v2 53.9%。
中文中文可用,缺少独立中文评测。
逻辑能力
上一代旗舰水平:GPQA Diamond 93.6%、HLE(带工具)57.9%、GDPval-AA 1890(官方公告表,Vellum 转录)。相比 Opus 5,深度推理与长任务差距显著(Frontier-Bench 18.7 vs 43.3)。
亮点
- 1.SWE-bench Verified 88.6%、GPQA Diamond 93.6%、OSWorld-Verified 83.4%(官方公告表)
- 2.Fable 5 拒绝请求时的官方回退模型,仍在所有平台提供
- 3.与 Opus 5 同价 $5 / $25,思考默认关闭,迁移成本低
坑
- 1.官方状态 Legacy:Frontier-Bench 仅 18.7%,不到 Opus 5 一半,新项目无理由选它
- 2.ARC-AGI-3 仅 1.5%,抽象推理明显落后
- 3.退役承诺仅到 2027-05-28,应尽快迁移
适合:Fable 5 回退目标 · 已有 Opus 4.x 提示词的存量系统
不适合:新项目 · 需要私有化部署的合规场景
| 基准 | 分数 | 来源 | 日期 | 证据 |
|---|---|---|---|---|
| LMArena Text Elo人类偏好 Elo | 1481 | LMArena Text (style control) | 2026-08-28 | 独立复测 |
| SWE-bench Verified真实仓库修 bug | 88.6% | Anthropic 发布公告 | 2026-08-28 | 厂商公布 |
| GPQA Diamond研究生级科学问答 | 93.6% | Anthropic 发布公告 | 2026-08-28 | 厂商公布 |
| Terminal-Bench终端 agent | 74.6% | Anthropic 发布公告 | 2026-08-28 | 厂商公布 |
更新 2026-08-28 · 排名供选型参考,基准会饱和、会泄漏、会过时。