Claude Fable 5
Claude Fable 5(Mythos 级公开版) · Anthropic · 发布 2026-06-09 · 当前代
Anthropic 公开的 Mythos 级模型,可连续多日运行 agent。
- 类型
- 未披露
- 注意力
- 未披露
- 层数
- 未披露
- 专家
- 未披露
- 隐藏维
- 未披露
- 词表
- 未披露
未披露。官方仅说明:与 Claude Mythos 5 为同一底层模型,Fable 5 额外挂载安全分类器;adaptive thinking 始终开启,不可关闭;使用 Opus 4.7 起的新分词器(同文本 token 约多 30%)。
未披露。Anthropic 未公布参数量、Dense/MoE、注意力结构。
官方确认的事实:
- 与 Claude Mythos 5 是同一底层模型,Fable 5 多了三类安全分类器(网络安全、生物/化学、蒸馏);Mythos 5 仅通过 Project Glasswing 受邀提供
- Adaptive thinking 始终开启,
thinking.type=disabled直接报错;深度用effort(默认high)调节 - 原始思维链从不返回,
thinking.display只能选summarized/omitted - 使用 Opus 4.7 起的新分词器,同一文本 token 数约多 30%
- 1M 上下文(默认即最大)、128K 最大输出
- 可靠知识截止 2026-01
闭源模型,无自建选项,不提供显存表。
无自建选项。
成本模型(官方定价页,2026-08-28):
- 输入 $10 / 输出 $50 / MTok
- 5 分钟缓存写 $12.50,1 小时缓存写 $20,缓存读 $1(10%)
- Batch API 五折:$5 / $25
- 1M 长上下文按标准价,不加价
被拒绝的请求不计费;回退到其他模型时 fallback credit 会退还重复的缓存成本。
实测:AA 智能指数单任务平均 $3.14,输出 64.9 tok/s,TTFT 约 80 s——比 Opus 5 贵约 35% 且更慢。
编程SWE-bench Pro 80.3%(官方公告表,Vellum 转录);Cognition FrontierCode 最高分;Stripe 用其一天完成 5000 万行 Ruby 迁移。
推理AA 智能指数 62(2026-08);Frontier-Bench v0.1 33.7%,低于 Opus 5 的 43.3%。
Agent官方定位为「长时运行 agent」,Claude Code / Managed Agents 下可工作数日;AA 测 Cost per task $3.14。
多模态官方称视觉 SOTA:GDP.pdf(视觉、无工具)29.8 vs GPT-5.5 24.9。
中文中文可用,缺少独立中文评测。
当前公开模型中的最高档:GDP.pdf 视觉推理 29.8、SWE-bench Pro 80.3(官方公告表)领先所有对手;纯视觉通关《宝可梦 火红》,持久记忆下 Slay the Spire 表现比 Opus 4.8 高 3 倍。但 Opus 5 发布后,在 GDPval-AA v2、AA-Briefcase、ARC-AGI-3 上已被 Opus 5 反超,Fable 5 的优势集中在需要极长任务链、极高自主度的场景。失败模式:分类器偏保守,约 5% 会话会触发回退;输出偏长、思考 token 多。
- 1.LMArena 文本榜第一(1507,2026-08-27),AA 智能指数 62
- 2.1M 上下文 + 128K 输出,思考始终开启,可跨阶段委派子 agent 连续工作数日
- 3.官方定价 $10 / $50,不到 Mythos Preview 的一半,缓存读取 $1
- 1.网络安全 / 生化 / 蒸馏类请求会被分类器拒绝并回退到 Opus 4.8,集成须处理 stop_reason=refusal
- 2.首 token 延迟高(AA 实测 TTFT 约 80 s),思考不可关闭且不返回原始思维链
- 3.价格是 Opus 5 的 2 倍,而 Opus 5 在多数榜单已持平甚至反超;30 天强制数据留存,无 ZDR
| 基准 | 分数 | 来源 | 日期 | 证据 |
|---|---|---|---|---|
| LMArena Text Elo人类偏好 Elo | 1507 | LMArena Text (style control) | 2026-08-28 | 独立复测 |
| Artificial Analysis Intelligence IndexAA 综合指数 | 62 | Artificial Analysis Intelligence Index v3 | 2026-08-28 | 独立复测 |
| Terminal-Bench终端 agent | 88% | Anthropic 发布公告 | 2026-08-28 | 厂商公布 |
| Artificial Analysis Intelligence IndexAA 综合指数 | 62 | Artificial Analysis (v4.1.1) | 2026-08-28 | 独立复测 |
| GPQA Diamond研究生级科学问答 | 92.6% | Artificial Analysis (v4.1.1) | 2026-08-28 | 独立复测 |
| Humanity's Last Exam人类最后考试 | 55.5% | Artificial Analysis (v4.1.1) | 2026-08-28 | 独立复测 |
| SciCode科学计算编程 | 60.2% | Artificial Analysis (v4.1.1) | 2026-08-28 | 独立复测 |
| Terminal-Bench Hard终端 agent(AA 困难子集) | 62.9% | Artificial Analysis (v4.1.1) | 2026-08-28 | 独立复测 |
| τ²-Bench Telecom工具调用 agent(电信域) | 98.5% | Artificial Analysis (v4.1.1) | 2026-08-28 | 独立复测 |
| IFBench指令遵循 | 63.5% | Artificial Analysis (v4.1.1) | 2026-08-28 | 独立复测 |
| Terminal-Bench终端 agent | 84.6% | Artificial Analysis · Terminal-Bench 2.1 | 2026-08-28 | 独立复测 |
| τ³-Bench Banking工具调用 agent(银行域) | 38.1% | Artificial Analysis · τ³-Bench Banking | 2026-08-28 | 独立复测 |
| LMArena Chinese Elo中文人类偏好 Elo | 1555 | LMArena Text · Chinese (style control) | 2026-08-28 | 独立复测 |
更新 2026-08-28 · 排名供选型参考,基准会饱和、会泄漏、会过时。