闭源仅 API推理模型多模态可商用 · Proprietary
Anthropic logo

Claude Fable 5

Claude Fable 5(Mythos 级公开版) · Anthropic · 发布 2026-06-09 · 当前代

Anthropic 公开的 Mythos 级模型,可连续多日运行 agent。

参数
未披露
上下文
1M
输出 125K
价格 / 1M tok
$10 / $50
Anthropic 官方定价 · 2026-08-28
API 速度
API ≈65 tok/s
首 token 79.92s · Artificial Analysis
Arena Elo1507
2026-08-28
AA 综合指数62
2026-08-28
代码
GPQA 推理92.6
2026-08-28
类型
未披露
注意力
未披露
层数
未披露
专家
未披露
隐藏维
未披露
词表
未披露

未披露。官方仅说明:与 Claude Mythos 5 为同一底层模型,Fable 5 额外挂载安全分类器;adaptive thinking 始终开启,不可关闭;使用 Opus 4.7 起的新分词器(同文本 token 约多 30%)。

未披露。Anthropic 未公布参数量、Dense/MoE、注意力结构。

官方确认的事实:

  • Claude Mythos 5 是同一底层模型,Fable 5 多了三类安全分类器(网络安全、生物/化学、蒸馏);Mythos 5 仅通过 Project Glasswing 受邀提供
  • Adaptive thinking 始终开启thinking.type=disabled 直接报错;深度用 effort(默认 high)调节
  • 原始思维链从不返回,thinking.display 只能选 summarized / omitted
  • 使用 Opus 4.7 起的新分词器,同一文本 token 数约多 30%
  • 1M 上下文(默认即最大)、128K 最大输出
  • 可靠知识截止 2026-01
Token Embedding未披露× ? 层注意力(未披露)FFN / MoE(未披露)厂商未公开内部结构LM Head参数未披露实线 = 已公开 · 虚线 = 未披露

闭源模型,无自建选项,不提供显存表。

无自建选项。

成本模型(官方定价页,2026-08-28):

  • 输入 $10 / 输出 $50 / MTok
  • 5 分钟缓存写 $12.50,1 小时缓存写 $20,缓存读 $1(10%)
  • Batch API 五折:$5 / $25
  • 1M 长上下文按标准价,不加价

被拒绝的请求不计费;回退到其他模型时 fallback credit 会退还重复的缓存成本。

实测:AA 智能指数单任务平均 $3.14,输出 64.9 tok/s,TTFT 约 80 s——比 Opus 5 贵约 35% 且更慢。

编程SWE-bench Pro 80.3%(官方公告表,Vellum 转录);Cognition FrontierCode 最高分;Stripe 用其一天完成 5000 万行 Ruby 迁移。

推理AA 智能指数 62(2026-08);Frontier-Bench v0.1 33.7%,低于 Opus 5 的 43.3%。

Agent官方定位为「长时运行 agent」,Claude Code / Managed Agents 下可工作数日;AA 测 Cost per task $3.14。

多模态官方称视觉 SOTA:GDP.pdf(视觉、无工具)29.8 vs GPT-5.5 24.9。

中文中文可用,缺少独立中文评测。

逻辑能力

当前公开模型中的最高档:GDP.pdf 视觉推理 29.8、SWE-bench Pro 80.3(官方公告表)领先所有对手;纯视觉通关《宝可梦 火红》,持久记忆下 Slay the Spire 表现比 Opus 4.8 高 3 倍。但 Opus 5 发布后,在 GDPval-AA v2、AA-Briefcase、ARC-AGI-3 上已被 Opus 5 反超,Fable 5 的优势集中在需要极长任务链、极高自主度的场景。失败模式:分类器偏保守,约 5% 会话会触发回退;输出偏长、思考 token 多。

亮点
  1. 1.LMArena 文本榜第一(1507,2026-08-27),AA 智能指数 62
  2. 2.1M 上下文 + 128K 输出,思考始终开启,可跨阶段委派子 agent 连续工作数日
  3. 3.官方定价 $10 / $50,不到 Mythos Preview 的一半,缓存读取 $1
  1. 1.网络安全 / 生化 / 蒸馏类请求会被分类器拒绝并回退到 Opus 4.8,集成须处理 stop_reason=refusal
  2. 2.首 token 延迟高(AA 实测 TTFT 约 80 s),思考不可关闭且不返回原始思维链
  3. 3.价格是 Opus 5 的 2 倍,而 Opus 5 在多数榜单已持平甚至反超;30 天强制数据留存,无 ZDR
适合:跨天运行的多阶段 agent 项目 · 大规模代码迁移 / 仓库级重构 · 金融、法律等高级知识工作 · 视觉密集型任务
不适合:高频低价值调用 · 安全研究 / 生物类内容(会回退) · 需要 ZDR 或私有化部署的合规场景
基准分数来源日期证据
LMArena Text Elo人类偏好 Elo1507LMArena Text (style control)2026-08-28独立复测
Artificial Analysis Intelligence IndexAA 综合指数62Artificial Analysis Intelligence Index v32026-08-28独立复测
Terminal-Bench终端 agent88%Anthropic 发布公告2026-08-28厂商公布
Artificial Analysis Intelligence IndexAA 综合指数62Artificial Analysis (v4.1.1)2026-08-28独立复测
GPQA Diamond研究生级科学问答92.6%Artificial Analysis (v4.1.1)2026-08-28独立复测
Humanity's Last Exam人类最后考试55.5%Artificial Analysis (v4.1.1)2026-08-28独立复测
SciCode科学计算编程60.2%Artificial Analysis (v4.1.1)2026-08-28独立复测
Terminal-Bench Hard终端 agent(AA 困难子集)62.9%Artificial Analysis (v4.1.1)2026-08-28独立复测
τ²-Bench Telecom工具调用 agent(电信域)98.5%Artificial Analysis (v4.1.1)2026-08-28独立复测
IFBench指令遵循63.5%Artificial Analysis (v4.1.1)2026-08-28独立复测
Terminal-Bench终端 agent84.6%Artificial Analysis · Terminal-Bench 2.12026-08-28独立复测
τ³-Bench Banking工具调用 agent(银行域)38.1%Artificial Analysis · τ³-Bench Banking2026-08-28独立复测
LMArena Chinese Elo中文人类偏好 Elo1555LMArena Text · Chinese (style control)2026-08-28独立复测

更新 2026-08-28 · 排名供选型参考,基准会饱和、会泄漏、会过时。