闭源仅 API推理模型·可关多模态已被替代可商用 · Proprietary
Anthropic logo

Claude 3.7 Sonnet

Anthropic · 发布 2025-02-24 · 已被替代Claude Sonnet 4

首个混合推理模型,与 Claude Code 一同发布。

参数
未披露
上下文
200K
输出 63K
价格 / 1M tok
$3.00 / $15
Anthropic 定价页 · 2025-02-24
API 速度
API
无自建选项
Arena Elo
AA 综合指数
真实仓库修 bug62.3
2025-02-24
GPQA 推理78.2
2025-02-24
类型
未披露
注意力
未披露
层数
未披露
专家
未披露
隐藏维
未披露
词表
未披露

首个混合推理模型:同一模型可选择即时回答或扩展思考,思考预算可控。

完善中

Token Embedding未披露× ? 层注意力(未披露)FFN / MoE(未披露)厂商未公开内部结构LM Head参数未披露实线 = 已公开 · 虚线 = 未披露

闭源模型,无自建选项,不提供显存表。

完善中

完善中

逻辑能力

工程型推理里程碑,思考模式开启后考试型推理也进入第一梯队;关掉思考时与 3.5 Sonnet 相当。

亮点
  1. 1.SWE-bench Verified 62.3%(脚手架 70.3%),当时第一
  2. 2.扩展思考可控预算,GPQA 78.2%
  3. 3.Claude Code 命令行工具同日发布
  1. 1.过度工程化倾向,会擅自改动未要求的代码
  2. 2.AIME 2024 61.3%,数学不及 o3-mini
  3. 3.128K 输出为 beta
适合:历史对照
不适合:新项目
基准分数来源日期证据
SWE-bench Verified真实仓库修 bug62.3%Anthropic Claude 3.7 Sonnet 公告(GPQA/MMMU 为 64K 扩展思考)2025-02-24厂商公布
GPQA Diamond研究生级科学问答78.2%Anthropic Claude 3.7 Sonnet 公告(GPQA/MMMU 为 64K 扩展思考)2025-02-24厂商公布
MMMU多模态理解75%Anthropic Claude 3.7 Sonnet 公告(GPQA/MMMU 为 64K 扩展思考)2025-02-24厂商公布

更新 2026-08-28 · 排名供选型参考,基准会饱和、会泄漏、会过时。