闭源仅 API推理模型·可关多模态已被替代可商用 · Proprietary
Claude 3.7 Sonnet
Anthropic · 发布 2025-02-24 · 已被替代 → Claude Sonnet 4
首个混合推理模型,与 Claude Code 一同发布。
参数
未披露
上下文
200K
输出 63K
价格 / 1M tok
$3.00 / $15
Anthropic 定价页 · 2025-02-24
API 速度
API
无自建选项
Arena Elo—
AA 综合指数—
真实仓库修 bug62.3
2025-02-24
GPQA 推理78.2
2025-02-24
架构简图
- 类型
- 未披露
- 注意力
- 未披露
- 层数
- 未披露
- 专家
- 未披露
- 隐藏维
- 未披露
- 词表
- 未披露
首个混合推理模型:同一模型可选择即时回答或扩展思考,思考预算可控。
完善中
闭源模型,无自建选项,不提供显存表。
完善中
完善中
逻辑能力
工程型推理里程碑,思考模式开启后考试型推理也进入第一梯队;关掉思考时与 3.5 Sonnet 相当。
亮点
- 1.SWE-bench Verified 62.3%(脚手架 70.3%),当时第一
- 2.扩展思考可控预算,GPQA 78.2%
- 3.Claude Code 命令行工具同日发布
坑
- 1.过度工程化倾向,会擅自改动未要求的代码
- 2.AIME 2024 61.3%,数学不及 o3-mini
- 3.128K 输出为 beta
适合:历史对照
不适合:新项目
| 基准 | 分数 | 来源 | 日期 | 证据 |
|---|---|---|---|---|
| SWE-bench Verified真实仓库修 bug | 62.3% | Anthropic Claude 3.7 Sonnet 公告(GPQA/MMMU 为 64K 扩展思考) | 2025-02-24 | 厂商公布 |
| GPQA Diamond研究生级科学问答 | 78.2% | Anthropic Claude 3.7 Sonnet 公告(GPQA/MMMU 为 64K 扩展思考) | 2025-02-24 | 厂商公布 |
| MMMU多模态理解 | 75% | Anthropic Claude 3.7 Sonnet 公告(GPQA/MMMU 为 64K 扩展思考) | 2025-02-24 | 厂商公布 |
更新 2026-08-28 · 排名供选型参考,基准会饱和、会泄漏、会过时。