闭源仅 API多模态已被替代可商用 · Proprietary
Claude 3 Opus
Anthropic · 发布 2024-03-04 · 已被替代 → Claude 3.5 Sonnet
首个在 LMArena 超越 GPT-4 的模型,写作口碑极佳。
参数
未披露
上下文
200K
输出 4K
价格 / 1M tok
$15 / $75
Anthropic 定价页 · 2024-03-04
API 速度
API
无自建选项
Arena Elo—
AA 综合指数—
代码—
GPQA 推理50.4
2024-03-04
架构简图
- 类型
- 未披露
- 注意力
- 未披露
- 层数
- 未披露
- 专家
- 未披露
- 隐藏维
- 未披露
- 词表
- 未披露
完善中
闭源模型,无自建选项,不提供显存表。
完善中
可用维度不足 3 个,不绘制雷达图
完善中
逻辑能力
2024 年初最强非推理模型之一,复杂指令与长链条分析稳定;数学 MATH 60.1% 一般。
亮点
- 1.MMLU 86.8%、GPQA 50.4%、GSM8K 95.0%
- 2.200K 上下文 needle 召回 99%,还"察觉"到测试
- 3.写作自然度与长文分析被广泛推崇
坑
- 1.$15 / $75 且速度慢
- 2.最大输出仅 4K
- 3.3 个月后被 1/5 价格的 3.5 Sonnet 超越
适合:历史对照
不适合:新项目
| 基准 | 分数 | 来源 | 日期 | 证据 |
|---|---|---|---|---|
| GPQA Diamond研究生级科学问答 | 50.4% | Anthropic Claude 3 发布公告 | 2024-03-04 | 厂商公布 |
| MMMU多模态理解 | 59.4% | Anthropic Claude 3 发布公告 | 2024-03-04 | 厂商公布 |
更新 2026-08-28 · 排名供选型参考,基准会饱和、会泄漏、会过时。