闭源仅 API推理模型多模态已被替代可商用 · Proprietary
OpenAI o4-mini
OpenAI · 发布 2025-04-16 · 已被替代 → GPT-5 mini
小推理模型,AIME 2025 92.7% 超过 o3。
参数
未披露
上下文
200K
输出 98K
价格 / 1M tok
$1.10 / $4.40
OpenAI 定价页 · 2025-04-16
API 速度
API
无自建选项
Arena Elo—
AA 综合指数—
真实仓库修 bug68.1
2025-04-16
GPQA 推理81.4
2025-04-16
架构简图
- 类型
- 未披露
- 注意力
- 未披露
- 层数
- 未披露
- 专家
- 未披露
- 隐藏维
- 未披露
- 词表
- 未披露
完善中
闭源模型,无自建选项,不提供显存表。
完善中
完善中
逻辑能力
考试型推理极强(数学、竞赛编程),知识型推理和长任务稳定性弱于 o3。
亮点
- 1.AIME 2025 92.7%(无工具),数学超越 o3
- 2.$1.1 / $4.4,与 o3-mini 同价但带视觉与工具
- 3.SWE-bench Verified 68.1%,接近 o3
坑
- 1.GPQA 81.4%、HLE 14.3%,知识面弱于 o3
- 2.幻觉率偏高(PersonQA 48%)
- 3.4 个月后被 GPT-5 mini 替代
适合:历史对照
不适合:新项目
| 基准 | 分数 | 来源 | 日期 | 证据 |
|---|---|---|---|---|
| SWE-bench Verified真实仓库修 bug | 68.1% | OpenAI o3 / o4-mini 发布公告(无工具) | 2025-04-16 | 厂商公布 |
| GPQA Diamond研究生级科学问答 | 81.4% | OpenAI o3 / o4-mini 发布公告(无工具) | 2025-04-16 | 厂商公布 |
| Humanity's Last Exam人类最后考试 | 14.3% | OpenAI o3 / o4-mini 发布公告(无工具) | 2025-04-16 | 厂商公布 |
| AIME 2025美国数学邀请赛 | 92.7% | OpenAI o3 / o4-mini 发布公告(无工具) | 2025-04-16 | 厂商公布 |
| MMMU多模态理解 | 81.6% | OpenAI o3 / o4-mini 发布公告(无工具) | 2025-04-16 | 厂商公布 |
更新 2026-08-28 · 排名供选型参考,基准会饱和、会泄漏、会过时。