闭源仅 API推理模型多模态已被替代可商用 · Proprietary
OpenAI logo

OpenAI o4-mini

OpenAI · 发布 2025-04-16 · 已被替代GPT-5 mini

小推理模型,AIME 2025 92.7% 超过 o3。

参数
未披露
上下文
200K
输出 98K
价格 / 1M tok
$1.10 / $4.40
OpenAI 定价页 · 2025-04-16
API 速度
API
无自建选项
Arena Elo
AA 综合指数
真实仓库修 bug68.1
2025-04-16
GPQA 推理81.4
2025-04-16
类型
未披露
注意力
未披露
层数
未披露
专家
未披露
隐藏维
未披露
词表
未披露

完善中

Token Embedding未披露× ? 层注意力(未披露)FFN / MoE(未披露)厂商未公开内部结构LM Head参数未披露实线 = 已公开 · 虚线 = 未披露

闭源模型,无自建选项,不提供显存表。

完善中

完善中

逻辑能力

考试型推理极强(数学、竞赛编程),知识型推理和长任务稳定性弱于 o3。

亮点
  1. 1.AIME 2025 92.7%(无工具),数学超越 o3
  2. 2.$1.1 / $4.4,与 o3-mini 同价但带视觉与工具
  3. 3.SWE-bench Verified 68.1%,接近 o3
  1. 1.GPQA 81.4%、HLE 14.3%,知识面弱于 o3
  2. 2.幻觉率偏高(PersonQA 48%)
  3. 3.4 个月后被 GPT-5 mini 替代
适合:历史对照
不适合:新项目
基准分数来源日期证据
SWE-bench Verified真实仓库修 bug68.1%OpenAI o3 / o4-mini 发布公告(无工具)2025-04-16厂商公布
GPQA Diamond研究生级科学问答81.4%OpenAI o3 / o4-mini 发布公告(无工具)2025-04-16厂商公布
Humanity's Last Exam人类最后考试14.3%OpenAI o3 / o4-mini 发布公告(无工具)2025-04-16厂商公布
AIME 2025美国数学邀请赛92.7%OpenAI o3 / o4-mini 发布公告(无工具)2025-04-16厂商公布
MMMU多模态理解81.6%OpenAI o3 / o4-mini 发布公告(无工具)2025-04-16厂商公布

更新 2026-08-28 · 排名供选型参考,基准会饱和、会泄漏、会过时。