闭源仅 API推理模型·可关多模态可商用 · Proprietary
GPT-5.5
GPT-5.5 · OpenAI · 发布 2026-04-23 · 当前代
GPT-5.6 之前的旗舰,1M 上下文,$5 / $30。
参数
未披露
上下文
1M
输出 125K
价格 / 1M tok
$5.00 / $30
OpenAI 官方定价页(d · 2026-08-28
API 速度
API ≈81 tok/s
首 token 62.42s · Artificial Analysis
Arena Elo1482
2026-08-28
AA 综合指数56
2026-08-28
代码—
GPQA 推理93.5
2026-08-28
架构简图
- 类型
- 未披露
- 注意力
- 未披露
- 层数
- 未披露
- 专家
- 未披露
- 隐藏维
- 未披露
- 词表
- 未披露
未披露。reasoning.effort 支持 none/low/medium/high/xhigh(无 max)。
完善中
闭源模型,无自建选项,不提供显存表。
完善中
编程Terminal-Bench 2.1 88.0%;SWE-bench Pro 58.6%。
推理HLE(带工具)52.2%。
AgentOSWorld-Verified 78.7%。
逻辑能力
GPT-5.6 发布前的旗舰:Terminal-Bench 2.1 88.0%(OpenAI 公告对比表)、HLE(带工具)52.2%、GDPval-AA 1769(Anthropic Opus 4.8 公告表,Vellum 转录)。综合能力与 Opus 4.7 相当,已被 GPT-5.6 Sol 在同价位全面覆盖。
亮点
- 1.LMArena 文本榜 1482(GPT-5.5 High),与 GPT-5.6 Sol 持平
- 2.Terminal-Bench 2.1 88.0%、OSWorld-Verified 78.7%
- 3.1.05M 上下文 + 128K 输出;另有 gpt-5.5-pro($30 / $180)
坑
- 1.$5 / $30 比 GPT-5.6 Sol 促销价贵,且无 max 推理档,性价比已被 Sol 反超
- 2.SWE-bench Pro 58.6% 明显落后 Opus 4.8(69.2%)
- 3.无自建
适合:已在 GPT-5.5 上调优的存量系统 · 需要 gpt-5.5-pro 高精度档的场景
不适合:新项目(改用 GPT-5.6 Sol) · 私有化部署
| 基准 | 分数 | 来源 | 日期 | 证据 |
|---|---|---|---|---|
| LMArena Text Elo人类偏好 Elo | 1482 | LMArena Text (style control) | 2026-08-28 | 独立复测 |
| Terminal-Bench终端 agent | 88% | OpenAI 发布公告 | 2026-08-28 | 厂商公布 |
| Artificial Analysis Intelligence IndexAA 综合指数 | 56 | Artificial Analysis (v4.1.1) | 2026-08-28 | 独立复测 |
| GPQA Diamond研究生级科学问答 | 93.5% | Artificial Analysis (v4.1.1) | 2026-08-28 | 独立复测 |
| Humanity's Last Exam人类最后考试 | 45.8% | Artificial Analysis (v4.1.1) | 2026-08-28 | 独立复测 |
| SciCode科学计算编程 | 56.1% | Artificial Analysis (v4.1.1) | 2026-08-28 | 独立复测 |
| Terminal-Bench Hard终端 agent(AA 困难子集) | 60.6% | Artificial Analysis (v4.1.1) | 2026-08-28 | 独立复测 |
| τ²-Bench Telecom工具调用 agent(电信域) | 93.9% | Artificial Analysis (v4.1.1) | 2026-08-28 | 独立复测 |
| MMMU-Pro多模态理解(Pro) | 79.9% | Artificial Analysis (v4.1.1) | 2026-08-28 | 独立复测 |
| IFBench指令遵循 | 75.9% | Artificial Analysis (v4.1.1) | 2026-08-28 | 独立复测 |
| Terminal-Bench终端 agent | 84.3% | Artificial Analysis · Terminal-Bench 2.1 | 2026-08-28 | 独立复测 |
| τ³-Bench Banking工具调用 agent(银行域) | 39% | Artificial Analysis · τ³-Bench Banking | 2026-08-28 | 独立复测 |
| LMArena Chinese Elo中文人类偏好 Elo | 1529 | LMArena Text · Chinese (style control) | 2026-08-28 | 独立复测 |
更新 2026-08-28 · 排名供选型参考,基准会饱和、会泄漏、会过时。