闭源仅 API推理模型·可关多模态可商用 · Proprietary
Gemini 3.5 Flash-Lite
Gemini 3.5 闪电轻量版 · Google 谷歌 · 发布 2026-07-21 · 当前代
Google 当前最便宜的 1M 上下文多模态模型,吞吐优先。
参数
未披露
上下文
1M
输出 64K
价格 / 1M tok
$0.30 / $2.50
Google AI 定价页 · 2026-08-28
API 速度
API ≈346 tok/s
首 token 8.76s · Artificial Analysis
Arena Elo1458
2026-08-28
AA 综合指数37
2026-08-28
代码—
GPQA 推理83.8
2026-08-28
架构简图
- 类型
- 未披露
- 注意力
- 未披露
- 层数
- 未披露
- 专家
- 未披露
- 隐藏维
- 未披露
- 词表
- 未披露
未披露。
完善中
闭源模型,无自建选项,不提供显存表。
完善中
编程SWE-Bench Pro 54.2%(官方模型卡)。
AgentTerminal-Bench 2.1 54.0%、OSWorld-Verified 74.0%(官方)。
逻辑能力
轻量档,agent / 抽取 / 分类类任务为主。SWE-Bench Pro 54.2%、OSWorld-Verified 74.0%。深度推理应上 Flash 或 Pro。
亮点
- 1.$0.30 / $2.50,1M 上下文,全模态输入
- 2.AA 实测约 350 tok/s,Terminal-Bench 2.1 54.0%(上代 3.1 Flash-Lite 31.0%)
- 3.GDM-MRCR v2 128K 72.2%,长上下文检索远超 Haiku 4.5 / GPT-5.4 mini
坑
- 1.AA 智能指数 37,复杂推理明显弱于 Flash 主力
- 2.输出价 $2.50 比上代 3.1 Flash-Lite($1.50)贵 67%,纯文本轻任务未必划算
- 3.官方未公布 GPQA / HLE / MMMU 等通用基准
适合:大规模文档抽取 / 翻译 · agentic search · 低延迟高并发
不适合:复杂推理与数学 · 私有化部署
| 基准 | 分数 | 来源 | 日期 | 证据 |
|---|---|---|---|---|
| LMArena Text Elo人类偏好 Elo | 1458 | LMArena Text (style control) | 2026-08-28 | 独立复测 |
| Artificial Analysis Intelligence IndexAA 综合指数 | 37 | Artificial Analysis Intelligence Index v3 | 2026-08-28 | 独立复测 |
| Artificial Analysis Intelligence IndexAA 综合指数 | 37 | Artificial Analysis (v4.1.1) | 2026-08-28 | 独立复测 |
| GPQA Diamond研究生级科学问答 | 83.8% | Artificial Analysis (v4.1.1) | 2026-08-28 | 独立复测 |
| Humanity's Last Exam人类最后考试 | 18.8% | Artificial Analysis (v4.1.1) | 2026-08-28 | 独立复测 |
| SciCode科学计算编程 | 40.9% | Artificial Analysis (v4.1.1) | 2026-08-28 | 独立复测 |
| MMMU-Pro多模态理解(Pro) | 79% | Artificial Analysis (v4.1.1) | 2026-08-28 | 独立复测 |
| Terminal-Bench终端 agent | 53.6% | Artificial Analysis · Terminal-Bench 2.1 | 2026-08-28 | 独立复测 |
| τ³-Bench Banking工具调用 agent(银行域) | 17.5% | Artificial Analysis · τ³-Bench Banking | 2026-08-28 | 独立复测 |
| LMArena Chinese Elo中文人类偏好 Elo | 1485 | LMArena Text · Chinese (style control) | 2026-08-28 | 独立复测 |
更新 2026-08-28 · 排名供选型参考,基准会饱和、会泄漏、会过时。