闭源仅 API推理模型·可关多模态可商用 · Proprietary
Google logo

Gemini 3.5 Flash-Lite

Gemini 3.5 闪电轻量版 · Google 谷歌 · 发布 2026-07-21 · 当前代

Google 当前最便宜的 1M 上下文多模态模型,吞吐优先。

参数
未披露
上下文
1M
输出 64K
价格 / 1M tok
$0.30 / $2.50
Google AI 定价页 · 2026-08-28
API 速度
API ≈346 tok/s
首 token 8.76s · Artificial Analysis
Arena Elo1458
2026-08-28
AA 综合指数37
2026-08-28
代码
GPQA 推理83.8
2026-08-28
类型
未披露
注意力
未披露
层数
未披露
专家
未披露
隐藏维
未披露
词表
未披露

未披露。

完善中

Token Embedding未披露× ? 层注意力(未披露)FFN / MoE(未披露)厂商未公开内部结构LM Head参数未披露实线 = 已公开 · 虚线 = 未披露

闭源模型,无自建选项,不提供显存表。

完善中

编程SWE-Bench Pro 54.2%(官方模型卡)。

AgentTerminal-Bench 2.1 54.0%、OSWorld-Verified 74.0%(官方)。

逻辑能力

轻量档,agent / 抽取 / 分类类任务为主。SWE-Bench Pro 54.2%、OSWorld-Verified 74.0%。深度推理应上 Flash 或 Pro。

亮点
  1. 1.$0.30 / $2.50,1M 上下文,全模态输入
  2. 2.AA 实测约 350 tok/s,Terminal-Bench 2.1 54.0%(上代 3.1 Flash-Lite 31.0%)
  3. 3.GDM-MRCR v2 128K 72.2%,长上下文检索远超 Haiku 4.5 / GPT-5.4 mini
  1. 1.AA 智能指数 37,复杂推理明显弱于 Flash 主力
  2. 2.输出价 $2.50 比上代 3.1 Flash-Lite($1.50)贵 67%,纯文本轻任务未必划算
  3. 3.官方未公布 GPQA / HLE / MMMU 等通用基准
适合:大规模文档抽取 / 翻译 · agentic search · 低延迟高并发
不适合:复杂推理与数学 · 私有化部署
基准分数来源日期证据
LMArena Text Elo人类偏好 Elo1458LMArena Text (style control)2026-08-28独立复测
Artificial Analysis Intelligence IndexAA 综合指数37Artificial Analysis Intelligence Index v32026-08-28独立复测
Artificial Analysis Intelligence IndexAA 综合指数37Artificial Analysis (v4.1.1)2026-08-28独立复测
GPQA Diamond研究生级科学问答83.8%Artificial Analysis (v4.1.1)2026-08-28独立复测
Humanity's Last Exam人类最后考试18.8%Artificial Analysis (v4.1.1)2026-08-28独立复测
SciCode科学计算编程40.9%Artificial Analysis (v4.1.1)2026-08-28独立复测
MMMU-Pro多模态理解(Pro)79%Artificial Analysis (v4.1.1)2026-08-28独立复测
Terminal-Bench终端 agent53.6%Artificial Analysis · Terminal-Bench 2.12026-08-28独立复测
τ³-Bench Banking工具调用 agent(银行域)17.5%Artificial Analysis · τ³-Bench Banking2026-08-28独立复测
LMArena Chinese Elo中文人类偏好 Elo1485LMArena Text · Chinese (style control)2026-08-28独立复测

更新 2026-08-28 · 排名供选型参考,基准会饱和、会泄漏、会过时。