闭源仅 API多模态已被替代可商用 · Proprietary
Gemini 2.0 Flash
Google · 发布 2025-02-05 · 已被替代 → Gemini 2.5 Flash
代理时代的低价主力,$0.1 输入超越 1.5 Pro。
参数
未披露
上下文
1M
输出 8K
价格 / 1M tok
$0.10 / $0.40
Google AI 定价页 · 2025-02-05
API 速度
API
无自建选项
Arena Elo—
AA 综合指数—
真实仓库修 bug51.8
2025-02-05
GPQA 推理60.1
2025-02-05
架构简图
- 类型
- 未披露
- 注意力
- 未披露
- 层数
- 未披露
- 专家
- 未披露
- 隐藏维
- 未披露
- 词表
- 未披露
未披露。2024-12-11 发布实验版,2025-02-05 GA;原生工具使用、原生图像 / 音频输出(实验)。
未披露。Google 未公开参数量。
已知信息:
- 1M 上下文,8K 最大输出
- 原生工具使用:Google 搜索接地、代码执行
- Multimodal Live API:实时双向音视频流
- 实验版支持原生图像输出与多语言 TTS
- Flash-Lite 为更低价变体(2025-02)
闭源模型,无自建选项,不提供显存表。
无自建选项。
成本参考:文本 / 图像 / 视频输入 $0.10、音频输入 $0.70、输出 $0.40;缓存输入 $0.025。
编程LiveCodeBench v5 34.5%(官方,GA 表);实验版 SWE-bench Verified 51.8%(2024-12 官方表)。
推理GPQA Diamond 60.1%、MMLU-Pro 77.6%(官方 GA 表)。
数学MATH 90.9%、HiddenMath 63.5%(官方)。
Agent原生工具使用、Multimodal Live API;Project Astra / Mariner 底座。
多模态MMMU 71.7%(官方);音频 / 视频输入。
中文Global MMLU Lite 83.4%(官方),中文良好。
逻辑能力
非推理小模型中的强者,MATH 90.9%;复杂多步推理需要 2.5 系列的 thinking。常见问题:长代理任务中容易偏离指令。
亮点
- 1.以 Flash 价格超越 1.5 Pro,GPQA 60.1%、MMMU 71.7%
- 2.原生工具调用(搜索、代码执行)、Multimodal Live API
- 3.1M 上下文,$0.1 / $0.4 的价格带来大规模应用采用
坑
- 1.无推理模式,LiveCodeBench 34.5%
- 2.最大输出 8K
- 3.原生图像生成等功能长期停留实验阶段
适合:高并发低成本应用(当年) · 多模态输入理解 · 历史对照
不适合:复杂推理 · 新项目
| 基准 | 分数 | 来源 | 日期 | 证据 |
|---|---|---|---|---|
| SWE-bench Verified真实仓库修 bug | 51.8% | Google Gemini 2.0 Flash GA 表(LiveCodeBench v5;SWE-bench 51.8 来自 2024-12 开发者博客,含代码执行工具) | 2025-02-05 | 厂商公布 |
| LiveCodeBench竞赛编程 | 34.5% | Google Gemini 2.0 Flash GA 表(LiveCodeBench v5;SWE-bench 51.8 来自 2024-12 开发者博客,含代码执行工具) | 2025-02-05 | 厂商公布 |
| GPQA Diamond研究生级科学问答 | 60.1% | Google Gemini 2.0 Flash GA 表(LiveCodeBench v5;SWE-bench 51.8 来自 2024-12 开发者博客,含代码执行工具) | 2025-02-05 | 厂商公布 |
| MMMU多模态理解 | 71.7% | Google Gemini 2.0 Flash GA 表(LiveCodeBench v5;SWE-bench 51.8 来自 2024-12 开发者博客,含代码执行工具) | 2025-02-05 | 厂商公布 |
更新 2026-08-28 · 排名供选型参考,基准会饱和、会泄漏、会过时。