Kimi K2.6
月之暗面 Kimi K2.6 · Moonshot AI 月之暗面 · 发布 2026-04-20 · 当前代
1T/32B 多模态 agent 模型,K3 之下的性价比选择。
- 类型
- MoE
- 注意力
- MLA(64 头)
- 层数
- 61
- 专家
- 384 · 激活 8 + 共享
- 隐藏维
- 7168
- 词表
- 160,000
与 Kimi K2 / K2.5 同构(DeepSeek-V3 式 MLA + 384 专家),加 MoonViT 视觉编码器(400M),新增视频输入。原生 INT4 QAT 发布。
完善中
| 精度 | 权重大小 | 说明 |
|---|---|---|
| BF16 | 2053 GB | 官方精度 |
| FP8 | 1031 GB | |
| Q8 | — | 暂无 |
| Q4 | 595 GB | GGUF Q4_K_M 或等效 |
- 消费级 24GB
- 不可行
- 单卡 80GB
- 不可行
- 8×80GB 节点
- INT4 595 GB,8×H100 勉强,推荐 8×H200
KV Cache:MLA,与 K2 同:≈ 70 KiB/token。 ≈ 70 KiB/token
⚠ 能加载 ≠ 能在满上下文 / 高并发下舒服跑。标「估」的数字来自 计算器 公式或社区量化文件大小。
完善中
| 配置 | 量化 | 占用 / 显存 | 解码 tok/s | 预填充 tok/s | 最大上下文 |
|---|---|---|---|---|---|
| 8× RTX PRO 6000 Blackwell 96GB工作站 | Q5_K_M估 | 700 GB / 768 GB | 348 | 14063 | 1001K |
| 8× A100 80GB数据中心 | Q4_K_M | 605 GB / 640 GB | 469 | 17550 | 518K |
| 8× H20 96GB数据中心 | Q5_K_M估 | 700 GB / 768 GB | 776 | 4163 | 1001K |
| 8× H100 80GB PCIe数据中心 | Q4_K_M | 605 GB / 640 GB | 460 | 42525 | 518K |
| 8× H100 80GB SXM数据中心 | Q4_K_M | 605 GB / 640 GB | 770 | 55631 | 518K |
| 4× AMD MI300X 192GB数据中心 | Q5_K_M估 | 695 GB / 768 GB | 514 | 36759 | 1.0M |
| 8× H200 141GB数据中心 | FP8 | 1041 GB / 1128 GB | 654 | 55631 | 2.5M |
| 4× B200 192GB数据中心 | Q5_K_M估 | 695 GB / 768 GB | 776 | 63281 | 1.0M |
单流(batch=1)估算:解码 ≈ 显存带宽 × 效率 ÷ 每 token 读取字节(激活参数 × 量化位宽 + KV);预填充 ≈ FP16 算力 × 0.45 ÷ (2 × 激活参数)。多卡按张量并行、带宽求和 × 0.55。实际受引擎、驱动、PCIe 影响,误差 ±30%。反向查:我的卡能跑谁 →
编程SWE-Bench Verified 80.2、SWE-Bench Pro 58.6、Terminal-Bench 2.0 66.7、LiveCodeBench v6 89.6(官方)。
推理GPQA Diamond 90.5、HLE-Full 34.7 / 54.0(工具)(官方)。
数学AIME 2026 96.4、HMMT Feb 2026 92.7(官方)。
AgentBrowseComp 83.2、OSWorld-Verified 73.1、Toolathlon 50.0(官方)。
多模态MMMU-Pro 79.4、MathVision 87.4(官方)。
GPQA 90.5、HLE-Full 34.7 / 54.0(工具)、AIME 2026 96.4、BrowseComp 83.2。LMArena 1461。
- 1.SWE-Bench Verified 80.2、SWE-Bench Pro 58.6、LiveCodeBench v6 89.6(官方)
- 2.Agent Swarm 可并行 300 子 agent / 4000 步;支持图像与视频输入
- 3.思考可关(Instant 模式),API 价仅 K3 的 1/3
- 1.Modified MIT:月活 > 1 亿或月收入 > 2000 万美元须标注「Kimi K2.6」
- 2.INT4 595 GB 仍需 8×H100 以上
- 3.已被 K3 取代旗舰位置,官方主推 K3 / K2.7 Code
| 基准 | 分数 | 来源 | 日期 | 证据 |
|---|---|---|---|---|
| LMArena Text Elo人类偏好 Elo | 1461 | LMArena Text (style control) | 2026-08-28 | 独立复测 |
| SWE-bench Verified真实仓库修 bug | 80.2% | Kimi K2.6 模型卡 | 2026-08-28 | 厂商公布 |
| LiveCodeBench竞赛编程 | 89.6% | Kimi K2.6 模型卡 | 2026-08-28 | 厂商公布 |
| GPQA Diamond研究生级科学问答 | 90.5% | Kimi K2.6 模型卡 | 2026-08-28 | 厂商公布 |
| Humanity's Last Exam人类最后考试 | 34.7% | Kimi K2.6 模型卡 | 2026-08-28 | 厂商公布 |
| Terminal-Bench终端 agent | 66.7% | Kimi K2.6 模型卡 | 2026-08-28 | 厂商公布 |
| Artificial Analysis Intelligence IndexAA 综合指数 | 45 | Artificial Analysis (v4.1.1) | 2026-08-28 | 独立复测 |
| GPQA Diamond研究生级科学问答 | 91.1% | Artificial Analysis (v4.1.1) | 2026-08-28 | 独立复测 |
| Humanity's Last Exam人类最后考试 | 37.5% | Artificial Analysis (v4.1.1) | 2026-08-28 | 独立复测 |
| SciCode科学计算编程 | 53.5% | Artificial Analysis (v4.1.1) | 2026-08-28 | 独立复测 |
| Terminal-Bench Hard终端 agent(AA 困难子集) | 43.9% | Artificial Analysis (v4.1.1) | 2026-08-28 | 独立复测 |
| τ²-Bench Telecom工具调用 agent(电信域) | 95.9% | Artificial Analysis (v4.1.1) | 2026-08-28 | 独立复测 |
| MMMU-Pro多模态理解(Pro) | 79.4% | Artificial Analysis (v4.1.1) | 2026-08-28 | 独立复测 |
| IFBench指令遵循 | 76% | Artificial Analysis (v4.1.1) | 2026-08-28 | 独立复测 |
| Terminal-Bench终端 agent | 65.9% | Artificial Analysis · Terminal-Bench 2.1 | 2026-08-28 | 独立复测 |
| τ³-Bench Banking工具调用 agent(银行域) | 23.3% | Artificial Analysis · τ³-Bench Banking | 2026-08-28 | 独立复测 |
| LMArena Chinese Elo中文人类偏好 Elo | 1526 | LMArena Text · Chinese (style control) | 2026-08-28 | 独立复测 |
更新 2026-08-28 · 排名供选型参考,基准会饱和、会泄漏、会过时。