返回博客
Kimi K3月之暗面开源大模型AI 大模型AI 编程LLM2026

Kimi K3 深度解析:全球首个开源 3T 级模型,定价、架构与影响

2026-08-127 min read

Kimi K3 深度解析:全球首个开源 3T 级模型,定价、架构与影响

⚡ 快速回答: Kimi K3 是月之暗面(Moonshot AI)2026 年 7 月 17 日发布的旗舰模型——全球首个开源 3T 级模型(2.8T 参数)。它拥有 100 万 token 上下文窗口、原生视觉理解,以及全新的 KDA(Kimi Delta Attention)注意力架构(896 专家 MoE)。API 定价 ¥20 输入 / ¥100 输出(每 1M tokens),缓存命中 ¥2。完整权重已于 7 月 27 日前开源。发布当日曾引发美股芯片股下跌,为开源模型树立了新标杆。


Kimi K3 是什么

Kimi K3 是月之暗面迄今能力最强的模型,也是开源 AI 的里程碑——2.8 万亿参数,让开源权重模型首次进入 3T 级规模,这一级别此前只属于闭源前沿模型。

它的三大核心场景:

  • 长程编程 — 极少人工监督下持续完成工程任务,理解大型代码库,协调终端工具
  • 端到端知识工作 — 覆盖调研、规划、执行的智能体工作流
  • 推理 — 始终思考模式,支持可配置推理强度

它还能结合软件工程与视觉推理——利用截图和视觉反馈优化游戏开发、前端和 CAD 等场景。

Kimi K3 架构与规格

规格 Kimi K3
参数量 2.8T(全球首个开源 3T 级)
架构 KDA(Kimi Delta Attention)+ 注意力残差
MoE 896 个专家,激活 16 个(Stable LatentMoE)
上下文窗口 1,048,576 tokens(100 万)
多模态 原生视觉理解
推理模式 始终开启,reasoning_effort: low / high / max
扩展效率 相比 K2 提升约 2.5 倍
权重开源 2026 年 7 月 27 日前发布

两大架构创新:

  • KDA(Kimi Delta Attention) — 让信息在更长序列和更深模型中流动更顺畅
  • 注意力残差(AttnRes) — 配合 KDA 保证超大规模训练稳定性

配合更稀疏的 MoE(896 专家中激活 16 个),这些改进让 Kimi K3 相比 K2 的扩展效率提升约 2.5 倍——同样的算力换来更多能力。

Kimi K3 定价(API)

计费项 价格
输入(缓存未命中) ¥20.00 / 1M tokens
输入(缓存命中) ¥2.00 / 1M tokens
输出 ¥100.00 / 1M tokens
上下文窗口 1M tokens

💡 访问提示: Kimi K3 需要在开放平台充值(最低 10 元)后解锁调用,新用户 15 元代金券不可用于 K3。模型 ID:kimi-k3

作为旗舰定位,K3 的 ¥100 输出价格处于国产模型高端区间——约为 Kimi K2.6 输出价(¥27)的 3.7 倍,对应其前沿级规模定位。

为什么 Kimi K3 值得关注

1. 开源模型的规模纪录

过去 12 个月(2025/07–2026/07)中,月之暗面有 9 个月保持开源模型规模上限。K3 把纪录推进到 3T 级——一个让开源模型足以挑战闭源前沿的临界规模。

2. 真实的市场冲击

7 月 17 日发布当天,美股芯片股(英伟达、美光)应声下跌——市场开始定价"高效开源模型降低前沿训练算力需求"的叙事。需求之火爆甚至让月之暗面一度暂停新用户订阅以应对服务器压力。

3. 倒逼 xAI 表态

马斯克公开把 Grok 4.6 定义为 Kimi K3 的回应——连最激进的美国实验室都开始以中国开源模型为基准。Kimi K3 是 2026 年中「开源 vs 闭源」叙事转向的关键推手。

Kimi K3 与主流模型对比

模型 参数量 上下文 输入/输出(每 1M) 开源权重
Kimi K3 2.8T 1M ¥20 / ¥100
Kimi K2.6 ~1T 256K ¥6.50 / ¥27
Grok 4.5 1.5T (V9) 500K $2 / $6
GPT-5.6 Sol $5 / $25
Claude Fable 5 $10 / $50

Kimi K3 定价属于旗舰高端档,但它是其中唯一可以下载自部署的模型——也是第一个证明 3T 级规模可以开源的模型。

如何开始使用 Kimi K3

  1. 充值至少 10 元(platform.kimi.com,代金券不可用)
  2. 申请 API Key(控制台)
  3. 调用 API — OpenAI 兼容,base URL https://api.moonshot.cn/v1,模型 kimi-k3
  4. 调节推理强度 — 顶层参数 reasoning_effortlow / high / max(默认 max
from openai import OpenAI

client = OpenAI(
    api_key="MOONSHOT_API_KEY",
    base_url="https://api.moonshot.cn/v1",
)

resp = client.chat.completions.create(
    model="kimi-k3",
    messages=[{"role": "user", "content": "用一句话介绍 KDA 注意力机制。"}],
)
print(resp.choices[0].message.content)

FAQ

Kimi K3 真的是开源的吗?

是的。月之暗面确认完整模型权重于 2026 年 7 月 27 日前发布,技术报告随后公开。它是首个达到 3T 级规模(2.8T 参数)的开源模型。

Kimi K3 多少钱?

API 定价为每 1M tokens 输入 ¥20(缓存命中 ¥2)、输出 ¥100,上下文窗口 1M tokens。需要最低充值 10 元。

可以本地运行 Kimi K3 吗?

权重开源后技术上可以,但 2.8T 参数需要多节点推理基础设施——大多数团队会使用托管 API 或社区量化版本。

什么是 KDA(Kimi Delta Attention)?

它是 Kimi 的新注意力机制,专门优化长序列与深层模型中的信息流动,配合注意力残差保证超大规模训练稳定。

Kimi K3 支持图片输入吗?

支持——原生视觉理解,包括编程、游戏开发和 CAD 场景的视觉推理能力。


总结

Kimi K3 不只是又一款新模型——它是开源首次追平闭源前沿规模的标志性事件。如果你在构建智能体编程或知识工作管线,且重视开源权重,K3 值得认真评估(尽管定价偏高)。如果你想观察开源与闭源之争的走向,它是过去一个月最重要的发布。

相关阅读: