Kimi K3
月之暗面 2026 年 7 月 17 日发布的 Kimi K3,2.8T 开源权重、1M 上下文。Arena.ai 编程榜全球第一,AA 智能指数全球第三,权重 7-27 前公开。
发布 2026-07-20更新 2026-07-20规格
- 厂商
- 月之暗面
- 发布日期
- 2026/7/17
- 类型
- coding
- 上下文窗口
- 1000K tokens
- 最大输出
- 64K tokens
- 定价
- 混合价约 $2.3/M(输入 ¥20/M · 输出 ¥100/M)
- API 兼容
- openai, moonshot
基准测试
✓ 优势
- •Arena.ai 编程榜全球第一
- •2.8T 参数,当前最大开源中文大模型
- •1M 上下文,reasoning + vision 全能
- •权重将于 2026-07-27 前公开,可自托管
- •首创 Kimi Delta Attention + Attention Residual 架构
⚠ 不足
- •API 混合价 $2.3/M 为中国模型最高档
- •2.8T 参数自托管部署成本高
- •综合智能指数(57)略低于 GPT-5.6 Sol / Gemini 3.1 Pro
- •生态与工具集成仍在完善
适用场景
概述
Kimi K3 是月之暗面于 2026 年 7 月 17 日发布的旗舰模型,也是当前参数量最大的开源中文大模型(2.8T 参数),1M 上下文,支持 reasoning 与 vision。它在 Arena.ai 编程对战榜上排名全球第一,Artificial Analysis 综合智能指数 57,位列全球第三(仅次于 GPT-5.6 Sol、Gemini 3.1 Pro)。
Kimi K3 把「开源」和「最强」两个标签同时贴到了一个中文模型上——模型权重将于 2026-07-27 前全部公开,意味着开发者第一次能够自托管一个编程能力接近顶级闭源模型的权重。
核心能力
编程登顶
| 维度 | Kimi K3 |
|---|---|
| Arena 编程榜 | 全球第一 |
| AA 智能指数 | 57(全球第三) |
| 参数量 | 2.8T(开源权重) |
| 上下文 | 1M |
| 能力 | reasoning + vision |
在 Arena.ai 的编程对战榜上,它压过了一众闭源前沿模型排到第一,综合智能指数也稳居全球第三。
架构创新
Kimi K3 首创 Kimi Delta Attention + Attention Residual 架构,专门提升长上下文场景下的注意力效率,这也是它能在 1M 上下文里保持稳定表现的关键。
开源权重的价值
对企业与政府客户,「权重可自托管」解决了三个刚需:数据不出域、成本可控、可深度微调。K3 的到来,加上 GLM-5.2、Qwen3.7,让 2026 下半年的中文开源阵营在编程赛道具备了与闭源正面竞争的实力。
API 调用示例
from openai import OpenAI
client = OpenAI(api_key="sk-...", base_url="https://api.moonshot.cn/v1")
resp = client.chat.completions.create(
model="kimi-k3",
messages=[{"role": "user", "content": "为这个仓库设计一套单元测试"}],
)
print(resp.choices[0].message.content)
定价
| 项目 | 价格 |
|---|---|
| 输入 | 约 ¥20/M |
| 输出 | 约 ¥100/M |
| 混合价 | 约 $2.3/M(中国模型最高档) |
价格是中国模型里的最高档,但对标其全球第一的编程能力仍具竞争力;若自托管开源权重,长期成本可进一步压低。
与同档模型怎么选
| 维度 | Kimi K3 | GLM-5.2 | DeepSeek V4-Pro |
|---|---|---|---|
| 参数 | 2.8T | 754B | 1.6T |
| 开源权重 | ✅(7-27) | ✅ | 部分 |
| 编程 | Arena 第一 | AA 开源第一 | 强 |
| API 价 | $2.3/M | $1.40/$4.40 | ~$1.74/$3.48 |
| 上下文 | 1M | 1M | 1M |
建议:对编程能力要求最高、且有算力自托管的团队选 Kimi K3;预算敏感选 DeepSeek V4;要平衡能力与开源生态选 GLM-5.2。
避坑清单
- API 价不便宜:$2.3/M 是中国模型最高档,高频场景用 DeepSeek V4 更省。
- 自托管成本高:2.8T 参数的推理服务对算力要求极高,中小团队用官方 API 更务实。
- 等权重公开:计划自建的团队可等 7-27 权重全部公开后再评估。
FAQ
Q: Kimi K3 值得自托管吗? A: 对有算力、重数据合规的团队非常值得——7-27 权重公开后,可自建一个编程能力接近顶级闭源模型的推理服务,数据不出域且可深度微调。但 2.8T 参数的部署成本不低,中小团队用官方 API($2.3/M)仍是更务实的路径。
Q: 它和 DeepSeek V4 怎么选? A: 追求最强编程能力选 Kimi K3(Arena 第一);追求极致性价比选 DeepSeek V4-Flash($0.14/$0.28)。K3 赢在能力天花板,V4 赢在单位成本。
Q: 权重什么时候能下载? A: 官方计划 2026-07-27 前全部公开,延续 Moonshot 的开源路线。
延伸阅读
- 对比同档:DeepSeek V4 / GLM-5.2 / Qwen3-Coder
- 相关模型:Kimi K2 Thinking / Kimi K2
- 相关资讯:Kimi K3 发布