Kimi K3
月之暗面 2026 年 7 月 17 日发布的 Kimi K3,2.8T 开源权重、1M 上下文。Arena.ai 编程榜全球第一,AA 智能指数全球第三,权重 7-27 前公开。
发布 2026-07-20更新 2026-07-20规格
- 厂商
- 月之暗面
- 发布日期
- 2026/7/17
- 类型
- coding
- 上下文窗口
- 1000K tokens
- 最大输出
- 64K tokens
- 定价
- 混合价约 $2.3/M(输入 ¥20/M · 输出 ¥100/M)
- API 兼容
- openai, moonshot
基准测试
优势
- •Arena.ai 编程榜全球第一
- •2.8T 参数,当前最大开源中文大模型
- •1M 上下文,reasoning + vision 全能
- •权重将于 2026-07-27 前公开,可自托管
- •首创 Kimi Delta Attention + Attention Residual 架构
不足
- •API 混合价 $2.3/M 为中国模型最高档
- •2.8T 参数自托管部署成本高
- •综合智能指数(57)略低于 GPT-5.6 Sol / Gemini 3.1 Pro
- •生态与工具集成仍在完善
适用场景
概述
Kimi K3 是月之暗面于 2026 年 7 月 17 日发布的旗舰模型,也是当前参数量最大的开源中文大模型(2.8T 参数),1M 上下文,支持 reasoning 与 vision。它在 Arena.ai 编程对战榜上排名全球第一,Artificial Analysis 综合智能指数 57,位列全球第三(仅次于 GPT-5.6 Sol、Gemini 3.1 Pro)。
Kimi K3 把「开源」和「最强」两个标签同时贴到了一个中文模型上——模型权重将于 2026-07-27 前全部公开,意味着开发者第一次能够自托管一个编程能力接近顶级闭源模型的权重。
核心能力
编程登顶
| 维度 | Kimi K3 |
|---|---|
| Arena 编程榜 | 全球第一 |
| AA 智能指数 | 57(全球第三) |
| 参数量 | 2.8T(开源权重) |
| 上下文 | 1M |
| 能力 | reasoning + vision |
在 Arena.ai 的编程对战榜上,它压过了一众闭源前沿模型排到第一,综合智能指数也稳居全球第三。
架构创新
Kimi K3 首创 Kimi Delta Attention + Attention Residual 架构,专门提升长上下文场景下的注意力效率,这也是它能在 1M 上下文里保持稳定表现的关键。
开源权重的价值
对企业与政府客户,「权重可自托管」解决了三个刚需:数据不出域、成本可控、可深度微调。K3 的到来,加上 GLM-5.2、Qwen3.7,让 2026 下半年的中文开源阵营在编程赛道具备了与闭源正面竞争的实力。
API 调用示例
from openai import OpenAI
client = OpenAI(api_key="sk-...", base_url="https://api.moonshot.cn/v1")
resp = client.chat.completions.create(
model="kimi-k3",
messages=[{"role": "user", "content": "为这个仓库设计一套单元测试"}],
)
print(resp.choices[0].message.content)
定价
| 项目 | 价格 |
|---|---|
| 输入 | 约 ¥20/M |
| 输出 | 约 ¥100/M |
| 混合价 | 约 $2.3/M(中国模型最高档) |
价格是中国模型里的最高档,但对标其全球第一的编程能力仍具竞争力;若自托管开源权重,长期成本可进一步压低。
与同档模型怎么选
| 维度 | Kimi K3 | GLM-5.2 | DeepSeek V4-Pro |
|---|---|---|---|
| 参数 | 2.8T | 754B | 1.6T |
| 开源权重 | 7-27) | 部分 | |
| 编程 | Arena 第一 | AA 开源第一 | 强 |
| API 价 | $2.3/M | $1.40/$4.40 | ~$1.74/$3.48 |
| 上下文 | 1M | 1M | 1M |
建议:对编程能力要求最高、且有算力自托管的团队选 Kimi K3;预算敏感选 DeepSeek V4;要平衡能力与开源生态选 GLM-5.2。
避坑清单
- API 价不便宜:$2.3/M 是中国模型最高档,高频场景用 DeepSeek V4 更省。
- 自托管成本高:2.8T 参数的推理服务对算力要求极高,中小团队用官方 API 更务实。
- 等权重公开:计划自建的团队可等 7-27 权重全部公开后再评估。
FAQ
Q: Kimi K3 值得自托管吗? A: 对有算力、重数据合规的团队非常值得——7-27 权重公开后,可自建一个编程能力接近顶级闭源模型的推理服务,数据不出域且可深度微调。但 2.8T 参数的部署成本不低,中小团队用官方 API($2.3/M)仍是更务实的路径。
Q: 它和 DeepSeek V4 怎么选? A: 追求最强编程能力选 Kimi K3(Arena 第一);追求极致性价比选 DeepSeek V4-Flash($0.14/$0.28)。K3 赢在能力天花板,V4 赢在单位成本。
Q: 权重什么时候能下载? A: 官方计划 2026-07-27 前全部公开,延续 Moonshot 的开源路线。
延伸阅读
- 对比同档:DeepSeek V4 / GLM-5.2 / Qwen3-Coder
- 相关模型:Kimi K2 Thinking / Kimi K2
- 相关资讯:Kimi K3 发布
Augment Code vs Cursor:企业 AI 编程怎么选?Context Engine vs AI IDE 对比
Augment Code vs Cursor 2026 选型对比:Context Engine 全仓索引的企业 AI 平台 vs SpaceX 收购的 AI IDE 天花板,从形态、Context 覆盖、长任务、价格、合规、中文支持和适合人群 8 个维度判断,帮你选对企业 AI 编程工具。
GitHub Copilot vs Tabnine:AI 代码补全怎么选?2026 对比
GitHub Copilot vs Tabnine 2026 选型对比:微软+OpenAI 生态全面的 AI 编程助手 vs 老牌支持私有化部署的代码补全工具。从补全质量、IDE 覆盖、隐私部署、价格和适合人群 6 个维度帮你选对补全工具。
Cursor vs Aider:GUI IDE 还是 CLI?2026 对比
Cursor vs Aider 2026 选型对比:GUI IDE vs Git 原生 CLI,从 Composer vs Architect 双模型、Tab 补全、多模型 BYOK、价格计费、开源与否和适合人群判断,帮开发者选对。Cursor 是闭源 VS Code fork 月费 $20,Aider 是开源 Apache-2.0 CLI 自带 API key。
Cursor vs Claude Code:什么时候用哪个?(2026 实测选型)
Cursor 和 Claude Code 到底怎么选?一句话结论 + 决策树 + 价格实测 + 国内可用性对比。GUI 派选 Cursor,终端长任务派选 Claude Code,最优解其实是共存。
Cursor vs GitHub Copilot:AI IDE 还是插件?2026 对比
Cursor vs GitHub Copilot 2026 选型对比:AI 原生 IDE vs IDE 插件,从 Composer vs Agent Mode、Tab 补全、多模型、AI Credits 计费、企业版和适合人群判断,帮开发者选对。Cursor 是 VS Code fork 重写交互层,Copilot 是 VS Code 插件继承原生体验。两家都已切 usage 制。
Cursor vs Trae:国内开发者怎么选?价格、模型、网络和真实体验对比
Cursor vs Trae 2026 选型对比:从价格、模型能力、国内访问、Builder/Composer、多文件改写、MCP 生态和适合人群判断,帮国内开发者决定继续用 Cursor,还是切到字节 Trae。