产品简介
Kimi K3 是月之暗面(Moonshot AI)于 2026 年 7 月 16 日晚正式发布的新一代旗舰大模型,也是公司迄今能力最强的模型。K3 总参数达 **2.8 万亿**(MoE 架构,896 个专家中动态激活 16 个),超越 DeepSeek V4 Pro 的 1.6 万亿,成为**全球参数规模最大的开源权重模型**。技术架构上采用自研 **KDA 混合线性注意力机制**(Kimi Delta Attention)+ 注意力残差(Attention Residuals)技术,原生支持视觉理解,拥有 **100 万 token 上下文窗口**。
**成绩亮点**:在 Frontend Code Arena 前端代码竞技场以 **1679 分登顶全球第一**,超越 Claude Fable 5。已在 Kimi App、Kimi Work、Kimi Code 和 API 中同步上线,**完整模型权重计划 2026/7/27 开源**。
**罕见的诚实姿态**:官方在发布博客首页主动写明"整体能力仍落后于 Claude Fable 5 和 GPT-5.6 Sol",尤其在 HLE(Humanity's Last Exam)推理测试上差距明显,没有像多数厂商那样只展示获胜的跑分项。这种"输分表也敢挂出来"的姿态在行业内获得不少认可。
发布次日(7/19)即有报道称月之暗面**最快 6 个月内有望完成港股 IPO**,当月 ARR 已达 3 亿美元,K3 发布后据报预计实现数倍增长。
核心功能
- 2.8 万亿参数(全球开源之最):MoE 架构,896 个专家中动态激活 16 个,超越 DeepSeek V4 Pro(1.6T)成为全球参数规模最大的开源权重模型
- KDA 混合线性注意力机制:自研 Kimi Delta Attention + 注意力残差技术,是 K3 推理效率与长上下文能力的核心技术支撑
- 100 万 token 上下文 + 原生视觉理解:支持超长文档/代码库处理,同时原生支持图像输入理解,无需额外适配
- Frontend Code Arena 全球第一:1679 分登顶前端代码竞技场,超越 Claude Fable 5,是目前口碑最集中的强项
- 官方主动公示短板(诚实姿态):发布博客首页写明整体能力仍落后 Fable 5 / GPT-5.6 Sol,HLE 推理测试差距明显,不做选择性展示
- 四端同步上线:Kimi App、Kimi Work、Kimi Code 和 API 同步支持,完整权重 2026/7/27 开源
适合谁用
以下类型的用户会特别受益于 Kimi K3:
- 前端代码生成与 UI 开发(当前最强项)
- 需要百万级 token 上下文的长文档/大型代码库分析
- 多模态(图像理解)与文本结合的复杂任务
- 追求全球最大参数开源模型自部署能力的企业与研究机构
- 对比评估国产开源模型与 Fable 5/GPT-5.6 差距的技术选型场景
优点亮点
- 全球参数规模最大的开源权重模型,技术话语权标志性突破
- Frontend Code Arena 全球第一,前端代码生成能力顶尖
- 100 万 token 原生上下文 + 视觉理解,多模态能力扎实
- 官方主动公示短板,行业内少见的诚实姿态,值得信任
- 四端(App/Work/Code/API)同步上线,落地速度快
价格与方案
API 定价:输入 $3.00/M token(命中缓存降至 $0.30/M)、输出 $15.00/M token,较 K2.6(输入 $0.95/M、输出 $4.00/M)明显上调,对应 100 万 token 超长上下文与更强推理能力。Kimi App/Work/Code 内直接可用(免费与付费额度视具体产品线而定)。完整开源权重 2026/7/27 发布后可免费下载自部署,但因总参数规模巨大,个人本地部署基本不现实,实际可行路径是社区量化版本 + 云端托管推理。
总结与建议
Kimi K3 是 2026 年国产大模型竞赛的标志性事件之一——2.8 万亿参数登顶全球最大开源模型,前端代码能力全球第一,同时官方罕见地在发布首页就承认整体能力仍落后 Claude Fable 5 和 GPT-5.6 Sol,这种诚实姿态比单纯堆参数更值得称道。如果你的核心需求是前端代码生成或需要超大规模开源模型做自主可控部署,K3 是当前最值得关注的选项;但如果你需要顶尖的通用推理能力(HLE 等),目前仍应优先选择 Fable 5 / GPT-5.6 Sol。完整权重 7/27 开源后,建议关注社区量化方案降低部署门槛。
版本演进
- Kimi K3 正式发布 (2026/07/16):2.8万亿参数登顶全球最大开源权重模型,KDA混合线性注意力+100万token上下文+原生视觉理解,Frontend Code Arena全球第一(1679分超Fable 5);官方主动公示HLE等推理测试仍落后Fable 5/GPT-5.6 Sol;四端同步上线,完整权重7/27开源
- Kimi K2.7 Code (2026/06/12):编程专项小迭代,1.1T MoE/32B激活/256K上下文,3项编程基准超K2.6,token消耗减30%
- Kimi K2.6 (2026/04/20):MIT协议开源,13小时连续编码+300 Agent集群,代码能力对标当时国际顶级闭源模型