产品简介
Kimi 是月之暗面(Moonshot AI)推出的 AI 对话助手,以超长文本处理能力起家。它是国内最早支持超长上下文的 AI 产品,一经推出即引发关注,如今已从单纯的长文本助手成长为覆盖 Agent、编程、企业办公(Kimi Work)的综合性 AI 平台。
**重大发布:2026/7/16 晚正式发布新一代旗舰 Kimi K3**——总参数 **2.8 万亿**(超越 DeepSeek V4 Pro 的 1.6 万亿),成为**全球参数规模最大的开源权重模型**,采用 MoE 架构(896 个专家中动态激活 16 个)+ 自研 KDA 混合线性注意力机制(Kimi Delta Attention)+ 注意力残差技术,原生视觉理解 + **100 万 token 上下文**。在 **Frontend Code Arena 前端代码竞技场登顶全球第一**(1679 分,超过 Claude Fable 5),已在 Kimi App、Kimi Work、Kimi Code 和 API 中同步上线;**完整模型权重计划 2026/7/27 开源**。**值得称道的是官方在发布博客首页坦诚说明"整体能力仍落后于 Claude Fable 5 和 GPT-5.6 Sol"**(尤其 HLE 推理短板明显),姿态罕见诚实。发布次日(7/19)即有报道称月之暗面**最快 6 个月内完成港股 IPO**。
**此前商业化加速**:截至 6 月中旬,Kimi 年化经常性收入(ARR)突破 **3 亿美元**(3 月破 1 亿、5 月破 2 亿)。**6/30 完成 200 亿美元估值融资交割,新一轮融资随即启动,投前估值升至 315 亿美元**,半年内融资超 39 亿美元。技术上此前已迭代至 **K2.6**(13 小时连续编码 + 300 Agent 集群)、**K2.7 Code**(编程场景专项优化)。
Kimi 在论文分析、长文档总结、网页内容提取等场景表现出色,网页版和 App 基础功能仍保持免费,重度 Agent / API 场景已进入规模化商业变现阶段。
核心功能
- 20 万字超长上下文:单次对话可处理约 20 万汉字的内容,能完整阅读和分析整本书籍、长篇报告
- Kimi K3(新,全球最大开源模型):2.8万亿参数,KDA混合线性注意力+100万token上下文,Frontend Code Arena全球第一(1679分超Fable 5),权重7/27完整开源
- K2.6 / K2.7 Code 开源模型:13 小时连续编码 + 300 Agent 集群编排能力,MIT 协议开源;K2.7 Code 面向编程场景专项优化
- 网页和文件解析:支持直接输入 URL 提取网页内容,上传 PDF/Word/Excel 等文件进行深度分析
- 学术论文助手:擅长论文阅读、文献综述、研究方法分析,是学术研究者的有力助手
- 联网搜索:支持实时联网检索,可获取最新信息并提供信息来源链接
- Kimi+ 智能体:内置多种预设智能体(翻译、写作、编程等),针对特定场景优化体验
- 数据分析:支持上传数据文件进行分析和可视化,生成图表和统计报告
适合谁用
以下类型的用户会特别受益于 Kimi:
- 需要阅读和分析长篇论文、报告、合同的学术和商务人士
- 频繁需要总结网页内容、提取关键信息的信息工作者
- 学生群体:论文写作辅助、文献检索、知识整理
- 需要处理大量中文文本的编辑和内容创作者
- 寻找免费且功能强大的中文 AI 助手的普通用户
优点亮点
- 长文本处理是核心优势:超长上下文,适合深度阅读和分析
- 网页版/App 基础功能免费:日常对话与文档分析零成本
- 中文理解能力优秀:对中文语境的把握准确自然
- 文件和网页解析方便:直接丢链接或文件就能分析
- 商业化验证扎实:ARR 半年内从 1 亿到 3 亿美元,估值 315 亿美元,资本市场认可度高
价格与方案
Kimi 网页版和手机 App 基础对话、文件分析功能免费开放。K3 API 定价:输入 $3.00/M token(命中缓存降至 $0.30/M)、输出 $15.00/M token,较 K2.6(输入 $0.95/M、输出 $4.00/M)明显上调,对应 100 万 token 超长上下文与更强推理能力。Kimi Work(企业办公场景)另有独立商业化方案。随着 K3/K2.6/K2.7 等模型能力升级,重度 Agent / API 场景收入占比持续提升。
总结与建议
如果你的核心需求是处理长文本——读论文、总结报告、分析合同——Kimi 依然是国产 AI 中的首选,网页版和 App 基础功能保持免费。**2026/7/16 发布的 Kimi K3 是本轮国产大模型竞赛的标志性事件**——2.8 万亿参数登顶全球最大开源模型,前端代码能力全球第一,且官方罕见地主动承认整体能力仍落后 Fable 5 / GPT-5.6 Sol,值得肯定这种诚实姿态。Kimi 已不只是"免费长文本工具":ARR 3 亿美元、估值 315 亿美元,冲刺港股 IPO 中,K2.6/K2.7 Code/K3 分别覆盖不同场景。日常使用推荐与豆包搭配:Kimi 处理长文本深度任务与编程 Agent,豆包负责日常对话和轻量创作。
版本演进
- 官网已上线Kimi K3模型(2026-07-16),定位为专为智能体编程与知识工作打造,现有评测仅提及K3开源商用抽成 (2026-07-16):官网已上线Kimi K3模型(2026-07-16),定位为专为智能体编程与知识工作打造,现有评测仅提及K3开源商用抽成规则,未覆盖其具体功能特性、使用场景及PerceptionBench等新研究内容。
- 官网已上线K3模型,定位为专为智能体编程与知识工作打造,现有评测仅提及K3开源商用抽成规则,未覆盖其具体功能特性、使用场:官网已上线K3模型,定位为专为智能体编程与知识工作打造,现有评测仅提及K3开源商用抽成规则,未覆盖其具体功能特性、使用场景及界面集成(如Kimi Work、Kimi Code、Kimi Claw等新模块)
- Kimi K3模型已正式上线,官网明确其定位为专为智能体编程与知识工作打造,现有评测仅提及K3开源商用抽成规则,未覆盖其:Kimi K3模型已正式上线,官网明确其定位为专为智能体编程与知识工作打造,现有评测仅提及K3开源商用抽成规则,未覆盖其正式发布及官网功能展示(如Kimi Work、Kimi Code、Kimi Claw、插件、定时任务、PPT集群、深度研究等)。
- Kimi K3模型已正式上线,定位为专为智能体编程与知识工作打造,现有评测仅提及K3开源商用抽成规则,未覆盖其正式发布及:Kimi K3模型已正式上线,定位为专为智能体编程与知识工作打造,现有评测仅提及K3开源商用抽成规则,未覆盖其正式发布及产品定位。
- 官网显示Kimi已上线K3模型,定位为专为智能体编程与知识工作打造,而现有评测仅提及K3开源商用抽成规则,未覆盖K3正式:官网显示Kimi已上线K3模型,定位为专为智能体编程与知识工作打造,而现有评测仅提及K3开源商用抽成规则,未覆盖K3正式发布及其产品定位、功能特性(如智能体编程与知识工作场景)等新动态。
- K3开源商用抽成规则 (2026-08-07):K3设30%商用收入抽成门槛,Qwen3.8-Max部分基准测试超越K3;全球开发者持续部署K3生态
- 官网主推K3模型(定位智能体编程与知识工作),并新增Kimi Work、Kimi Code、Kimi Claw等产品,评:官网主推K3模型(定位智能体编程与知识工作),并新增Kimi Work、Kimi Code、Kimi Claw等产品,评测未提及。
- 官网首页主推K3模型,定位为智能体编程与知识工作,并新增Kimi Work、Kimi Code、Kimi Claw等产品:官网首页主推K3模型,定位为智能体编程与知识工作,并新增Kimi Work、Kimi Code、Kimi Claw等产品入口及插件、定时任务功能;现有评测仅提及WorkBuddy与腾讯文档协同,未覆盖K3及上述新功能。
- WorkBuddy 深度打通腾讯文档,打造 Agent 时代的第三代办公协同 (2026-07-30):WorkBuddy 新版本深度打通腾讯文档,支持在侧边栏直接编辑生成的文件,并将腾讯文档嵌入工作流,实现人与 AI、同事及各自 Agent 间的协同。用户可选用 DeepSeek V4 Pro、Kimi K3 等模型处理文档,并将文件上传至云端分享流转。作者认为,这种"人、Agent 与共享状态"的协作模式,标志着第三代办公产品的到来。
- Kimi K3 开源:2.8T MoE 模型与技术报告 (2026-07-27):Kimi 发布其最强模型 Kimi K3,这是一个 2.8T 参数的 MoE 模型,具备原生视觉理解和 1M token 上下文窗口。新架构实现了每单位计算 2.5 倍的智能提升。除模型权重外,Kimi 还开源了高性能注意力内核、MoE 通信库及大规模智能体运行环境基础设施。
- Kimi K3 开源分布式智能体环境 AgentENV (2026-07-27):我们与 kvcache-ai 合作开源了 AgentENV。 AgentENV 是一个用于大规模运行智能体环境的分布式系统。其组件为 Kimi K3 的智能体强化学习训练提供支持,具备快速快照、恢复和分支功能,适用于大规模并行智能体工作流。 在 GitHub 上探索:http://github.com/kvcache-ai/AgentEnv
- Kimi K3 开放日:模型权重、技术报告和关键 Infra 技术同步开放 (2026-07-27):月之暗面发布 2.8 万亿参数的混合专家模型 Kimi K3,支持原生视觉理解和 100 万 token 上下文窗口。其规模化效率较 Kimi K2.5 提升 2.5 倍,并同步开源模型权重、技术报告及 MoonEP、FlashKDA、AgentEnv 三项 Infra 技术。
- Kimi 发布视觉感知基准 PerceptionBench (2026-07-27):Kimi.ai 发布 PerceptionBench,一个从当前前沿模型在 42 个基准上的失败模式中归纳出的视觉感知基准。该基准将视觉感知拆解为 10 种原子能力,并构建了 3000 道验证题,每道题只考察单一感知能力,无需推理或外部知识。
- 在 M1 Max 上运行 2.8T 参数的 Kimi K3:Deltafin 项目实现 0.0687 token/s 推 (2026-07-29):Deltafin 项目成功在 64 GB M1 Max 上运行了 2.8T 参数的 MoE 模型 Kimi K3,当前中位推理速度为 0.0687 token/s(14.6 秒/token)。完整安装需约 1.7 TB 本地磁盘,流式模式仅需 215 GB 但推理速度降至 3 分钟以上/token。项目提供 OpenAI 兼容 API 服务器,支持聊天和代码补全,但建议客户端超时设为小时级别。
- Kimi K3 发布(全球最大开源模型) (2026/07/16):2.8万亿参数登顶全球最大开源权重模型,KDA混合线性注意力+100万token上下文+原生视觉理解,Frontend Code Arena全球第一(1679分超Fable 5);官方坦诚整体能力仍落后Fable 5/GPT-5.6 Sol;完整权重7/27开源;7/19报道月之暗面拟6个月内完成港股IPO
- 融资 315 亿美元估值 + K2.7 Code (2026/06/30):200 亿美元估值融资交割,新一轮启动投前估值升至 315 亿美元;ARR 突破 3 亿美元;K2.7 Code 编程模型发布,K3 计划 7 月发布
- Kimi K2.6 (2026):月之暗面发布 K2.6(MIT 开源),13 小时连续编码 + 300 Agent 集群;网页 / App 端默认接入 K2.6
- Kimi K2 / K2.5 (2025):从长文本助手转型 Agent + 编码方向
- Kimi Chat 早期 (2023-2024):国内首批主打 200 万字超长上下文的 AI 对话产品