产品介绍
Kimi 是月之暗面(Moonshot AI)的旗舰 AI 助手,2023 年靠”20 万字长上下文”起家,如今的招牌变成了两样:开源和 agent 集群。最新旗舰 K3(2026 年 7 月)是全球首个开源 3T 级模型——官宣 2.8 万亿参数 MoE 架构,原生支持视觉与 100 万 token 上下文,Coding、Agentic、多模态多项基准对标 Claude Fable 5 与 GPT-5.6 Sol;Agent Swarm 集群可调度最多 300 个子 agent 并行干活,官方称比单 agent 快约 4.5 倍。K3 已同步进入 Kimi 主站、Kimi Code 与 Kimi Platform API,权重开放下载。
基础对话免费;会员四档 ¥49 / ¥99 / ¥199 / ¥699 每月,Agent 集群、Kimi Code、PPT、深度研究等重度功能共享一个按 token 计的月度额度池,国际版 $19/月起。K3 发布 48 小时后需求超预期、GPU 容量逼近上限,官方于 7 月 19 日宣布暂时停止接受新付费订阅(已有订阅用户不受影响)。公司层面势头很猛:2026 年年中估值约 315 亿美元,ARR 三个月从 1 亿美元冲到 3 亿美元,阿里是主要投资方。
生态位上,Kimi 是 DeepSeek 之外最受关注的中国开源模型系——但两者路线不同:DeepSeek 偏”纯模型+极致成本”,Kimi 把重心押在产品化的 agent 能力上(集群、专属助理 Kimi Claw、200-300 次连续工具调用)。中文长文档处理依然是相对豆包等竞品的强项。Kimi Work 至少自 2026 年 6 月初已进入公开测试阶段:挂载本地文件夹、WebBridge 浏览器自动化、内置 Cron 定时任务,并预集成 A 股/港股/美股金融数据,以”桌面数字员工”形态切入办公 agent 战场。
注意:K3 对 thinking history 的传递敏感,中间切换模型再切回可能导致质量不稳定;长任务中可能过度主动替用户做决策;API 价格已明显高于 DeepSeek(编程版约为其 6.5 倍),“便宜大碗”标签在弱化;重度功能集中在 ¥99 以上档位,免费版权益有限。
模型迭代时间线
| 时间 | 版本 | 要点 |
|---|---|---|
| 2023-10 | Kimi Chat | 首发即 20 万字长上下文,一战成名 |
| 2024-03 | 200 万字版 | 无损上下文扩至 200 万字 |
| 2025-01 | k1.5 | 多模态思考模型,对标 OpenAI o1 |
| 2025-07 | K2 | 开源 1 万亿参数 MoE agentic 模型 |
| 2025-11 | K2 Thinking | 开源思考模型,200-300 次连续工具调用 |
| 2026-04 | K2.6 | 256K 上下文 + 视觉输入 + 300 子 agent 集群 |
| 2026-07 | K3 | 全球首个开源 3T 级模型:2.8T MoE + 1M 上下文 + 原生视觉,对标 Fable 5 / GPT-5.6 Sol |
Fireworks 约 1030 个真实 agent 任务实测:K3 与 Fable 5 双模型路由准确率 93%,长 agent 循环成本最高降至 1/50
开启测试;支持本地文件、WebBridge、Cron 与多 Agent 协作
全球首个开源 3T 级模型,2.8T MoE + 1M 上下文 + 原生视觉;发布 48 小时后需求超预期,官方暂停新订阅
编程专版发布,随后推高速版
1T MoE + 256K 上下文 + 视觉输入,agent 集群扩至 300
首次引入 Agent Swarm 多智能体集群




