月之暗面 Kimi:激进技术路线与克制组织扩张
月之暗面 Kimi 半年内完成多轮大额融资,估值飙至 300 亿美元,K2 系列三次迭代的同时全公司仅约 300 人。
作为「AI 六小虎」之一的月之暗面 Kimi,在短短一年内完成多轮大额融资,估值从 43 亿美元跃升至传闻中的 300 亿美元。其背后是激进的技术迭代——从 K2 到 K2.7 Code 半年三次升级——与克制的组织扩张(全公司仅约 300 人)的鲜明对照。
资本与商业化双重加速
2025 年 12 月,Kimi 完成 5 亿美元 C 轮融资,投后估值 43 亿美元;2026 年 5 月,又完成 20 亿美元 D 轮融资,估值来到 200 亿美元;6 月,传闻新一轮最高 20 亿美元融资正在洽谈,投前估值达 300 亿美元。
商业化进展同样迅猛。K2.5 上线不到 20 天,累计收入便超过 2025 年全年总和,ARR(年度经常性收入)突破 2 亿美元。从 3 月的 1 亿美元到 4 月的 2 亿美元,Kimi 营收在短期内实现翻倍。接近 Kimi 的人士表示:「很长一段时间里,K2.5 供不应求。」
半年三次迭代,产品路径逐渐清晰
Kimi 的产品迭代节奏明显加快:
- 2026 年 1 月:发布 K2.5,支持全模态处理,原生融合文本与视觉输入;
- 2026 年 4 月:发布 K2.6,主打编程和 Agent 集群能力,单次任务最高可调度 300 个子 Agent 并行协作;
- 2026 年 6 月:发布电脑端本地通用 Agent 产品 Kimi Work,以及 K2.7 Code 编程专用模型。
K2.6 在 SWE-Bench Pro 上以 58.6% 的成绩超越 GPT-5.4,可持续编码 13 小时、修改超 4000 行代码。K2.7 Code 则在长程任务上将平均 Token 消耗减少 30%,多语言代码生成能力大幅提升。
6 月发布的 Kimi Work 支持 300 个 Agent 并发,内置 Cron 调度器,可直接读写电脑文件,所有操作在本地完成、数据不出设备。
底层架构创新:专挑「技术无人区」
与多数厂商在工程层面优化不同,Kimi 选择回到 AI 系统最底层组件进行重构:
- MuonClip 优化器:将 Token 处理效率提升到 AdamW 的 2 倍;
- Kimi Linear 混合线性注意力架构:在 128K 至 1M 超长上下文实现 5 至 6 倍解码速度提升;
- Attention Residuals:重新设计残差连接,训练计算量减少约 20%,相当于获得 1.25 倍效率优势。
Kimi 算法研究员表示:「MuonClip、Kimi Linear、Attention Residuals 本质上都是为了效率,通过算法创新,充分利用现有资源,达到更高的 Token 效率和模型智能水平。」
杨植麟透露,下一代模型 K3 将采用全新模型架构,目标之一是更好地适配 Agent 长程任务能力。此外,他称之为「打破行业认知」的发现是:视觉强化学习训练可反哺纯文本能力,「之前普遍认为引入视觉能力会降低文本能力,但我们发现二者可以互相提升」。
300 人的「精锐部队」与极致扁平
与激进的技术投入形成鲜明对比的是克制的组织扩张。作为估值已超 300 亿美元的独角兽,Kimi 全公司仅约 300 人,是头部大模型创业公司中人数最少的之一。杨植麟公开表示:「这几个大模型创业公司里,我们始终保持人数最少,保持卡和人的比例最高非常关键。我们不希望团队扩那么大,(扩大)对创新有致命性伤害。」
Kimi 内部不设 OKR、不设部门墙、取消总监和副总裁等职位标签,组织架构极致扁平,几位联创直接对接数十位团队成员。在算力与数据日益同质化的竞争中,杨植麟反复提及「品味(taste)」,将其视为 Kimi 建立差异化壁垒的核心驱动力。
走向「不被定义」的 LLM
杨植麟在 2025 年底内部信中写道:「2026 年 Kimi 会成为一个『与众不同』和『不被定义』的 LLM。不管是别人没敢押注的技术无人区,还是需要一点偏执的审美坚持,我相信有更多 Kimi-defined 的创新能对人类文明加速发展产生独特贡献。这种独特性是我们存在的最大意义。」
DeepSeek V4 技术报告中明确致谢了 Kimi 创新并开源的 Muon 优化器,杨植麟对此回应:「这是开源的意义,我们受益于开源技术,也希望把我们的贡献带给社区。」
融资已落地、商业化加速、技术路径明确——Kimi 接下来要回答的,是如何在头部大厂与同行夹击中,把「激进的技术野心」真正转化为可持续的市场地位。
