月之暗面发了 Kimi K2.7 Code。
跟之前所有国产大模型发布会不一样的地方是,他们上来就说了一句话。
大概意思是,GPT-5.5 和 Claude Opus 4.8,在编程上大概 70 分。我们 Kimi K2.6,50 分。
50 分。
你在中国 AI 圈多久了,你有听过哪家公司开发布会,先说自己只有 50 分吗。没有。全是”全面超越“”达到国际领先水平“”比 GPT 强“。
月之暗面说,这次我们做到 60 分以上了。差距还在,但缩小了。
就这一句话,我今天专门写这篇文章。
不是因为这个模型有多炸裂。是因为这种坦诚,在中国 AI 圈,太少见了。
这个【60 分】背后的数字,我帮你拆开看看。
他们发了一个叫 Kimi Code Bench v2 的评测,是自己的评测体系。K2.6 的得分是 50.9。K2.7 Code 的得分是 62.0。提升 21.8%。
另一个评测叫 Program Bench,从 48.3 涨到 53.6。涨了 11%。
还有一个叫 MLS Bench Lite,从 26.7 涨到 35.1。涨了 31.5%。

自己跟自己比,涨多少都正常。关键是怎么跟别人比。
在 MCP Mark Verified 这个评测上,K2.7 Code 拿了 81.1 分。Claude Opus 4.8 拿了 76.4 分。
开源模型,第一次在工具调用这个维度,超过了 Claude 顶尖闭源模型。
不是一个“声称超越”,是一个可以用数字验证的超越。
同时,在 Kimi Code Bench v2 上,GPT-5.5 拿了 69.0 分。K2.7 Code 拿了 62.0 分。差距从 18 分缩到了 7 分。
7 分。不是 0 分,但也不远了。
还有一件事。这个模型的推理 token 消耗比上一个版本少了 30%。
什么意思呢。同样一个编程任务,K2.6 要想 1000 个字才能动手,K2.7 Code 想 700 个字就够了。想得少,不代表做得差,代表想得更准。这 30%省下来的,是你的 API 费用。
他们说下周一上线 6 倍速版本,差不多 180 到 260 token 每秒。价格翻倍,速度翻 6 倍。
技术细节说一下,然后我说重点。
K2.7 Code 是 1 万亿参数的 MoE 架构。但每次推理只激活 320 亿个参数。这意味着你可以用一台有 24GB 显存的消费级显卡,跑这个万亿参数的模型。不是跑完整版,是跑 INT4 量化版,但能跑。
256K 的上下文窗口。不到 Claude 的 100 万,但对大部分编程场景够用了。关键是开源权重,Modified MIT 协议,你可以下载下来自己部署,商用也 OK。
但这些都不是我想说的重点。
重点是一个叫 Preserve Thinking 的功能。
你知道现在所有的 AI 编程工具都有一个共同的致命问题吗。
你跟它聊了十分钟,它在第三轮的时候犯了一个设计决策的错误。你说不对,你应该用 A 方案而不是 B 方案。它说好,用 A 方案。然后第五轮的时候,它又犯了同样的错误。
因为它忘了。
每次你发新消息,模型重新开始思考。之前的推理链条、为什么选了那个方案、为什么放弃了另一个——全没了。像一个失忆的程序员,每次 code review 都得从零开始解释。
K2.7 Code 的 Preserve Thinking,解决的就是这个。
它会记住前面几轮的思考过程。不是记住你说了什么,是记住它自己是怎么推理的。它知道方案 A 被放弃了是因为性能问题,方案 B 被选中是因为兼容性好。所以当你第七轮跟它说「前面那个功能有个 bug」的时候,它还知道那个功能是基于方案 B 做的,应该从方案 B 的思路去修。
这不是一个「更好用」的功能。这是一个编程范式的改变。
以前你跟 AI 编程,是你在指挥它。你每次都得重复上下文,你说十句话它忘九句。
现在它能记住自己是怎么想的了。这意味着,AI 正在从「执行命令」进化到「理解意图」。
好,技术讲完了。现在说对普通人的影响。
如果你写代码。
MCP 工具调用 81.1 分超过 Claude,意味着 K2.7 Code 在处理多步骤编程任务时——比如「帮我写一个登录功能、对接数据库、写测试、部署」这一整套流程——的成功率比其他开源模型高出一截。而且价格只有 Claude 的五分之一。一个月大约 19 美元,你可以一直用。或者直接下载权重,在自己的机器上跑,除了电费,不花一分钱。
如果你不写代码。
这件事对你的意义是——AI 编程工具正在从「贵的只有公司用得起」变成「免费的每个人都能用」。你不需要知道 MCP 是什么,你只需要知道:一年前,能用 AI 帮你写一个完整 APP 的工具只有 GPT 和 Claude,月费 200 美元起步。现在,你可以用免费的开源模型,在自己的电脑上,让 AI 帮你写代码。
这不是技术问题。这是门槛问题。门槛从 200 美元降到 0 美元的时候,会发生什么——会有人做出你从来没想过的应用。那些没有 200 美元月费、没有编程基础的人,他们脑子里的想法,才是 AI 编程真正要服务的对象。
如果你关心投资。
月之暗面没有上市。但他们的估值和这一轮融资,在国产大模型公司里是排前几的。今天这个发布,信号很清晰:他们在代码这个赛道上,选了「坦诚跟随+开源免费」的策略。不是去跟 GPT 拼语言能力,而是用开源+低价去抢开发者的使用习惯。这个策略过去在数据库领域(MongoDB)、操作系统领域(Linux)都成功过。现在轮到 AI 编程工具了。而且等下周一 6 倍速版本上线,速度快了之后体验又会上一个台阶,他们跟 Claude/GPT 的差距会进一步缩小。
最后说一下。
月之暗面说今年的重点是 K3。K3 才是真正想去对标 GPT-5.5 和 Claude Opus 4.8 的产品。K2.7 只是一个中间版本。
但中间版本已经让 MCP 工具调用超过 Claude 了。
中国 AI 公司的发布会,终于有人不再吹完了然后被打脸。不再说「六边形超越」「综合性能全球第一」。就老老实实地说,我们 50 分到 60 分了,还差 10 分。
这本身就值得写一篇文章。
因为只有承认差距的人,才有可能缩小差距。
夜雨聆风