月之暗面称,“Kimi K3”可比肩甚至超越前沿模型,但庞大的模型规模或限制其普及。
作者:Rachel Fieldhouse、Mohana Basu

图片来源:CN-STR/法新社/Getty
中国最新研发的大语言模型(LLM)凭借其规模和能力,给科学界留下了深刻印象。上周,总部位于北京的月之暗面(Moonshot AI)发布了“Kimi K3”。这是一款具备强大推理能力的大语言模型,可处理海量文本。该公司的测试显示,在编程、电子表格操作等任务上,K3的表现可比肩甚至超越美国的竞争模型。
自DeepSeek之后,还没有哪款中国人工智能模型引发如此大的关注。“这是一个转折点。”澳大利亚新南威尔士大学(UNSW Sydney)认知神经科学家Joel Pearson说。他的研究关注人工智能如何影响人们的生活。他补充道:“人们称它为‘斯普特尼克时刻’。”
模型发布三天后,月之暗面表示,由于需求激增、系统处理能力已接近上限,公司暂停了K3新用户注册。
K3于7月16日发布,时间恰逢2026世界人工智能大会在上海开幕前夕。大会开幕时,中国国家主席习近平宣布正式启动一个全球性联盟,旨在推动建立相关监管机制,确保人工智能安全发展并造福人类。习近平在会上表示:“中方认为,各国应坚持以人为本,推动智能向善。”他还指出,人工智能应成为推动“共同繁荣和共同安全”的力量。
位于珀斯的西澳大利亚大学人工智能研究者Mehwish Nasim表示,Kimi K3的发布时间颇具深意。就在它问世前数周,美国公司Anthropic发布了Claude Fable 5;而在它发布前数日,OpenAI刚刚推出最新的GPT-5.6模型。她说:“中国正在释放一个信号:其雄心不仅是构建前沿人工智能系统,也希望参与塑造国际人工智能生态及其治理方式。”
最大的开放权重模型
与前代Kimi K2以及DeepSeek模型一样,K3采用开放权重。DeepSeek模型由一家总部位于杭州的同名公司开发。所谓开放权重,是指模型的核心组件公开,研究人员可以免费下载和修改;不过,模型训练的相关信息并未公开。用户还可通过“应用程序编程接口”(API)访问K3,让软件与模型交互,其成本低于OpenAI、Google和Anthropic等公司拥有的专有大语言模型。后者采用封闭权重,无法下载和修改。
月之暗面表示,模型权重(即参数)将于7月27日发布。位于堪培拉的澳大利亚国立大学机器人与人工智能研究者Rahul Shome表示,消费者、开发者和研究人员一直在推动人工智能模型开放权重。Shome说,K3尤其令人兴奋,因为它将成为规模最大的开放权重模型,拥有2.8万亿个参数,工作记忆容量达到100万词元(token,即人工智能模型处理文本时使用的基本单位)。不过,该模型体量过大,无法在个人设备上运行,因此机构若要运行它,可能需要投入大量资金。
澳大利亚天主教大学悉尼校区计算智能研究者Niusha Shafiabady表示,K3庞大的工作记忆意味着,它可以记住数千行代码或整本书的内容,并降低生成虚构信息的概率——这种现象通常被称为“幻觉”。Shafiabady说,她准备亲自测试K3,让它总结研究成果。
差距正在缩小
长期以来,开放权重模型的性能和能力一直落后于美国的专有模型。但布里斯班昆士兰科技大学生成式人工智能实验室的人工智能问责研究者Aaron Snoswell表示,如今两者之间的差距似乎已经缩小到前所未有的程度。
Pearson表示,中国的开放权重模型正在改变投资者和用户对美国前沿模型价值的看法。Google、Anthropic和OpenAI投入数十亿美元训练模型,而中国企业的预算要低得多。Pearson还指出,如果政府决定施加限制,用户可能会失去对美国模型的访问权限。上个月,在美国政府要求Anthropic暂停向外国公民提供访问权限后,该公司一度面向所有用户停用了其最先进的Fable 5和Mythos 5模型。本月,Fable 5已恢复访问,但Mythos 5仍仅向部分美国机构开放。
新南威尔士大学计算机科学家Toby Walsh表示,尽管美国以国家安全为由限制中国获得先进人工智能芯片,中国人工智能企业仍然成功构建了前沿模型。他补充道:“人们不禁会猜,这或许正是‘需求是发明之母’的体现。”
在北京清华大学研究人工智能模型的William Guey表示,Kimi K2.5在中国走红,部分原因是它很适合运行人工智能智能体(AI agent);过去一年左右,智能体的应用迅速增长。这类自主工具可以执行具体操作,例如从互联网上下载研究论文或扫描网站。Walsh补充说,K3同样针对智能体运行进行了良好调优,而这正是许多人感兴趣的方向。
Snoswell表示,中国人工智能企业正积极吸引美国开发者和消费者使用中国的大语言模型。
不过,Nasim表示,K3能否在中国以外得到广泛采用仍有待观察。她补充说,其普及程度很可能取决于高校和政府如何评估该模型的安全风险,包括公司如何存储和使用用户数据,以及第三方能否访问这些数据。
中国自身的政策也可能限制这些模型在境外的使用。据媒体报道,本月早些时候,中国政府与阿里巴巴、Z.ai和字节跳动等国内人工智能企业举行了会谈,讨论可能限制海外用户访问国产人工智能模型的问题。
即便如此,Walsh表示,K3说明研究人员今后将能从多种开放权重模型和专有模型中作出选择。他补充道:“这证明,人工智能不会成为一个赢家通吃的市场。”
DOI:https://doi.org/10.1038/d41586-026-02281-2
夜雨聆风