小达微探经授权发布,转载请注明出处
2.8万亿参数、全球最大开源模型、前端编程全球第一。7月17日凌晨,月之暗面发布Kimi K3,消息一出,迅速刷屏海内外。连特斯拉CEO埃隆·马斯克都在相关评测报道评论区留言:“Impressive”
这已经是马斯克第二次公开认可Kimi。今年3月,Kimi发布改进ResNet残差连接的相关论文时,马斯克就曾转发并称赞“Impressive work from Kimi”。能让这位xAI创始人在自己也在做大模型的背景下连点两次赞,分量不言自明。
那么,这个让马斯克都“看傻”的Kimi K3,到底做了什么?
全球首个开源3万亿级别模型

一、“AI自己设计芯片”:一个案例引发的海啸
Kimi K3发布的众多信息中,最炸裂的不是参数,是一个案例。
月之暗面披露,K3连续运行48小时,利用开源EDA工具和Nangate 45nm工艺库,独立完成了一款专用芯片的构建、优化与验证。芯片面积4mm²,集成146万个标准单元,搭载融合反量化的INT4 MAC阵列,可在100MHz频率下完成时序收敛,持续解码吞吐量可达每秒8700Token以上。
“AI自己设计AI芯片”这个闭环,全球罕见。
消息一出,华尔街反应剧烈。全球EDA巨头新思科技(Synopsys)一度大跌超12%,最终收跌7.85%;铿腾电子(Cadence)一度跌超12%,最终收跌9.47%。市场担忧:如果AI能自主完成芯片设计全流程——完全绕开Cadence和新思科技的专有软件——对传统EDA软件的需求逻辑将被彻底重估。


这还只是开始。
二、不只是“大”,是“真的能干活”
Kimi K3是一个2.8万亿参数的MoE(混合专家)模型。896个专家模块,每次推理只激活其中16个。100万Token上下文窗口,原生支持视觉理解。

参数规模超过DeepSeek V4的1.6万亿和文心大模型5.0的2.4万亿。它是目前全球参数最大的开源模型,也是首个超2万亿级别的模型。
但“大”不是本事,“能干活”才是。
架构上,K3引入了两项关键创新:Kimi Delta Attention(KDA)混合线性注意力机制,将KV缓存使用量减少75%,在100万Token上下文下解码吞吐量提升最高6倍;Attention Residuals让模型能跨层检索信息,深层不会“忘掉”底层学到的东西。两项技术叠加,让K3相比上一代K2的整体扩展效率提升约2.5倍。
在实际场景中,K3展示了令人震惊的能力:
芯片设计——48小时自主完成全流程。
科研计算——约两小时完成天体物理I-Love-Q关系的复现,阅读并交叉验证20多篇论文,生成3000多行Python代码。
视频创作——用56段原始素材剪出完整品牌视频,选片、动作匹配、逐帧卡点全部自主完成。
一个模型,覆盖芯片设计、科研计算、视频剪辑——这不叫“聊天机器人变聪明了”,这叫“AI开始交付实物了”。
三、榜单说话:开源模型第一次登顶
在Arena AI的Frontend Code Arena榜单上,K3拿到1679分,排名第一,压过Claude Fable 5的1631分和GPT-5.6 Sol的1618分。

Code Arena采用匿名双盲对战机制:同一道前端任务交给两个匿名模型,用户实际体验后投票。百万级用户参与,品牌影响被削弱。七个前端细分领域,K3拿下六个第一。上一代K2.6排第18,K3直接跃升17位。
开放权重模型历史上第一次登顶这类榜单。
不止这一张榜。Artificial Analysis Intelligence Index综合评测中,K3拿到57分,排第三,仅次于Fable 5和GPT-5.6 Sol,领先Opus 4.8和GPT-5.5。SWE Marathon测评中,K3以42.0分位列第一。FrontierSWE拿到81.2分,Opus 4.8是66.7。
当然,官方也坦承:K3整体表现仍落后于Claude Fable 5和GPT-5.6 Sol。但这种坦诚在国产大模型发布中实属罕见。“在编程这个主战场上,已经坐到了最靠前的位置”——这种定位,比宣称“全能”更有说服力。
四、一场“模型发布”引发的资本地震
K3发布后,全球科技股和半导体股大幅下挫。
美股盘前,纳斯达克100指数期货跌逾1.8%,英伟达领跌“科技七巨头”。正式交易中,谷歌、Meta、英伟达、特斯拉齐跌超2%。费城半导体指数跌1.63%,较6月22日高点回撤超20%,正式进入技术性熊市。
道指跌超400点,标普500跌1.01%,纳指跌1.4%。抛售波及全球——日经225指数周五重挫逾4%。
高盛将此次下跌定义为“去杠杆事件”,警告“算力扩张时代”或已走到尽头。高盛合伙人直言:一家无法匹配西方最大规模预训练算力的中国实验室,通过架构创新、合成数据和强化学习,迅速缩小了与顶尖美国模型的差距——这并非证明“扩展定律”失效,而是表明“扩展不再是唯一的制胜路径”。
摩根大通全球市场情报主管在客户报告中直言,Kimi K3的发布“无疑雪上加霜”,“对‘DeepSeek 2.0’时刻的担忧令亚洲和美国科技股双双承压”。
五、从“便宜能用”到“贵得有道理”
如果说中国AI开源模型的全球冲击可以排序,K3大概是第三次:
第一次是DeepSeek——以低成本、高效率震动全球,证明中国模型能在有限算力下做出顶尖性能。
第二次是GLM——ARR半年从1亿飙到10亿,证明中国模型能赚钱。
第三次是K3——2.8T参数,Frontend Code Arena第一,7月27日开源完整权重。
但K3最让人意外的,是它的定价。
Kimi K3 API定价:输入每百万Token 2元(缓存命中)和20元(缓存未命中),输出100元。按美元计,输出价格约为每百万Token 15美元——和Claude一个价。
这是中国大模型第一次照着美国顶级模型的价目表收费。过去国产模型打的是“性价比”牌,K3选择了另一条路:性能对标,价格也对标。借助Mooncake分离式推理架构,编程场景缓存率超90%,实际输入价格仅为标准价格的1/4。根据Artificial Analysis数据,K3平均任务成本约0.94美元,接近GPT-5.6 Sol的1.04美元。
与此同时,月之暗面的估值曲线同样陡峭:2025年底投后估值仅43亿美元;2026年5月完成20亿美元融资,投后200亿美元;6月30日新一轮启动,投前估值315亿美元——半年估值上涨超7倍。截至6月中旬,ARR突破3亿美元。投资界独家获悉,Kimi已筹备赴港IPO,最快6个月内完成上市。
六、海外怎么看?震撼与冷静并存
X上的反应分成两派。
震撼派。Vercel的CEO Guillermo Rauch做了nextjs.org的综合Web工程评测,结论很直接:K3领先Fable,开放模型第一次领先全部专有模型。马斯克在Artificial Analysis的推文下留言:“Impressive”。Emad Mostaque更直接:“美国实验室最终会去蒸馏中国模型”。美国科技媒体Axios发文称,Kimi K3的早期表现正在整个AI行业引发“惊叹”,同时在硅谷和华盛顿引发“警觉”——中国正在迅速缩小美国在先进AI领域的领先优势。
冷静派。Simon Willison做了经典鹈鹕SVG测试——K3的结果较K2.5明显提升,但简单任务消耗了1.6万余输出Token,其中约1.32万是推理Token,成本约0.25美元。推理Token使用很重,效率边界仍待观察。Ivan Fioravanti称赞了K3的UI、设计和速度,但指出模型“投入较多思考,偶尔越界加戏”——会自行扩展任务范围,而不是严格停在用户划定的边界里。Bindu Reddy提醒K3榜单成绩“过于突出”,仍需用更难污染的测试继续验证。
但两派都承认一件事:K3让全球AI从业者不得不重新评估中国开源模型的位置。它已经从“便宜替代品”,变成了一个需要认真对比的生产力工具。
七、局限:强,但并非完美
K3并非没有短板。
推理Token消耗大。简单任务消耗1.6万余输出Token,其中约1.32万是推理Token。这意味着每次回答都在“深思熟虑”,但也意味着成本不低、速度不快。
“越界加戏”。模型会自行扩展任务范围——在某些场景这是“主动性”,在需要精确执行的场景就是“失控”。
响应速度偏慢。当前默认思考强度为“Max(极致)”,后续更新会增加low和high两种模式。
综合能力仍有差距。官方坦承整体落后于Fable 5和GPT-5.6 Sol。单项领先不等于全面超越。
北京邮电大学人工智能学院王教授说:大模型的参数可以堆,但能不能在真实世界里持续稳定地干活——那才是真本事。“目前行业内对AI大模型的关注更多的是推理能力和自我探索能力。在这方面,国内大模型还需更多努力。”
八、7月27日,真正的分水岭
完整模型权重将于2026年7月27日前公开发布。
届时,任何人都能下载并运行这个2.8万亿参数的庞然大物。金融机构、政府、军工——数据不能出门的客户,第一次有机会在自己的机房里跑接近前沿水平的模型。
配置文件一出来,专家数量、隐藏层维度、注意力结构立刻能反推出理论算力和内存占用。社区会跑出实际吞吐量数据——那是唯一能直接测量的成本证据。在此之前,任何关于“效率是真是假”的争论都停留在猜测阶段。
全球首个开源的3万亿级别模型——这个标签的分量,7月27日之后才能真正被掂量。
结语
一个模型的发布,引发全球科技股震荡、EDA巨头股价暴跌、纳斯达克指数重挫——这在AI历史上不是第一次,也不会是最后一次。
但每一次都在证明一件事:AI竞赛的格局正在被重新书写。
Kimi K3不是“中国AI全面超车”的宣言。它更像一个信号:开放权重模型第一次在真实的、可验证的编程任务上,与全球最顶级的闭源模型正面交锋并赢得胜利。
单项领先不等于全面超越。差距依然存在。但差距已经缩到了历史最短。
7月27日权重开源后,记得回来下载。到那时候,全世界都能亲手验证这个2.8万亿参数的国产巨兽。
国产AI的节奏,已经不是“追”了。

本文基于2026年7月17日Kimi K3发布会的公开信息整理,数据来源包括月之暗面官方披露、第三方评测平台及公开媒体报道。
全文结束
(上下滑动下面文本框查看更多)
免责声明:我们尊重知识产权、数据隐私,文章来源于互联网收集整理,由小达微探公众号(ID:ZQteach)整理,版权归原作者及其公司所有。转载此文是出于传递更多行业信息,仅供研究、学习交流之用,若有来源标注错误或侵犯了您的合法权益请联系,我们将及时更正、删除,谢谢。

1.本文已上传【小达微探】知识星球,更多高质量报告和研报,如分享过期就加入即可下载。

2.欢迎加入【小达微探知识星球】获取最新的行业合集资料!
重磅报告干货
基于“区块链 + 物联网”的产业链金融应用白皮书(2021)
2024人形机器人研究报告揭秘:政策引领、技术革新、需求驱动,新纪元已开启|附PDF下载【干货分享】生成式AI专利报告出炉,中国生成式AI专利申请量世界第一,独家解读报告亮点|附PDF下载

关于小达微探公众号
本公众号专注于搜索海量行业研究报告,覆盖各行各业助您精准预见趋势,把握未来,定期分享人工智能、元宇宙、无人驾驶、新能源、双碳、数字经济、医疗大健康及出海等领域的研报和干货,若寻找报告请首选 小达微探 微信公号。如有数字化咨询、课程培训、产业落地、技术研发、投融资等需求或需行业报告、领袖社群商务合作请联系小助理W(byouqkl),并注明您的姓名、公司及职务!
夜雨聆风