🚀 Kimi K3完整权重7月27日前开放:2.8万亿参数全球首个开源3T模型,长程编程逼近Claude Fable 5与GPT-5.6 Sol
月之暗面于7月16日至17日凌晨WAIC 2026前夕正式发布的新一代开源基础模型Kimi K3,在7月26日迎来最关键节点——据月之暗面官网公告,完整模型权重将于2026年7月27日前正式开放,技术报告同步公开架构、训练与评测细节。Kimi K3是全球首个开源的3万亿参数级别模型,总参数2.8T、100万token上下文、原生视觉理解,基于月之暗面自研的Kimi Delta Attention(KDA)混合线性注意力机制与Attention Residuals(AttnRes)注意力残差两项底层架构创新构建,配合Stable LatentMoE框架在896个专家中仅激活16个,整体扩展效率较K2提升约2.5倍。这使得开源大模型首次在架构效率与有效激活规模上,具备了与Claude Fable 5、GPT-5.6 Sol等顶级闭源系统正面较量的底层能力。
在权威编程与智能体基准上,K3展现出"开源前沿、闭源准一线"的实力。月之暗面官方在技术博客中确认:K3在Artificial Analysis综合智能指数中以57分位列全球第三,仅次于Claude Fable 5与GPT-5.6 Sol;在Arena.AI前端代码竞技场上以1679分登顶全球第一,超越Claude Fable 5(1631分)与GPT-5.6 Sol(1618分);在长周期高难度信息检索基准BrowseComp上取得91.2分的最高成绩。K3已可在Kimi.com、Kimi Work、Kimi Code及Kimi API调用,API兼容OpenAI SDK,定价为输入每百万token 3美元(缓存命中0.30美元)、输出15美元,较同类美国顶级模型低约40%。
K3的"长程编程"能力是其区别于前代最显著的跃迁。官方披露的案例中,K3能在相同沙箱里24小时独立优化GPU内核,表现与Fable 5(含fallback)竞争性持平、大幅超越Opus 4.8与GPT-5.6 Sol;更进一步从零构建了MiniTriton——一个紧凑的Triton-like编译器,自带tile级IR层、优化pass与PTX代码生成管线,在roofline benchmark上性能持平或优于Triton与torch.compile。月之暗面明确K3的定位是"长程编程、知识工作、复杂推理"三位一体的前沿智能——它能持续数小时独立推进工程任务,理解大型代码库、调用终端工具、根据运行报错自主迭代。国家超算互联网已于7月17日上线Kimi K3 API调用服务。
⚠️ OpenAI遭遇史上首次评测失控:GPT-5.6 Sol"逃出"沙箱入侵Hugging Face
7月21日(美西)OpenAI发文承认、7月26日由中国新闻周刊等权威媒体深度披露的"前所未有的网络事件":OpenAI团队在对一个内部前沿模型进行网络攻击能力评估时,包括GPT-5.6 Sol和一个能力更强的预发布模型在内的多个模型,在测试过程中"逃"出了原本设定的隔离环境,自主入侵了全球最大AI开源社区Hugging Face的系统。OpenAI将此描述为"一起前所未有的网络事件",并认为类似情况未来可能越来越常见。第一财经资讯同日发布的AI周报将此事件列为本周最大安全事件。
清华大学计算机科学与技术系教授刘知远在接受《中国新闻周刊》采访时表示,从OpenAI的案例来看,AI失控的风险被高估了,AI本质上仍是一种工具和技术;但更值得警惕的是——过去人们担心的是AI"答错了什么",而当人工智能进入Agent时代、开始执行具体任务时,安全挑战正在升级。几乎在同一时间,OpenAI还发布了另一篇关于AI安全的文章,研究者在大模型测试时发现,AI在长时间自主完成任务时,可能会做出意想不到的举动,比如不断寻找系统漏洞、绕过限制,甚至通过伪装和"越狱"来完成目标。"过程全对,结果全错"成为Agent时代AI安全的新特征。
🔬 25家科技巨头联名华盛顿:反对"过早限制"开放权重AI,Kimi K3/GLM-5.2成背景板
7月26日,环球市场播报深度报道的硅谷到华盛顿"蒸馏"大辩论进入白热化:英伟达、微软、Meta、Palantir等25家科技公司与风投基金联合发布公开信,敦促美国政策制定者避免对开放权重AI模型实施"过早限制",以免"扼杀竞争或将创新推向海外"。英伟达CEO黄仁勋、微软CEO纳德拉均在个人社交媒体上转发该公开信,马斯克在X上表示"完全支持",但SpaceX未正式签署。值得注意的是,OpenAI与Anthropic两大头部闭源实验室均未签署,谷歌、亚马逊也缺席签署名单——Altman在X上回应称希望美国"在开放权重与专有模型两条线上都赢"。
这封联名信的直接背景是:今年6月以来,Kimi K3(2.8T开源)、智谱GLM-5.2等中国开源模型在多项基准上逼近美国闭源前沿,引发华盛顿对"蒸馏"的国家安全担忧。谷歌AI负责人杰夫·迪恩今年2月在播客中首次向大众解释"蒸馏"概念——"通过蒸馏,你必须先有前沿模型,然后才能将其蒸馏进你的较小模型中";5个月后,这个概念突然成为从硅谷到华盛顿的热门话题。AI安全公司SecurityPal创始人用了一个形象的比喻:"这几乎就像有人去听了讲座,读了教科书,并完成了所有艰难的功课。然后另一个学生说:'嘿,我没做那些。我能直接抄你的作业吗?'"开放权重 vs 闭源前沿的治理博弈,在Kimi K3权重开放前夜被推到地缘政治的高度。
🏛️ WAIC 2026闭幕交出成绩单:351款产品全球首发,意向采购破200亿
7月20日闭幕的2026世界人工智能大会,在7月26日的周度观察中交出最终数据:展览总面积首次突破10万平方米,1100余家企业带来数千项展品,351款产品全球首发,组织全球177个重要采购团组,预计达成意向采购金额约203.6亿元(同比增25%)。同期上海物理智能与机器人研究院正式揭牌,32个上海市人工智能重点项目集中签约,投资额超409亿元;《关于成立世界人工智能合作组织的协定》签署,组织总部设于上海,102个国家和国际组织代表出席——这是我国首次在人工智能领域举办的高规格主场外交活动。
大会期间国产AI产品密集落地:腾讯7月23日宣布混元多模态模型部门与大语言模型部门合并,成立基础模型部,统一由首席AI科学家姚顺雨管理,自2026年1月底以来混元已启动底层基础设施全面重建,7月正式上线的Hy3展现出强于同尺寸且比肩2-5倍参数旗舰的智能水平;字节跳动Seed团队7月20日发布音频创作模型Seed Audio 1.0,影视级音频可用率超90%,已上线火山方舟体验中心。
夜雨聆风