AI 日报 · 2026-07-28关注方向:AI 大模型 / 具身智能 / 算力租赁
【1】Kimi K3 开源权重正式上线,2.8 万亿参数创开源模型规模纪录
7 月 27 日,月之暗面正式开源 Kimi K3 模型权重、技术报告,并同步开源支撑训练的关键 Infra 技术(MoonEP、FlashKDA、AgentEnv)。Kimi K3 总参数达 2.8 万亿,基于 KDA 混合线性注意力机制构建,原生支持视觉理解,拥有 100 万 token 上下文窗口。上线 Hugging Face 后 30 分钟内获超 4000个赞登顶趋势榜,被平台 CEO 称为"迄今增长最快的一次发布"。Nebius、Fireworks AI、Together AI、vLLM 等海外基础设施厂商随即宣布 Day 0 适配;华为昇腾也宣布对 MXFP4 量化实现 Day 0 原生支持。美国 AI 创企 Cognition(Devin 开发主体)已将 Kimi K3 接入其桌面客户端,称其为"首款性能逼近前沿水准的开源模型"。 这是中国开源模型连续三个月内的第三锤(继 DeepSeek-V4 预览版、GLM-5.2之后),分别打向美国闭源旗舰模型的价格、长任务能力和模型规模三个维度。Kimi K3 在多项独立评测中进入全球第一梯队,部分编程和长任务成绩超过Claude 或 GPT,标志着开源模型与闭源旗舰的性能差距已大幅收窄。开源生态的快速扩张正在倒逼闭源厂商重新审视竞争策略,同时也引发了美国监管层对"中国开源模型蒸馏和安全风险"的关注。【2】英伟达牵头成立开放安全 AI 联盟,开源与闭源路线之争白热化
7 月 27 日,英伟达联合微软、Adobe、IBM、SAP、戴尔、思科等 37 家企业宣布成立"开放安全人工智能联盟",旨在构建和共享开源工具,推动 AI 的负责任使用,构建基于开源生态的 AI 安全防御体系。同日,支持开源大模型的行业联名信签署企业突破 50 家,谷歌、Meta、AMD 悉数在列,OpenAI 也加入其中。面对行业压力,迟迟未表态的 Anthropic CEO 阿莫迪发文回应,称公司"从未主张禁止开源权重模型",但行业对其"前沿模型风险论"不再买账。英伟达明确表态:世界既需要封闭式模型,也需要开放式模型。 这是 AI 行业"开源 vs 闭源"路线之争的标志性事件。OpenAI 和 Anthropic近期向美国政策制定者示警,试图限制中国开源模型的使用;而英伟达、微软、Meta 等巨头则联名反对过早限制开放权重模型。联盟的成立意味着硅谷在开源问题上已实质分裂——以英伟达为首的"开放派"正在通过生态联盟构建竞争壁垒。对于算力行业而言,开源模型的繁荣直接拉动推理算力需求,是 GPU租赁市场持续景气的重要驱动力。【3】中国大模型周调用量达美国 14 倍,三星海力士将签 9500 亿美元芯片大单
据 OpenRouter 最新数据,上周(7 月 20-26 日)全球 AI 大模型总调用量为58 万亿 Token。其中,中国大模型周调用量达 33 万亿 Token,已连续十三周超过美国,达到美国的 14.1 倍;同期美国大模型周调用量为 2.34 万亿 Token,环比下滑 67.86%。与此同时,韩国总统顾问透露,三星电子与 SK 海力士将与包括英伟达在内的美国科技巨头达成总价值高达 9500 亿美元的存储芯片供应合作。此外,工信部 7 月 27 日发布《"小快轻准"数字化产品和服务培育指引(2026 年版)》,提出深化人工智能在中小企业深度融合应用。 中国大模型调用量持续碾压美国,说明中国 AI 应用生态的渗透速度远超预期,庞大的推理需求正在转化为持续的算力消耗。9500 亿美元的存储芯片供应合作则表明全球 AI 供应链正在加速向深度绑定方向演进,HBM 等关键存储芯片的产能扩张将直接影响未来 GPU 算力的供给节奏和租赁价格走势。工信部的新政策则从需求侧进一步催化中小企业 AI 算力消费【4】GPU 算力租赁价格持续攀升,H100 合约价一年涨近 40%
据 SemiAnalysis 数据,H100 一年期租赁合同价从 2025 年 10 月的 1.70 美元/小时飙升至 2026 年 3 月的 2.35 美元/小时,涨幅近 40%。截至 2026 年 7 月,国内市场 H100 月租普遍在 1.2-1.5 万元/卡,H200 单卡月租金突破 6.6 万元。国际市场上,AWS、Azure、GCP 三大超算云 H100 按需价格在 6.88-12.29 美元/GPU 小时,而新兴 GPU 云(RunPod、Lambda、Vast.ai 等)价格低至 1.38-3.99美元/小时,价差达 75-86%。分析指出,多智能体(Multi-Agent)AI 工作负载带来的推理需求激增是价格上涨的核心驱动力,on-demand 容量在所有 GPU 类型上均已售罄。 算力租赁价格持续上行反映了 AI 推理需求的爆发式增长远超供给扩张速度。新兴 GPU 云与超算云之间的巨大价差,意味着算力租赁市场仍存在显著的套利空间和商业模式创新机会。对于具身智能和大模型企业而言,持续攀升的算力成本正在倒逼其优化模型架构和推理效率,MaaS 价格战与算力成本上行之间的剪刀差值得持续关注。【5】2026 年具身智能进入"量产元年",整机产量有望突破 10 万台
2026 年被业界普遍视为"人形机器人量产元年"。工信部与国务院国资委近日联合印发通知,启动年度人形机器人与具身智能实景实训专项行动,提出到年底"带动形成万台级规模落地能力"。数据显示,2025 年中国人形机器人出货量约 1.44 万台,占全球出货量的 84.7%;2026 年整机产量有望突破10 万台。今年上半年,国内具身智能及机器人领域披露融资总额达 460 亿元,涉及 226 家企业、288 起融资事件。摩根士丹利预计,中国人形机器人市场规模今年将达 20 亿美元,2030 年攀升至 150 亿美元。产业形态已形成清晰分工:工业机械臂深耕标准化作业,轮/四足机器人规模化落地移动类场景,人形机器人面向柔性装配和护理等特殊场景。 从"技术演示"到"真干活"的转变标志着具身智能正式进入商业化落地阶段。万台级规模落地目标意味着产业链上下游(关节、传感器、控制器、模型算法)将迎来实质性的量产需求释放。460 亿元的半年融资额表明资本市场对这一赛道的信心依然充足。但行业也面临四大核心瓶颈:真实机器人数据难以支撑规模化训练、短动作能力难以延展为长链路任务、世界理解难以转化为可执行动作、离线模型难以进入真实闭环系统。世界模型被视为破局关键。