7 月 19 日, AI 圈进入了一周内的第二轮"开源风暴":阿里通义宣布 Qwen3.8 即将开源, 2.4T 参数、官方公开承认性能"仅次于 Fable 5"——这是中国大模型公司第一次主动把自己定位在全球第二;月之暗面 Kimi K3 因需求远超预期,上线 48 小时即暂停 C 端新订阅,发布次日 ARR 创历史最大单日增幅,公司据报拟 6 个月内赴港 IPO ,估值或超 300 亿美元;面壁智能一口气开源 MiniCPM-Robot 具身模型系列,把 1.5B 的 VLA 模型塞进机器人本体; Anthropic 让步——Claude Code 周限额提升 50% 至 8 月 19 日、 Fable 5 入驻 Max 和 Team Premium 套餐;围棋世界一哥申真谞受让两子战胜 KataGo 扳平三番棋;谷歌安卓 Gemini 锁屏漏洞曝光、纽约禁止房东用 AI 图做租赁广告——AI 渗进物理世界的成本和风险正在被一一标注。
模型动态
1. Qwen3.8 即将开源, 2.4T 参数官方称"仅次于 Fable 5"
阿里通义千问宣布 Qwen3.8 即将发布并很快开放权重,模型参数量 2.4T ,官方在原推里直接写"仅次于 Fable 5"——这是中国大模型第一次主动把自己挂在公认第一的闭源旗舰旁边。 Qwen3.8-Max-Preview 已上线阿里云 Token Plan 、 Qoder 、 QoderWork , Qoder 还给出限时 1 折、夜间 0.2 折起的调用福利。分析师 Nathan Lambert 评论:中国政策正推动顶尖模型开放权重,开启智能竞争新阶段。
2. 面壁智能开源 MiniCPM-Robot 具身模型系列, 1.5B VLA 走端侧路线
面壁智能开源首个具身 AI 模型系列 MiniCPM-Robot :包含 1.5B 参数通用视觉-语言-动作( VLA )模型 MiniCPM-RobotManip 、目标跟踪紧凑型模型 MiniCPM-RobotTrack ,以及专为具身模型构建的高性能推理框架 PhyAI 。当行业主流在卷"云端万亿大模型当机器人脑子",面壁走的是反方向——把机器人智能拉回端侧,补上"反射弧"那 100 毫秒。
3. 面壁 MiniCPM5-2B 发布: 4B 以下全球第一, 9 芯片 Day0 适配
面壁智能联合 OpenBMB 发布端侧模型 MiniCPM5-2B ,以 2B 参数量在 Artificial Analysis 的 AA-Index 榜单取得 4B 以下模型最高分 17 分,平均分 54.26 ,超越 Qwen3.5-2B 等竞品。模型原生支持混合思考与 512K 超长上下文,已完成华为昇腾、 AMD 、英特尔、联发科、高通、英伟达等 9 款芯片 Day0 适配,即将开源。 MiniCPM 开源系列累计下载量突破 3800 万次。
4. 商汤发布 SenseNova U1 Pro :原生多模态 + 8K 出图
商汤在 WAIC 发布旗舰原生多模态基础模型 SenseNova U1 Pro ,基于 NEO-Unify 架构统一理解、生成与行动,支持原生交织视觉-语言推理。相比 U1 Lite , U1 Pro 支持数十轮智能体生成循环、 8K 原生分辨率输出、超低文字渲染错误率,以及超宽/超高图像生成。预览版现已开放邀请, API 与定价将于 2026 年 8 月正式发布。
5. 阿里开放式世界模型 HappyOyster 1.0 上线百炼,一句话生成可交互世界
阿里巴巴发布开放式世界模型 HappyOyster 1.0 (快乐生蚝),已登陆阿里云百炼面向企业和开发者灰测。模型提供世界探索与实时导演两大模式,支持用户通过一句话或一张图生成可实时交互的开放世界,可用文字指令操控镜头与剧情。产品提供 Android/iOS/Web 三端 SDK ,支持构建可玩世界、互动剧等沉浸式应用。
产品动态
6. Anthropic 大让步: Claude Code 周限额提升 50% 至 8/19 , Fable 5 入驻 Max/Team Premium
Anthropic 宣布所有 Pro 、 Max 、 Team 及按席位计费 Enterprise 用户的 Claude Code 周限额在 8 月 19 日前提升 50%。同时 Claude Fable 5 从 7 月 20 日起纳入 Max 和 Team Premium 套餐,限额为 50%; Pro 和 Team Standard 用户可通过使用额度继续访问,并获一次性 100 美元额度。外界普遍解读为对 Kimi K3 和 Codex 持续重置限额的竞争反应——Anthropic 罕见地放下身段。
7. 荣耀发布 AgenticOS 智能体操作系统, Robot Phone 8 月首发内核
荣耀在 WAIC 2026 发布 AgenticOS ,支持意图驱动、自然交互等四大特征,拥有行业首个系统级 Agent 架构。 8 月发布的 Robot Phone 将首发其内核, Q4 的 Magic9 系列将推出尝鲜版。 Robot Phone 搭载第五代骁龙 8 至尊版芯片,顶部集成行业最小四自由度钛合金机械云台,体积缩小 70%。荣耀的算盘是从手机操作系统的底层重写 Agent 入口。
8. 小鹏第二代 VLA 模型打通中国与欧洲,目标 2027 年海外交付
小鹏发布图灵第二代 VLA 模型,已实现同一套模型打通中国与欧洲市场。该模型通过世界模型与 VLA 一体两面设计,可在训练数据不足的海外市场自主生成训练数据加速泛化。小鹏正加快推进欧洲量产适配,目标 2027 年逐步向海外用户交付。"一套模型卖全球"这条路一旦走通,将改写中国智驾出海的标准打法。
9. 国家地方共建人形机器人创新中心 × 华为:全国首个具身智能实训场样板点
国家地方共建人形机器人创新中心与华为在 WAIC 2026 发布全国首个具身智能实训场样板点。该实训场打通不同品牌人形机器人的训练数据接口,支持工业搬运、巡检、服务类机器人在高温、雨天、狭小通道等复杂场景的统一仿真训练,并对外开放中小机器人企业试用名额。样板点依托国产算力底座,搭载具身智能 VLA 大模型——具身智能这个赛道开始出现共享基础设施。
10. 蚂蚁数科发布 Agentar2.0 :商业智能体超级工厂,预置 200 个岗位级模板
蚂蚁数科在 WAIC 发布商业智能体超级工厂核心平台 Agentar2.0 ,首批预置 200 个岗位级数字专家模板及数百个可订阅的智能体工具。该平台通过自研基座模型 LingDT 与区块链技术实现多智能体可信协同,目前已在金融行业落地超 300 个智能体。从模型大战转到 Agent 工厂——蚂蚁把企业级 Agent 当成可量产的工业品在造。
行业风向
11. Kimi K3 需求暴增,月之暗面暂停 C 端新订阅并拆分会员
Kimi K3 上线 48 小时内需求逼近算力上限, Kimi.ai 宣布暂停 C 端新订阅以保障现有用户体验,已订阅用户不受影响,已购 Coding Plan 的用户继续受益。团队正加速扩容,将分批重新开放新订阅。未来会员将拆分为 Kimi Membership ( Web/App/Work )和 Kimi Code Membership (编程工作流)两套,以更精准匹配算力。优质国产开源模型把基础设施逼到极限,已经成了某种"行业勋章"。
12. 月之暗面 Kimi K3 发布次日 ARR 创纪录,拟 6 个月内赴港 IPO 估值超 300 亿美元
月之暗面 Kimi K3 发布次日 ARR (年化收入)创下历史最大单日增幅。公司据报已分发股东决议案调整架构,正筹备未来 6 个月内赴港 IPO ,估值或超 300 亿美元——以约 3% 的 Anthropic 估值和 4% 的 OpenAI 估值,在 Kimi K3 已接近美国前沿水平的情况下快速走向公开市场。中国大模型"新四小龙"的资本路径正在分叉。
13. 英伟达黄仁勋东京行:敲定全球首个机器人产业国家级 AI 工厂
英伟达 CEO 黄仁勋在东京宣布与日本政府支持的 AI 企业 Noetra 合作,建设一座配备 2.75 万块 GPU 的"AI 工厂",定位为全球首个面向机器人产业的国家级 AI 基础设施。黄仁勋还与铠侠、东京电子等多家日本科技企业高层共进晚餐,离开居酒屋时向粉丝赠送红豆糕。国家级 AI 工厂这种主权级算力部署,正在成为大国博弈的新单位。
14. 申真谞受让两子战胜 KataGo ,三番棋扳平
世界排名第一的韩国棋手申真谞在"精锐数学·韩经棋神战"第二局中,以四目半战胜围棋 AI KataGo ,成为首位在正式比赛中受让两子击败 KataGo 的职业棋手。比赛配置四块 RTX 3090 显卡(合计 96GB 显存),申真谞每局 5 小时基本用时加一次 30 秒读秒, KataGo 每手 20 秒内完成运算。双方将于 21 日进行最终局。受让两子这个分寸之间,藏着人类顶尖棋手和顶级 AI 当前差距的真实刻度。
15. 安卓 Gemini 锁屏漏洞曝光:可不输密码发短信,谷歌本周修复
谷歌安卓系统存在一项身份验证绕过漏洞,攻击者在拥有物理访问权限时,可不输入锁屏密码通过 Gemini 发送短信或 WhatsApp 消息。该漏洞自今年 5 月起被发现,最初在 Android 16 系统、 Pixel 6a 手机中复现,触发方式为在锁屏界面同时按下"继续"和"添加附件"按钮。谷歌已知悉该漏洞,计划本周大范围推送修复补丁。 AI 助手越深入系统底层,被武器化的入口就越多。
16. 纽约市长发布"租赁欺诈报告",房东不得用 AI 图做租赁广告
纽约市长 Zohran Mamdani 发布"租赁欺诈报告",要求房东和中介披露在房源广告中使用 AI 生成或编辑的图片。该措施旨在打击利用 AI 美化房产、欺骗租户的行为,尤其保护需远程签约的租户。报告还包含承认租户工会、扩大租户谈判权等建议。这是城市级监管首次正面回应"AI 美图导致信息失真"这条灰色产业链。
17. 作家埃格斯受邀 OpenAI 演讲:批评 ChatGPT 夺走一代人的表达能力
美国作家戴夫·埃格斯( Dave Eggers )应 OpenAI CEO 萨姆·奥尔特曼邀请,为约 200 名 OpenAI 员工发表演讲。他批评 ChatGPT 给教育工作者带来"灾难性"影响,称学生若用它写作将永远学不会真正表达,自己的声音会被夺走,导致一两代人陷入沉默。埃格斯此前曾公开批评 AI 生成文字是"毫无意义的模仿拼凑之作"。让批评者进公司演讲这种姿态本身,比演讲内容更值得关注。
论文研究
18. Google DeepMind 提出 GenCeption :视频生成模型 7500 段合成视频训练即可成为通用视觉模型
Google DeepMind 提出 GenCeption ,将阿里巴巴开源的 Wan2.1 视频生成模型改造为单次前向传播即可完成深度估计、分割等任务的模型。它仅用 7,500 段合成视频训练,数据量仅为竞品的 1/7 至 1/500 ,但在多个基准上匹配甚至超越了 DepthAnything 3 等专用模型。生成式模型与判别式模型之间那条泾渭分明的界限,正在被"一个模型干所有事"的范式吃掉。
19. AI 文本检测器在模仿作者风格时漏检率飙升,科学写作类别高达 24%-29%
Epoch AI 研究显示, Pangram 、 GPTZero 和 Originality.ai 检测普通 AI 文本近乎完美,假阴性率最高仅 0.7%。但当 Claude Opus 4.8 等模型模仿特定作者风格写作时,平均 13% 的 AI 文本未被检出;科学写作类别中漏检率高达 24%-29%, Pangram 对 Gemini 生成的学术文本漏检率达 48%。 AI 检测工具这条赛道,正在被模型自身的风格适应能力反向打穿。
20. Perplexity 发布 WANDR :智能体搜索基准,最高分仅 0.447
Perplexity 发布开放基准 WANDR ,包含 500 个真实数据收集任务,要求智能体同时完成广泛发现与深度验证。其自家的 Search as Code 系统以 0.363 的 Soft F1 领先,但所有系统均远未解决该基准,最高分仅 0.447 。当 BrowseComp 这类老基准被刷到接近 90%,行业需要新的尺子来重新校准"智能体能干多复杂的活"。
内容摘录整理自「 AI HOT 日报 aihot.virxact.com 」,数据覆盖北京时间 2026 年 7 月 19 日全天。
夜雨聆风