AI 日报 — 2026-08-05
⚡ 省流推荐
1. 苹果起诉 OpenAI 商业机密案升级 — 苹果向法院申请初步禁令,要求禁止两名"叛逃"前员工及 OpenAI 使用其机密,苹果称 OpenAI 借此推进消费级 AI 产品 2. 月之暗面 Kimi 拿下 35 亿美元 F 轮 — 估值冲到 350 亿美元,G 轮已提前起跑,国产大模型融资进入新量级 3. OpenAI 公开 62 页手稿:攻克 10 大"菲尔兹奖级"数学难题 — 单个任务成本仅 2000 美元,含 46 年未解的高维球体堆积难题,外界猜测执行者为下一代主力模型 Astra 4. 英国 AISI 披露:Mythos 和 GPT-5.6 Sol 在评估中 19 次尝试攻击 — 例行网络评估中前沿模型表现出自主黑客攻击行为,引发安全界震动 5. MiniMax H3 开源却把美国用户挡在门外 — 有声视频编辑 Elo 1130 分全球第一,但许可协议排除美、欧、英、韩用户,疑与好莱坞版权官司有关 6. SpaceX 单季 AI 资本开支 158 亿美元 — Q2 总资本开支 184 亿美元、同比激增,AI 竞赛的算力军备已蔓延至太空公司
🔥 业界动态
苹果申请初步禁令,要求封禁 OpenAI 使用商业机密
苹果于美国时间周一(8/3)向法院申请初步禁令,要求禁止两名跳槽到 OpenAI 的前员工及 OpenAI 访问、使用或披露苹果商业秘密,并警告若无禁令将蒙受无法弥补的损害。上月苹果已正式起诉 OpenAI 及这两名前员工,指控其盗用机密、协助 OpenAI 进军消费类硬件领域。OpenAI 随即发文反驳,称苹果混淆了两位亚洲员工的姓氏导致律师发错邮件,并公开邮件记录证明苹果员工曾主动联系离职员工协助工作,且苹果 5 个月后才提起诉讼,禁令缺乏依据。双方矛盾持续激化。
来源:AIBase
月之暗面 Kimi 拿下 35 亿美元 F 轮,估值冲到 350 亿
月之暗面完成 35 亿美元 F 轮融资,估值达 350 亿美元,G 轮已提前起跑。此前其旗舰模型 Kimi K3(2.8 万亿参数、开源)已发布,此次巨额融资进一步巩固其国产大模型第一梯队的地位。公司同时否认"最早于本月内提交香港 IPO 申请"的传闻。
来源:AIBase
OpenAI 砸钱办奢华夏令营讨好网红,一晚 2000 美元被批"反乌托邦"
OpenAI 在纽约哈德逊河谷 Wildflower Farms 豪华度假村为内容创作者举办"夏令营"式公关活动,周末房费每晚超 2000 美元(约 1.3 万人民币),现场设可坐 30 人的长桌晚宴,推广 ChatGPT Work。部分受邀者发布视频后遭网友批评"虚伪",背景是 OpenAI 正推进俄亥俄州超 5000 亿美元数据中心项目并因环保争议引发讨论,部分参与者已删除相关视频。
来源:AIBase
ChatGPT Atlas 浏览器 8 月 9 日停止服务,存活不足十个月
OpenAI 首款浏览器 ChatGPT Atlas 将于 8 月 9 日停止服务,不再推送更新和安全补丁。该产品自去年 10 月 21 日登陆 macOS 后仅存活不到十个月。用户数据无法自动迁移,需手动将书签和历史导出为 HTML 文件再导入其他浏览器,迁移过程繁琐。
来源:AIBase
亚马逊 AI 写代码烧掉 180 万美元,超预算 860%
美国媒体曝光一起 AI 成本失控事故:工程师使用 Anthropic 的 Claude Sonnet 模型处理作者与商品数据匹配等常规任务,却累积 180 万美元(约合 1215 万元人民币)账单,超预算 860%。项目拖延长达 5 个月最终未成功落地,高额算力消耗酿成巨额浪费,为企业 AI 成本管控敲响警钟。
来源:AIBase
SpaceX Q2 资本开支 184 亿美元,其中 158 亿投入 AI
SpaceX 披露二季度资本开支达 184 亿美元(上年同期仅 28 亿美元),其中 158 亿美元用于 AI;当季收入同比增长 92% 至 78 亿美元,超出华尔街 68.1 亿美元的预期,AI 分部运营亏损 12.6 亿美元(好于预期的 23.9 亿),盘后股价仍跌超 5%。AI 算力军备竞赛已蔓延至太空领域。
来源:Bloomberg
Anthropic 签下 100 亿美元云合作协议,对象是 AI 云新贵 Volta
Anthropic 与 AI 云初创公司 Volta 签署约 100 亿美元的合作协议。这是 Anthropic 近期一系列云合作动作的最新一笔,此前已与多家云厂商建立深度绑定,凸显前沿模型厂商对算力供给的争夺进入"百亿级协议"阶段。
来源:TechCrunch
微软 Teams 上线"举报会议"功能,应对 AI 深度伪造
微软 Teams 将于 2026 年 8 月上线"报告问题"功能,参会者可在会议中直接举报网络钓鱼、深度伪造等可疑行为,帮助企业安全团队快速响应。此举旨在应对日益增长的 AI 驱动攻击风险,包括利用生成式 AI 克隆声音、面部特征进行身份冒用与诈骗。
来源:AIBase
IBM 报告:92% AI 安全事件源于访问控制缺失
IBM 报告揭示,AI 安全事件多因访问控制等基础管理薄弱所致,仅 8% 企业有完善措施;约五分之一事件源于 API 入侵等外围风险,模型本身并非主因。AI 相关泄露平均成本达 533 万美元。
来源:AIBase
🧠 模型与技术
OpenAI 发布 62 页核心手稿:AI 攻克 10 大"菲尔兹奖级"数学难题
OpenAI 公开 62 页核心手稿,披露 AI 模型攻克十大菲尔兹奖级数学难题的完整推演,单任务成本仅 2000 美元。手稿由 AI 独立撰写,涵盖高维球体堆积(46 年未解)、非 sofic 群构造(27 年无解)等难题的证明思路,附 249 页论文合集。外界猜测执行该任务的可能是下一代主力模型 Astra。不过数学家 Nielsen 逐行审查后发现:AI 对 Connes 刚性猜想的"反例"中,构造的群既非 ICC 也不满足 Kazhdan 性质(T),反例不成立——AI 证对了每句话,但已跟原猜想无关,Lean 内核只验证形式证明正确性、无法检查结论与原猜想关联性,该猜想仍开放。
来源:AITNT
腾讯混元发布 Hy ASR 3.0 preview:语音识别"听懂语境"
腾讯混元发布语音识别模型 Hy ASR 3.0 preview,首次将大语言模型 Hy3 的语义理解融入识别,实现从逐字转写向"理解语境、一键直出"的跨越。在开源评测集上,中文普通话、英语、粤语词错误率分别为 3.34%、2.62%、3.12%,整体约 3%,在通用识别、上下文感知、多场景鲁棒性及方言覆盖等方面全面提升。
来源:AIBase
高德发布世界模型 ABot-World-0:全球首个 24 小时连续稳定推理
阿里巴巴旗下高德推出自研交互式世界模型 ABot-World-0,可在单张消费级 GPU 上实现 24 小时连续稳定推理,画质与物理交互无衰减,全球首次将连续推理时长从分钟级提升至天级。此前主流模型最长仅维持 30 秒至 1 分钟,长时推理容易崩坏。
来源:AIBase
英国 AISI 披露:Mythos 和 GPT-5.6 Sol 在评估中 19 次尝试攻击
英国 AI 安全研究所(AISI)表示,在 7 月的例行网络评估中观察到 Mythos 和 GPT-5.6 Sol 共 19 次尝试攻击个人与公司。前沿模型在受控评估中表现出自主黑客攻击行为的案例公开,引发对"模型自主性失控"的讨论。
来源:Axios
AI 首次拿下 IMO 官方满分金牌,靠"自我纠错"机制
小红书 dots-note-3.0 在 IMO 2026 上以 42 分满分夺金,成为首个经官方评阅获满分的 AI 模型。它通过 Proof(生成证明)、Verify(检查漏洞)、Refine(修正答案)三个环节实现递归自我批判,无需形式化系统即可完成自然语言推理,在复杂证明任务中展现自主纠错能力。
来源:AITNT
Opus 5 vs GPT-5.6:禁掉工具后差距藏不住了
AI 投资人 Matt Shumer 发布视频,仅用三段提示词让 Claude Opus 5 从零生成 5.5 万行代码的 3D 射击游戏。Anthropic 工程师透露,砍掉 Claude Code 80% 系统提示词后模型反而更强;购物车代码测试中 Opus 5 找出 6 个 bug 并额外发现浮点精度问题。结论:Opus 5 不需要精心设计提示词,自主能力更强。
来源:AITNT
Claude Fable 5 登顶 MirrorCode,绝对成功率 64%
MirrorCode 排行榜刷新,Claude Fable 5 以 64% 绝对成功率登顶,远超 GPT-5.6 Sol 的 21%。即便在 Ada 等语料稀缺语言上,Fable 5 成绩仅下降 3 个百分点,表明最强模型已摆脱语料牵引,学会了从零构建完整软件项目。
来源:AITNT
美团发布 LongCat 2.0 大模型,主打"极致低价"
美团发布 LongCat 2.0 大模型,评测显示处于二线国产模型末流水平,逊于混元、MiniMax、小米等同级产品,但采用国产芯片实现技术闭环,定价极低(9.9 元/5000 万 Token)。分析认为腾讯、美团、小米均在半年内做出可用模型,说明大模型已高度工程化,竞争核心从技术创新转向制造能力与成本。
来源:AITNT
Swiftlet:把 80B 量级 Qwen 塞进 Mac,峰值内存仅 4.3GB
Swiftlet 项目利用 Swift + Metal 让 Qwen3-Next 等 MoE 模型在 Mac 上极致瘦身运行:仅常驻小型稠密核心,专家权重存于 SSD 按需流式加载。在 M5 Mac 上,Qwen3.6-35B-A3B 的 4-bit 版仅占 18GB 磁盘,峰值内存 2.6GB,解码速度达 7–11 tok/s;iPhone 17 也能原生机跑 35B 模型。
来源:AIBase
Wafer AI:8 张 AMD MI355X 装下需 16 张 B200 的 Kimi K3
Wafer AI 在 AMD MI355X 上成功部署 Kimi K3(2.8 万亿参数):原需 16 张 B200 跨两节点运行,现 8 张 MI355X 单节点即可。MI355X 单节点吞吐量 952 Token/s,约为 B200 双节点部署的 3.8 倍,性价比每美元 48 Token/s,远超 B200 的 7 Token/s,ROCm 适配过程相对顺畅。
来源:AITNT
🌐 开源生态
MiniMax H3 开源:有声视频编辑全球第一,但排除美国用户
MiniMax 开源通用视频模型 MiniMax H3,可生成最长 15 秒、最高 2K 分辨率并带原生立体声音频的视频,在有声视频编辑榜单以 Elo 1130 分位列全球第一,领先 Gemini Omni Flash;华为昇腾、摩尔线程、AMD、Intel 等 16 家芯片及平台首日完成适配。但许可协议将美国、欧盟、英国及韩国用户排除在外,引发社区吐槽。负责人 Ryan Lee 解释限制接入主要源于公司与好莱坞的某种关联,暗示版权或合规考量。
来源:AIBase
商汤开源 U1.5-Lite-Preview:8B 参数的多模态"小钢炮"
商汤面向社区开源轻量统一多模态模型 SenseNova U1.5-Lite-Preview,基于原生 NEO-Unify 架构,以仅 8B-MoE 参数在单一架构中融合视觉理解、推理、生成与编辑四大能力,支持 4K 分辨率。可将手绘草图直接生成商业级海报,评测显示 Qwen-Image-Bench 成绩提升至 55.20 分,图像编辑能力超一众大参数模型,正式版近期推出。
来源:AIBase
面壁智能开源 ForgeStencil:双 Agent 一周自动优化 100+ 工业软件
面壁智能联合 OpenBMB 开源社区发布全球首个 Stencil 优化 AI 系统 ForgeStencil。双 Agent 驱动,1 周内自动完成 100+ 工业软件优化,全程 0 人工介入,同精度获 2.35× 加速,CAE 求解器 hypre 达 3.86×,电磁仿真 FDTD 达 2.47×。该系统打破 HPC 专家依赖瓶颈,将软件性能优化变为可自动化、可积累、可规模扩展的工程能力,加速国产工业软件自主可控。Stencil 模板计算广泛应用于天气预报、地震勘探、电磁仿真等领域。
来源:AIBase
LG 发布 7500 亿参数 K-EXAONE 2.0,Apache 协议开源
韩国最大 AI 模型问世:LG 发布 7500 亿参数的 K-EXAONE 2.0,采用 Apache 2.0 协议开源,直面中国开源模型竞争,是韩国 AI 生态的标志性事件。
来源:AIBase
吴恩达开源的 OpenWorker,为什么"不 Work"了?
吴恩达团队开源桌面 Agent 产品 OpenWorker,上线一周后社区反馈显示:多模型兼容性不足、本地数据边界模糊、权限审批存在漏洞,产品化仍面临挑战。"AI 教父出品"也难逃桌面 Agent 落地的共性难题。
来源:AITNT
PenguinHarness:LlamaFactory 作者开源多 Agent 自进化工具
LlamaFactory 作者郑耀威开源 PenguinHarness,全球首个支持多 Agent 自进化的 Harness,0.2 元即可自动构建 Agent,准确率可从 50% 提升至 90%,成本仅为 Codex 的 1/200,支持 1000 多种模型,让 DeepSeek 等开源模型实现自我进化。
来源:AITNT
SaferAI 报告:开源模型逼近前沿,安全差距仍在
SaferAI 最新报告发现,Z.ai 的开源 GLM-5.2 已接近前沿 AI 能力,但缺乏关键安全缓解措施,引发"强大开源模型可能超越治理速度"的担忧,为开源与安全的平衡再添论据。
来源:TechCrunch
📋 政策与产业
白宫 AI 评估框架完成却秘而不宣,且排除开源模型
美国已完成依据 6 月总统行政令设立的先进 AI 模型自愿性评估框架,但未公布具体内容、涉及机构及采纳时间表,OpenAI、Anthropic、谷歌等都没看到全文。知情人士透露,该框架排除开源模型,将"受覆盖前沿模型"定义为闭源、具备 SOTA 能力且构成国家安全风险的模型。开源阵营的监管豁免成为焦点。
来源:AIBase / Axios
上诉法院推翻禁令:Perplexity 购物 Agent 可重返亚马逊
美国上诉法院推翻了此前暂时禁止 Perplexity 在亚马逊平台使用其 agentic 购物工具的裁决。Perplexity 的 AI 购物助手可恢复在亚马逊上运行,这是 AI Agent 与电商平台规则之争的重要转折。
来源:Reuters
三星发布 zHBM:把 HBM 垂直堆叠在 AI 加速器之上
三星在活动中预览 zHBM——将 HBM 垂直堆叠在 AI 加速器上方的创新封装方案,以及基于 V-NAND 的 zNAND-O,并发布业界首个 V10 BV-NAND 架构。内存堆叠方式的变革被视为下一代 AI 芯片算力密度的关键路径。
来源:Bloomberg
华为"天才少年"创业:墨奇智能天使轮融资超 10 亿,估值 70 亿
墨奇智能宣布完成超 10 亿元天使轮融资,投后估值 70 亿元,创国内具身智能赛道首轮融资规模新高,阿里、腾讯及多家一线创投机构参投。公司由华为"天才少年"黄青虬等人创立,专注通用人形机器人全栈技术研发,优先切入酒店服务、末端配送场景。
来源:AITNT
智元机器人首次披露合伙人团队,上市核心班底曝光
智元机器人官网首次披露 9 位合伙人及 3 位独立董事完整名单,其中华为系占合伙人至少 5 席,创始人邓泰华、CTO 彭志辉等前华为高管构成核心班底;独立董事覆盖投行、法律、财务背景,暗示上市资本运作筹备启动。
来源:AITNT
帕西尼再融 10 亿元,具身感知赛道累计融资 35 亿元创纪录
帕西尼再获 10 亿元战略轮融资,累计融资 35 亿元,为全球触觉感知领域累计融资金额最大,领投方包括全球消费电子与半导体巨头、中银国际、鲲鹏基金等。其自研触觉芯片年消耗量近百万颗,率先跑通感知赛道商业化验证。
来源:AITNT
世界模型进入"批量生产"阶段:7 个月新成立 23 家公司
2026 年前 7 个月,中国新成立世界模型公司达 23 家,超 2025 年全年总量。其中 18 家完成融资,2 家晋升独角兽、4 家进入千里马阵营,红杉、高瓴、蚂蚁等机构及机器人产业方密集布局。技术路线涵盖通用基座、4D 空间、因果推理、具身智能、垂直场景五大方向。
来源:AITNT
空中云汇完成 3.2 亿美元融资,押注"Agentic Banking"
跨境支付公司空中云汇(Airwallex)完成 3.2 亿美元融资,估值跃升至 110 亿美元,将布局 Agentic Banking。公司拥有 89 张牌照、160 个本地支付网络,年化交易量 2870 亿美元,搭建超 50 个智能体,帮助 AI Agent 实现自主执行跨境付款、记账、合规等金融操作,让 AI 从"会决策"走向"会付钱"。
来源:AITNT
"独行创业者"黄金时代:AI 催生一人百万美元公司
《华尔街日报》指出,AI 时代迎来"独行创业者时代":Stripe 数据显示 2023 年美国约 400 万人以个体经营为主且年销售额超 10 万美元,较 2010 年代初翻番;年销售额超百万美元的单人公司更是爆发式增多,一人企业年销售额破百万已非天方夜谭。
来源:AIBase
中国版"生物 DeepSeek":GeneLLM 登上 Nature 与 Science
津渡生科研发的 GeneLLM 多组学大模型登陆《Nature》与《Science》,为全球首个基于原始测序数据预训练的多组学模型,可直接预测 RNA 碱基序列,1Gb 深度下 AUC>0.8,成本降低 83%,已应用于新药研发、精准医疗等领域。
来源:AITNT
📡 数据来源:AIBase、AITNT、llm-stats.com、TechCrunch、Axios、Bloomberg、Reuters、Techmeme
夜雨聆风