
今日必看
TODAY'S SIGNAL
NVIDIA 开源 NOOA 框架
NVIDIA Labs 将整个 AI 智能体压缩成一个普通 Python 类——方法是模型在运行时补全的动作、字段保存状态、docstring 即提示词、类型注解是运行时强制契约,普通代码体则保持确定性执行。一个仅 253 行的智能体在 SWE-bench Verified 上用 GPT-5.5 拿下 82.2%(29 次调用、约 110 万 token),对比框架要 66 次调用、220 万 token 才到 78.2%;ARC-AGI-3 上 GPT-5.6-sol 舰队达 85.1% 平均 RHAE,单局成本约 13.3 美元。框架以 Apache 2.0 发布(NVIDIA-NeMo/labs-OO-Agents),模型无关、经 LiteLLM 路由,并贡献给 Open Secure AI Alliance。其关键机制是「引用传递」:工具结果以实时 Python 变量进入代码而非序列化进上下文窗口,会话转录始终可追加、缓存有效,无需上下文压缩。
Grok Imagine 2.0 升级
xAI 推出 Grok Imagine Image 2.0,在 LMSYS 文生图与图像编辑双榜冲到 #2(1320 分,较上一版 #14 大幅跃升)。核心能力是高精度区域编辑——悬停即可点选图像任意区域即时修改,同时保留背景一致性;排版与字体显著改善,信息图、商业海报里的小字也能保持清晰。模型已接入 Vercel AI Gateway,支持图生图与多轮编辑,但当前仅通过 xAI App 提供、未开放 API。这是 xAI 在视觉生成上第一次真正挤进第一梯队。
值得关注
WORTH NOTICING
• OpenAI 桌面端语音操控电脑
OpenAI 给 macOS 版 ChatGPT 桌面应用接入 ChatGPT Voice,基于全新语音模型系列 ChatGPT-Live,用户可直接用语音指令让智能体在电脑上执行多步骤任务、读取活跃屏幕内容(macOS 经 Appshots 访问),并原生对接 ChatGPT Work 与 Codex。这是语音从「对话」走向「代操作」的一步,控制中心从键盘鼠标部分让渡给自然语言。
• 全国产 10 万卡集群投用
国家发改委披露,国家超算互联网郑州核心节点首个全国产 10 万卡人工智能超集群投入运行,支持新材料、创新药、AI 等 26 个领域 300 多种计算任务;粤港澳大湾区节点新上线国产化超节点万卡集群,号称把万亿参数大模型训练时间从一年压到半年。截至 6 月底全国智能算力规模同比增 177%,达每秒 2185 百亿亿次浮点运算;鹏城实验室正以新一代光纤在深圳—贵州间建千公里级「深贵线」算力调度大通道。
• 1688 上线牛顿 AI 智能体
阿里巴巴旗下 1688 本月上线「牛顿」AI 智能体,买家输入采购需求,智能体数秒内完成选品、寻源、比价与议价,把 B2B 从「人找货」推进到「AI 替你找、替你比、替你对」。与之呼应,连连数字与银联国际合作推出「人在场」模式智能体支付——Agent 负责供应商匹配、商品筛选与支付指令发起,用户只在关键节点确认,拼出 B2B AI 采购的完整交易闭环。
• Mistral Voxtral 语音模型
Mistral 发布首个文本转语音模型 Voxtral TTS,处理 10 秒语音样本延迟仅 70 毫秒、达 9.7 倍实时率,3 秒参考音频即可零样本声音克隆。值得注意,这是 Mistral 首个未完全开源的模型,延续了其在开放与闭源之间反复权衡的路线。
• Cloudflare:机器流量超人
Cloudflare 在 2026 年二季度财报电话会上披露,AI 机器人等非人类流量已于 2026 年 5 月正式超过人类流量,比 CEO 此前预测的 2027 年底大幅提前;若趋势延续,预测五年后非人类流量将达人类 1000 倍。该季度营收 6.96 亿美元、同比增 36%,但净亏损 2.057 亿美元。
• Firebird 亚美尼亚 AI 工厂
NVIDIA 博客披露,Firebird 在亚美尼亚启动独联体地区最大 AI 工厂,由 NVIDIA 加速计算与 Dell 基础设施驱动(Blackwell、Rubin、DSX),亚美尼亚总理等官员出席开幕式。这是算力基建向东欧外溢的信号,也反映 NVIDIA 通过整机交付绑定区域算力节点的策略。
• Pokee-Isaac 28B 企业模型
Pokee AI 发布面向企业的 Pokee-Isaac 28B,主打 1000 万 token 上下文、可在客户安全边界内运行,RULER 基准 10M 长度准确率 93.3%,单张 B200 即可部署,原生兼容 OpenAI API。
快速浏览
QUICK SCAN
• Claude Code v2.1.225
新版本为用量警告新增网关支出限额支持,达到限额时提示显示上限、重置时间与操作者消息;并为不受信任目录中的 claude agents 增加工作区信任提示,修复了 macOS 上 MCP OAuth 间歇性 401、跨会话消息滞留及 Remote Control 恢复后历史损坏等问题。
• LlamaIndex LiteParse
LlamaIndex 发布轻量开源文档处理引擎 LiteParse,从数字 PDF 中毫秒级提取结构化表单数据、复选框状态、矢量图形与词级包围盒,无需为常规解析跑昂贵的视觉语言模型(VLM),面向 RAG 与数据管线开发者。
• 纯 C99 跑 BitNet
开发者用纯 C99 从零构建 CPU 推理引擎,无需 Python、CUDA 或 BLAS 即可运行 BitNet 1.58-bit 三值模型,在 Intel Xeon 上 4 线程跑出 36.25 tok/s,把低位宽模型的本地部署门槛进一步拉低。
• llama.cpp 支持 Longcat
llama.cpp 新增对 Longcat-Flash 模型的支持,开发者已提取出 8B 参数子模型并完成初步测试、提供 GGUF 文件,延续社区「把超大 MoE 拆成可消费小包」的务实路线。
• 35B MoE 开源红队渗透模型
一款专为自主红队渗透测试设计的 35B MoE 开源模型(激活仅 3B)发布,解决了此前模型捏造 Nmap 扫描结果、陷入死循环等痛点,在 SecEval、MITRE ATT&CK、CWE 等安全评测中均取得第一。
• OpenMed 本地医疗 AI 登顶
本地优先的开源医疗 AI 项目 OpenMed 登顶 GitHub 周度 Trending,集成 2200+ 医疗模型、支持 21 种语言,核心功能含临床实体识别与符合 HIPAA 的 PII 脱敏,全程可在设备端本地运行。
• ArmenAgha 实时交互新架构
ArmenAgha 团队展示专为物理世界实时交互设计的全新架构模型,未加速视频演示中推理响应极快,团队称这是针对实时预算专门推导的架构,仅凭表现完全猜不出其真实参数规模。
• 微软开源 BitNet 推理框架
微软开源 BitNet 推理框架,用 1.58 bit 三值权重量化让千亿参数模型在单 CPU 上运行——100B 模型单 CPU 可跑 5-7 tok/s,x86 下比 llama.cpp 快 2.37-6.17 倍,能耗降低 82%。
AI 前沿研究
AI FRONTIER
• AURORA-LM 连续扩散语言模型
南京大学模式识别实验室联合南洋理工、帝国理工提出连续扩散语言模型 AURORA-LM,先训练自编码器把文本映射为高容量连续 latent 序列,再用分块因果扩散模型学习其生成分布;全部实验在昇腾 NPU 上完成,并扩展到约 10 亿参数,验证了连续空间语言建模在国产算力上的训练与扩展可行性。
• PerceptionBench 多模态
一篇测量型论文构建 PerceptionBench,诊断 42 个现有基准的最早失败点、抽取十项原子感知能力,构造 3000 道短答案题,难度只来自感知本身。结果冷峻:16 个前沿多模态模型无一达到 60% 准确率,感知相关幻觉平均最弱,且总分相近的模型隐藏截然不同的能力剖面。
• LLaDA2.2 扩散语言模型
Inclusion AI 发布扩散语言模型 LLaDA2.2,通过对比草稿与正确输出执行保留、替换、删除、插入等编辑而非整体重写,支持 128K 上下文,在长周期智能体基准上追平甚至超过自回归模型。
• AV-AIVAT 智能体评估降本
论文提出迭代 AIVAT 估计器 AV-AIVAT,在不完全信息博弈中对智能体强弱评估实现 74 倍成本节约,并保证「认证随时有效停止」——把昂贵的智能体对弈评估压缩到可负担量级。
• 文件系统即智能体长期记忆
一项研究提出以文件系统作为智能体长期记忆——管理型智能体把经验整理成层级化 Markdown 文件,搜索型带引用检索路径,执行型把轨迹提炼为技能,相比向量数据库检索成本降低约一半。
• Leanstral 形式化代码模型
Mistral 推出面向 Lean 4 形式化验证语言的代码模型 Leanstral,只要证明编译通过即可保证代码属性对任意输入永远成立,有望把形式化验证从学术界推向工程实践。
AI 融资动态
AI FUNDING
• 智象未来 15 亿 C 轮晋独角兽
大模型公司智象未来(HiDream.ai)宣布完成 15 亿元人民币 C 轮融资,近三个月内已完成三轮密集融资、累计超 21 亿元,正式迈入独角兽行列,反映一级市场资金向具身与多模态高确定性公司聚集。
• 商汤医疗超 1 亿美元 B 轮
商汤医疗完成超 1 亿美元 B 轮融资,投后估值突破百亿元人民币,已进入 Pre-IPO 阶段,正筹备上市前最后一轮融资,向「医疗世界模型第一股」发起冲刺。
• 求之科技 1 亿美元天使+轮
距首轮超 1 亿美元天使轮落地不足一个月,求之科技(DISCOVER Robotics)再度完成 1 亿美元天使+轮,率先构建「模型—数据—仿真」全栈具身智能技术底座。
• Profound 百万美元种子轮
海外方面,由印度消费科技前高管创立的 Profound 推出 AI 职业代理人,通过 30 分钟对话学习用户工作与目标后代为处理职场事务,已获 150 万美元种子轮融资,补齐全球 AI 融资的多样性样本。
AI 股市动态
AI MARKET WATCH
• 周日休市 AI 主线周回顾
8 月 9 日周日,A 股、港股、美股均休市。本周 AI 与科技主线全面领涨,个股收盘明细详见 08-08 期互链。
• 本周 A 股科技领涨
沪指周涨 2.81%、深成指 5.39%、创业板 6.55%,全 A 平均股价涨 10.34%;信息技术板块单周涨超 11%,两市周五成交近 2.68 万亿、放量 1356 亿。
• 本周美股 AI 硬件大涨
美东 8 月 7 日纳指周涨 5.19%、标普 500 创历史新高(7757.64),费半单日涨 2.56%;Coherent 涨 13.44%、应用光电涨 9.2%(详见 08-08 期)。
• 光通信 PCB 主力净流入
主力 5 日净流入榜被光通信与 PCB 包场:天孚通信 59 亿、工业富联 56 亿、胜宏科技 49 亿、生益科技 42 亿、沪电股份 21 亿,机构持续加码算力链。
• 宇树 IPO 倒计时
宇树 8 月 10 日科创板申购,发行价 150.80 元、市值约 610 亿、219 倍 PE,美团系持股 9.7% 为最大外部机构股东,DeepSeek 战配 1.41 亿。
• 黄金资源品走强联动
COMEX 黄金周涨超 7% 报 4401.3 美元,白银周涨超 10%;刚果(金)禁铜钴矿出口,铜钴定价转向「战略硬通货」,与算力电力品种联动。
• 央行宽松加新基建
周末四部委齐发声,央行定调适度宽松;发改委推「十五五」六张新基建网(算力网、新型电力网等),托底科技板块流动性。
• 美非农走弱降息预期
美国 7 月非农减 2.3 万人、远低预期,美元跳水、降息预期抬升,北向资金回流 A/港股预期增强,是周一高开核心外部动因。
💡今日总结
模型权力的天平在继续倾斜:NVIDIA 把智能体拆成一个 Python 类、xAI 把图像编辑做到悬停即改,工具层在飞速变薄;应用层的争夺则转向「把模型塞进真实生产」——从 1688 的对话即交易到 Cloudflare 断言机器流量已超人。算力侧中国点亮 10 万卡国产集群,似乎在赌「系统架构」能补「单卡性能」的差距。
关注「真创AI」,看懂 AI 世界
真知灼见,AI前沿
夜雨聆风