一、本周头条
1. Claude Sonnet 5 发布 + Fable 5 解禁:Anthropic 一周双响
Anthropic 本周大动作不断。6月30日发布 Claude Sonnet 5,同日宣布 Fable 5 出口管制解除,并上线 Claude Science 科研工作台。
Sonnet 5 定位"史上最强 agentic Sonnet":
- 性能逼近 Opus 4.8,定价仅为其 60%(发布价 $2/$10 per MTok,8月底后 $3/$15)
- 编码能力 63.2%,工具调用和多步任务执行显著提升
- 早期合作伙伴反馈一致:以前 Sonnet 中途放弃的复杂任务,Sonnet 5 能跑完全程
- 安全性优于 Sonnet 4.6,网络安全能力被刻意压低以降低滥用风险
Fable 5 回归——经历了 6/12 出口管制 → 6/30 解禁的18天波折后重新上线:
- 出口管制起因是 Amazon 研究者找到绕过安全分类器的方法,但实际能力并未超越常规模型
- Anthropic 联合 Amazon、Microsoft、Google 发布了 AI 越狱严重性框架
- Fable 5 回归后改为"按需付费"模式(使用积分),不再包含在订阅计划内
Claude Science 科研工作台进入 beta:
- 集成 60+ 科研技能(基因组学、蛋白质组学、化学信息学等)
- 原生渲染 3D 蛋白质结构、基因组浏览器轨迹、化学分子式
- 全程可审计:每个输出附带完整生成历史,支持复现
2. 美团 LongCat-2.0 开源:万亿参数国产模型进入第一梯队
美团正式发布并开源 LongCat-2.0,1.6T 总参数,原生支持 1M 超长上下文:
- 国产算力集群全流程训练与推理
- OpenRouter 月调用量跻身全球前三
- 编程评测表现超越 GPT-5.5 及 Claude Opus 4.6
同周,月之暗面透露 Kimi K3 将于本月发布,参数规模直指 2.5 万亿——国产大模型的参数军备竞赛达到新高度。
3. 可灵 AI 完成 30 亿美元融资:AI 视频赛道跑出中国独角兽
可灵 AI 完成 30 亿美元融资,腾讯参投,估值 180 亿美元:
- Q1 营收突破 6.5 亿元,ARR 接近 5 亿美元
- 计划 12 个月内启动赴港 IPO
- 这是继 DeepSeek 之后,又一个中国 AI 公司的超大规模融资
二、资讯速览
大厂动态
Anthropic / Claude
- Claude Apps Gateway(6/29):为 Bedrock/GCP 上的 Claude Code 部署提供统一管控——企业 SSO、集中策略、每用户成本归因
- Loops 实践指南(6/30):Claude Code 团队定义 agentic loops 分类——从 turn-based 到 goal-based、time-based、proactive
- 企业管控升级(7/2):按用户/团队的用量+成本分析、模型级权限、花费阈值告警
- 首尔办公室开设(6/17 本周爬取):NAVER 全员部署 Claude Code,三星/LG/Nexon 均在使用
- Claude Fable 5 从订阅制改为按需积分付费
- ADK 2.0 发布(7/1):引入 Workflow 运行时,将确定性流程与 Agent 灵活性融合,解决生产环境可靠性问题
- ADK Go 2.0(6/30):Go 语言版本新增图编排引擎、原生 Human-in-the-Loop、动态编排
- Genkit 全栈 Agent 开发(7/1):TypeScript 全栈 agentic 应用框架
- Agent Quality Flywheel(6/30):从编码 Agent 反哺模型质量的方法论
- Nano Banana 2 Lite 图像模型:4 秒出图,$0.034/张
- NotebookLM 推出 TikTok 风格短视频功能
Microsoft
- Project Aion 纯网页版操作系统曝光:基于 Edge + Web 技术,AI 交互界面为核心
- Teams 8月上线 AI 助手 Facilitator:实时解析会议、推送补充信息
- 成立"Frontier Company":25 亿美元,6000 名工程师嵌入企业一线推进 AI 落地
Apple
- Safari 技术预览版 247 新增 MCP 服务器功能,AI 智能体可直接调试网页
X (Twitter)
- 正式推出托管 MCP 服务器,AI 工具可直连 API 检索实时数据
开源 & 研究
- 新浪 VibeThinker-3B:30 亿参数在竞赛级数学/编程任务中媲美百倍规模模型,提出"参数压缩-覆盖假说"
- 百度 Unlimited OCR:3B 端到端 OCR 模型,Reference Sliding Window Attention,5 天 Star 破万
- 小红书 RedKnot:推理引擎开源,KV Cache 存储优化,长文本处理效率翻倍
- 英伟达 Nemotron-Labs-TwoTower:双塔离散扩散语言模型,文本生成速度提升 2.42 倍
- Anthropic 越狱严重性框架:联合 Amazon/Microsoft/Google 发布,首个行业级 AI 越狱分级标准
产品 & 工具
- Claude Science:Anthropic 科研工作台 beta,集成 60+ 生物信息学/化学技能
- Google ADK 2.0:Agent + Workflow 混合运行时,Python/Go 双语言支持
- Claude Apps Gateway:企业级 Claude Code 部署管控,SSO + 策略 + 成本归因
国内动态
- 可灵 AI:30 亿美元融资,计划赴港 IPO
- 美团 LongCat-2.0:万亿参数开源,1M 上下文
- Kimi K3:月之暗面将发 2.5 万亿参数模型
- 豆包:内测社交功能打通飞书、App 内置地图导航
- 支付宝"阿宝":AI 生活助理公测,72 项办事技能
- 高德"袋马":AI 编程产品内测,自然语言生成应用
- 百度昆仑芯:传赴港 IPO,目标估值 500 亿美元
- 阿里巴巴:全面禁用 Claude 系列工具(含 Claude Code),涉数据安全考量
三、深度洞察
1. Fable 5 事件:AI 安全治理的"成年礼"
Fable 5 从出口管制到解禁的 18 天,是 AI 行业安全治理走向成熟的标志性事件:
- 触发:Amazon 研究者找到安全分类器绕过方法,政府当天发出出口管制令
- 调查:Anthropic 证明相同行为在 Opus 4.8、GPT-5.5、Kimi K2.7 等模型中均可复现——问题不是 Fable 5 独有
- 回应:联合五大科技公司发布越狱严重性框架(4 级分类:禁止/高风险双用途/低风险双用途/明确安全),启动 HackerOne 漏洞赏金计划
这不再是某家公司的 PR 危机管理,而是行业首次建立"AI 漏洞怎么定级、怎么沟通、怎么修"的共识框架——类似于软件安全领域的 CVSS。未来每个发布前沿模型的公司都将面对这套游戏规则。
2. "Agent 基建"时代到来:从模型能力到运营管控
本周多个发布指向同一主题——企业不再只关心模型有多强,更关心怎么管:
- Anthropic:Claude Apps Gateway(SSO/策略/成本归因)+ 企业管控升级(按用户花费分析、模型权限、阈值告警)
- Google:ADK 2.0 引入确定性 Workflow("LLM 不该做路由和调度")
- Microsoft:25 亿美元 Frontier Company 把工程师送进企业推 AI 落地
信号很清晰:Agent 的瓶颈不再是能力,而是可观测性、可控性和成本管理。谁先把 AI 变成"可运营的基础设施",谁就拿下企业市场。
3. 中国 AI 公司的两极分化:开源军备 vs 商业变现
本周呈现了一幅有趣的对比:
- 军备侧:美团 LongCat-2.0(1.6T 参数开源)、Kimi K3(2.5T 参数即将发布)——参数规模刷新纪录
- 变现侧:可灵 AI(Q1 营收 6.5 亿,ARR 近 5 亿美元)——中国 AI 公司首次在应用层跑出大规模收入
有意思的是阿里"反向禁用 Claude"事件。表面是数据安全考量,深层是国产大模型生态的自主化信号——当你自己有通义千问,为什么让工程师用竞品?但这也暴露了一个现实:Claude Code 在中国开发者中的渗透率已经高到需要"禁令"来切割。
四、值得阅读
- Redeploying Fable 5 — 完整复盘 Fable 5 出口管制事件:时间线、安全分类器工作原理、行业越狱框架,堪称 AI 安全治理的教科书案例
- Why we built ADK 2.0 — Google 解释为什么 Agent 需要确定性 Workflow:100 次执行 95 次对不够,业务流程需要 100%
- Introducing Claude Science — 科研工作台的完整介绍:60+ 技能、原生分子/蛋白质渲染、全程可审计复现
- Claude Apps Gateway — 企业部署 Claude Code 的"中控"方案:SSO、策略推送、成本归因、多云路由
- Getting started with loops — Claude Code 团队定义 agentic loop 的分类法:turn-based → goal-based → time-based → proactive
夜雨聆风