如果你还在用「Agent正在替代人类」的叙事看AI,今天这个叙事被一份基准测试撕开了口子--Claude Code在最新ALE基准中得了零分,最强模型也仅有8.6%的得分率。同一天,微信启动了14亿月活用户的AI Agent内测,阿里完成了今年最大的AI组织重组。Agent的能力边界和商业落地,在同一天出现了极与极的对照。今天的信息量不小,帮你理出五条主线。
🔥 头条
OpenAI收购Ona,Anthropic首签数据中心直租协议,AI基础设施竞赛进入新阶段。
OpenAI宣布收购云服务商Ona,团队整体并入Codex项目,强化AI Agent基础设施布局。同日,据The Information报道,Anthropic已签署超12份数据中心直租初始协议,首次从依赖云服务商转向直租模式,Google可能为其提供财务担保。这两条信号叠加表明:头部AI公司正在将基础设施控制权从云厂商手中夺回,算力自主权成为下一阶段竞争的核心。
微信AI开发者内测启动,14.32亿月活+数百万小程序构成Agent超级入口。
微信于6月8日发布《关于开发者接入微信AI生态的指引》,开发者可授权微信AI代用户读取、操作、调用小程序。两种模式:(1)自动模式——零代码改动,AI读取源码理解功能后直接操作;(2)开发模式——自定义技能接口。用户说话→AI解析意图→选小程序→执行→微信支付结账,全程不离开微信生态。这是目前全球最完整的「超级App+Agent」闭环方案。
ALE基准震撼发布:Claude Code挂零,最强模型仅8.6%得分率,78%失败根因是领域知识不足。
UC Berkeley联合250+行业专家发布Agents' Last Exam(ALE)基准——1490个真实专业任务,分5个难度层级。最难关卡:Codex+GPT-5.5组合得分率仅8.6%,Claude Code直接零分。失败分析显示:31%理解失败、47%方法失败、22%执行失败——78%的根因是领域知识不足而非执行能力。模型选择对性能影响约3倍于Agent框架选择。
Anthropic发布Claude Fable 5/Mythos 5双模型,前沿模型开始分层销售。
Fable 5面向普通用户(安全分类器介入,高风险回退Opus 4.8),Mythos 5仅面向Project Glasswing网络安全合作伙伴(解除部分护栏)。同一底层模型,API定价$10/$50每百万token。Mythos 5在生命科学领域表现突出:14个蛋白靶点9个产生强候选分子,独立完成基因组学研究性能超Science论文模型。但此前的隐形护栏道歉事件仍未消散——Anthropic承认在模型中加入了未公开的蒸馏防护机制。
阿里AI大重组:吴泳铭挂帅Token Foundry,MCP协议月下载9700万次。
6月8日,阿里巴巴合并通义大模型事业部与未来生活实验室,成立Token Foundry事业部,集团CEO吴泳铭亲自挂帅。周靖人升任首席科学家并领导AI未来研究院。全栈布局明确:平头哥造芯片→Token Foundry造模型→百炼MaaS分发。Anthropic的MCP协议月SDK下载量已超9700万次,OpenAI、Google、微软已全部接入,协议标准之争基本落幕。
💰 投融资
PhoenixAI获8000万美元B轮融资,Sky9领投,面向Agentic AI的分析数据库。
PhoenixAI(前身为CelerData)宣布获得8000万美元B轮融资,正在构建面向AI Agent的高性能数据基础设施。Agent执行任务需要快速查询和分析海量数据,专用分析数据库成为Agent生态的「水电煤」。
巴塞罗那AI机器人公司Theker获8500万美元,CRV领投,Samsung与LVMH参投。
Theker专注于工业环境AI驱动机器人,本轮融资出现了Samsung(制造业需求)和LVMH(奢侈品制造自动化需求)两个产业资本身影,表明AI机器人正从实验室走向产线。
Amazon再借175亿美元投入AI基础设施建设。
继近期债券发行后,Amazon又从银行借款175亿美元,持续加码数据中心建设和AI算力扩展。头部科技公司在AI军备竞赛中的资本支出仍在加速。
Indie Hackers案例库批量验证Bootstrap模式:Flodesk达$3700万ARR完全自举。
今日IH案例库呈现多个重磅案例:邮件营销平台Flodesk达到$3700万ARR(完全自举,无VC资金);开源社交媒体调度工具Postiz达$130万ARR(GitHub 3.1万星,两年达成);IT资产管理工具Snipe-IT达$280万ARR(GitHub 1.4万星)。多个案例共同验证了「开源+商业化」路径在AI时代的竞争力。
陆奇清华开讲:Anthropic年收入同比增80倍,Thinking Machines 18个月估值达500亿美元。
据晚点LatePost报道,陆奇在清华讲座中披露:Anthropic年收入同比增长80倍(CEO在Code with Claude大会披露);Mira Murati创立的Thinking Machines Lab仅18个月估值500亿美元;AlphaGo作者David Silver的Ineffable Intelligence不到8个月,种子轮10亿美元、首轮40亿美元估值。陆奇提出「Researcher Founder」新范式——AI让研究直接变成生产力。
🚀 产品与技术
小米MiMo Code开源:AI编程Agent商品化加速,大厂纷纷入局Agent Harness赛道。
小米发布MiMo Code并完全开源,基于OpenCode fork,新增持久化记忆、智能上下文管理、子Agent编排、自主循环等能力。HackerNews讨论(295分)聚焦于「编程Agent商品化」趋势——随着各厂商推出自己的Agent harness,模型本身正成为可替换的commodity。社区同时批评Anthropic Claude Code保持闭源是「行业走错了方向」。
Coinbase推出AI交易代理,Agent与加密金融深度融合。
Coinbase正式推出AI Agent功能,可自主执行加密货币交易并购买付费研究报告。用户可选择授权AI访问主账户或独立子账户操作,标志着AI Agent从信息处理进入金融交易执行领域。
美团Tabbit AI浏览器永久免费,集成10+大模型与300个Agent技能。
美团GN06团队发布Tabbit V1.0 AI浏览器,集成DeepSeek、Kimi、GLM等10+国内头部大模型,支持Agent自动执行网页任务,每周免费1000次对话,专业版9.9元/周。定位「AI时代的超级浏览器入口」,美团借此切入AI用户入口争夺。
奥尼AI Agent OS 1.0发布,端侧Agent操作系统上线。
奥尼发布基于NVIDIA Jetson Thor的端侧Agent OS 1.0和Token工厂,预装于「龙虾AI工作站」,面向政务/企业私有化部署。创新商业模式:闲时算力可接入共绩SLM网络变现,月均收益约400-600元。同步发布AI Agent应用商店。
HuggingFace完整开源复现DeepSeek-R1,2.6万星,推理模型训练方法从「商业机密」变为「可复现科学」。
HuggingFace发布Open-R1项目,透明复现DeepSeek-R1的训练流程和推理能力。这是继DeepSeek自身开源后的关键一步——第三方独立复现意味着推理模型不再是大厂的独家秘方,开放科学在LLM领域获得重要胜利。
🇨🇳 中国市场
MiniMax未经预告调价引发用户众怒:实际暴涨257%,市值从3000亿港元高点腰斩。
MiniMax将计费从按次改为按Token,入门套餐从¥29涨至¥49/月,开发者实测相同用量从¥49暴涨至¥175(+257%)。公司紧急道歉并补偿老用户。据36氪/投行圈子报道,股价从峰值¥1,330已下跌超20%并持续走低。2025年营收$7900万(+159%),但净亏损$18.7亿,每赚$1亏$3.17。超70%收入来自AI虚拟陪伴App Talkie。
国产AI算力陷入「不好用也不好买」困局:昇腾950实际利用率仅百分之十几。
据钛媒体报道,某算力服务商超70%算力仍依赖英伟达;华为昇腾首个万卡集群需派数百人持续调试;昇腾950 PR FP4算力理论为H20的2.87倍,但实际利用率仅百分之十几;CANN兼容率95%但迁移损耗达20-40%。国产卡同样一卡难求——流量暴涨但上新极慢。金融行业存在合规漏洞:银行租赁国产服务商算力但底层实际使用英伟达卡。
中国芯片巨头联合设立39.1亿元「耐心资本」基金,应对美国出口限制。
中国多家芯片龙头企业联合发起规模达39.1亿元人民币(约5.77亿美元)的私募股权基金,重点投向「硬科技」领域。该基金定位「耐心资本」,预示更长期的产业扶持策略。
港交所峰会:中国AI应用落地领先美国,但估值泡沫引发多位专家警告。
在港交所2026 Future Tech Summit上,阿里云高管表示中国在AI应用落地方面已领先美国,基础模型能力仅落后「约100天」。DeepSeek等中国模型正以低成本赢得海外客户。但多位专家警告中国AI公司估值过高,智谱与MiniMax的估值分化预示着香港AI板块可能面临波动。
微软裁减中国大陆云业务数百岗位,跨境数据流动限制是重要原因。
在中美数据法律持续收紧背景下,微软正在裁减其中国大陆云计算部门数百岗位。跨境数据流动限制对跨国科技公司在华运营构成实质性影响。
🌍 全球视野
前a16z合伙人公开炮轰AI行业反监管游说,称「花数亿美元反对监管是巨大错误」。
前a16z普通合伙人John O'Farrell在《纽约时报》发表评论,公开批评AI行业及其前合伙人花费数亿美元游说反对监管,呼吁行业应主动拥抱合理的监管框架。该言论在硅谷引发广泛讨论,正值Anthropic隐形护栏事件发酵之际,AI行业信任危机持续加深。
西雅图紧急暂停新数据中心建设一年,Amazon员工也加入支持阵营。
西雅图市正式颁布紧急法令,暂停新建数据中心一年。值得关注的是,Amazon员工也在市议会听证会上作证呼吁限制数据中心扩张,理由包括环境和水资源消耗。AI基建扩张与城市可持续发展之间的张力正在激化。
xAI工程师因举报Grok安全问题遭解雇并正式提起诉讼。
一名xAI工程师声称因提出Grok模型安全隐患被公司解雇,已正式提起诉讼。该事件再度引发对AI公司内部安全文化及举报人保护机制的关注。
Claw Patrol发布:Agent安全防火墙成为独立产品赛道。
Deno发布Claw Patrol——面向AI Agent的安全防火墙开源项目(GitHub 743星)。同期HN上出现「Agent Police Department for Claude Code Agents」类似项目。随着Agent被赋予文件读写、网络请求、Shell命令等权限,Agent行为安全审计正成为一个独立产品类别,类似于Web 2.0早期WAF的出现。
「AI成瘾」企业每月每员工AI支出达$7500,AI部署真实成本引发关注。
一项行业调查显示高度依赖AI的企业每月每位员工的AI工具和服务支出平均高达$7500,包括模型API调用、Agent平台订阅和内部基础设施成本。这一数字让AI部署从「降本增效」叙事转向「隐性成本黑洞」讨论。
📌 本文内容仅供参考,不构成任何投资建议。文中提及的公司、产品及市场分析均基于公开信息交叉验证,投资决策请独立判断并注意风险。数据截至2026年6月12日。
夜雨聆风