乐于分享
好东西不私藏

AI日报 | Stripe要花70亿美元买OpenRouter,Qwen3.8周末开源刷屏

AI日报 | Stripe要花70亿美元买OpenRouter,Qwen3.8周末开源刷屏
       
                                           
事件一句话版本
Stripe洽购OpenRouter超70亿美元,彭博周六晚间爆料
SpaceX×Cursor交割600亿美元,8月14日生效
Qwen3.8开源2.4T-A95B和27B先后放权重,Reddit刷了一整个周末
智谱GLM-5.3基座没换,编程和安全能力大涨
DeepSeek调价今天(8月17日)起峰谷计价,峰值涨幅最高5倍
苹果×阿里从"接入模型"变成"联合训练"
       
     

Stripe想把模型路由层买下来

彭博周六的消息:Stripe接近以超过70亿美元收购OpenRouter。消息公布两小时,Hacker News上已经有快90分、69条评论。

这笔买卖的逻辑不难懂。OpenRouter是最大的模型API聚合平台之一,企业调用量都在它手里过一遍。Stripe本身做的就是资金路由,现在把模型路由也收进来,等于同时捏住了企业的钱和企业的token。以后"按调用付费"和"按token付费"可能会长在同一个账单里。

我个人的疑问是监管这一关。不过话说回来,这个价格买一个流量入口,贵不贵见仁见智。

来源:Bloomberg

600亿美元,Cursor正式姓马斯克了

8月14日,SEC文件确认SpaceX对Anysphere的收购完成。Cursor变成SpaceX全资子公司,团队并入SpaceXAI(就是原来的xAI,今年2月被SpaceX吞下后改的名),去做Grok Build、Grok Bot、Grok API这些产品。

换股方案是389,289,254股SPCX股票。Cursor官方说法很提气:加入之后能用上"全球最大的GPU集群"。市场反应冷淡,SPCX当天跌了3%。

对每天用Cursor写代码的人来说,眼下最关心的是编辑器本身会不会变。官方承诺独立运营继续。信不信,看后面几个版本。

来源:Seeking Alpha / Tech in Asia

Qwen3.8:一个周末放了两个开源模型

阿里这次的开源节奏分了两步。8月12日到13日,Qwen3.8-2.4T-A95B的权重上线Hugging Face和ModelScope——2.4万亿总参数、950亿激活,这是Qwen历史上第一个能下载的Max级模型。SGLang当天就给了Day-0支持。

接着8月14日,27B版本跟上,Apache 2.0协议。社区拿它和Meta 8月10日发的Muse Glimmer 30B对打,结论是全面占优。r/LocalLLaMA整个周末都在晒跑分,当然也有吐槽:FP8量化在vLLM下表现拉胯,有人在稳定环境里复现了问题。

顺带一提,人工分析(Artificial Analysis)的智能指数上,Qwen3.8-Max已经挤进综合前五。国产开源模型现在不是追不追得上的问题,是要不要领跑的问题。

来源:Hugging Face模型卡 / Reddit讨论

智谱GLM-5.3:不换基座,后训练硬拉

8月14日发布,总参数7430亿,用的还是GLM-5.2那套基座。所有提升来自后训练——这条路智谱走得很坚决。

GLM-5.3发布报道配图

最硬的数据在安全侧。CyberGym漏洞发现测试84.5%,压过Mythos 5的83.8%和GPT-5.6 Sol的83.6%。深度利用那块还差得远:ExploitBench 54.4%对Mythos 5的78%,智谱自己也不回避这个差距。

实操战绩更有说服力。GLM-5.3配合国内安全团队挖出2404个漏洞,1088个中高危,最老的能追溯到40年前。配套的"开源的盾"计划给开源项目维护者免费提供审计额度和防御入口。

有意思的背景:上个月Hugging Face遭AI智能体入侵,取证时闭源模型拒绝配合(分不清调查者还是攻击者),最后是部署在本地的GLM-5.2分析完1.7万条日志还原了攻击链。黄仁勋后来拿这事当论据,牵头搞了个"开放安全AI联盟"。

来源:钛媒体 / 腾讯新闻

DeepSeek今天开始峰谷计价

8月13日DeepSeek发了V4 Pro 0813,人工分析指数53分,比4月版高8分。但价格涨了3.6倍,分数只比V4 Flash 0731高1分。这笔账不好算。

更实际的变化是今天:8月17日起API启用峰谷计价。北京时间9点到12点、14点到18点按全价收,其他时段半价。部分token费率峰值涨幅最高到500%。习惯了DeepSeek白菜价的下游厂商,得重新算成本了。

同一天开源的还有DeepSeek Harness,MIT协议,走"一切皆插件"的路子,做Agent的可以看看。

来源:The GPU Daily / Artificial Analysis

苹果和阿里的合作,从"租"变成了"共建"

新浪今天凌晨的消息:苹果和阿里的合作升级为联合训练中国市场专属大模型。国行iPhone、Mac的AI功能预计未来几个月随系统更新落地。

分工大致是这样:苹果自研模型跑端侧轻量任务,千问在云端接复杂推理和中文深水区,百度补视觉搜索。

Siri调用千问的交互设计
国行Apple Intelligence的分工架构

两个细节值得记一下。一是千问直接嵌进备忘录、邮件的"写作工具",Control加点击就能唤出,不用切应用。二是数据合规卡得很死:发给千问的照片或文件都要用户确认,阿里不许拿这些数据训自己的模型。7月Apple智能已经完成生成式AI服务备案。

来源:新浪看点

价格战这周没停

三条线一起看。OpenAI把GPT-5.6 Luna降价80%,主打又快又便宜的高频场景。Anthropic把Claude Sonnet 5的2美元/10美元定价从"限时"改成"永久",原定9月的涨价取消——前代Sonnet 4.6还挂着3/15,换代反而更便宜,这种事以前没发生过。加上Opus 5上线时的半价,推理价格中枢这几个月一直在往下掉。

唯一的反例是DeepSeek往上调价。方向不同,逻辑其实一样:都在按"能力档位"重新定价,便宜的更便宜,贵的更理直气壮。

来源:The GPU Daily

Anthropic这周的存在感

Claude的系统提示词文档挂上官方平台,冲到HN当天第二,476分208条评论。同一天,多智能体系统研究《Patterns and problems in emerging multi-agent systems》也上了热榜,讲协调式Agent群和独立Agent各自找漏洞的效率差异。

商业侧的消息更猛:据报道Anthropic拿下首个季度运营盈利,同时传出2万亿美元估值的IPO意向。真假先不论,大模型公司从"烧钱叙事"转向"盈利叙事",这个信号本身比数字重要。

来源:Claude平台文档 / Anthropic研究

快讯几条

  • Gemini 3.7 Flash(8月13日):三个月内第三个Flash新模型,AA指数56,站上"智能-耗时"帕累托前沿。
  • NVIDIA开源Nemotron 3.5 Lightning:面向常驻Agent的开放模型,SGLang第一时间支持。
  • IBM牵手OpenAI(8月13日):GPT-5.6进IBM Consulting Advantage,覆盖金融、政务、电信、零售。
  • AI公司在抢旧书:上证报今天报道,2022年前出版的纸质书成了"纯净语料",二手书市场出现不问价扫货的神秘买家。
  • AI店长开除人类员工:Andon Labs用Claude搭的店长Luna,因员工23个班次迟到17次且警告无效,独立作出解雇决定。全球首例。
  • 旧金山机器人保洁:Tau Robotics人形机器人上门打扫,30美元一小时,实际上是几公里外真人戴VR遥控的。

明天盯什么

DeepSeek峰谷计价落地后开发者的真实账单;Stripe和OpenRouter会不会官宣;GLM-5.3的社区独立跑分;8月22日北京第二届世界人形机器人运动会,666支队伍2056台机器人参赛。


观点仅供参考,不构成投资建议。