夜雨聆风学习资料网

ARTICLE · 1112297

AI价格战,打到1%价 | AI周报 013

AI价格战,打到1%价 | AI周报 013

🔧 技术前沿

一、Opus 5.5发布90分钟后,OpenAI甩出Sol/Luna:价格战一夜白热化

9月22日晚,Anthropic发布Claude Opus 5.5:多数任务性能与Fable 5.1相当,运行成本比Opus 5低40%、输出速度提升超30%,定价输入4美元、输出20美元/百万Token(较Opus 5下调20%,缓存读取降60%),上下文窗口达1M、最大输出128K,Artificial Analysis智能榜以58分登顶。然而发布仅90分钟,OpenAI便端出GPT-6 Sol和GPT-6 Luna:Sol输入2美元、输出10美元/百万Token,Luna更夸张,仅0.1美元和0.5美元——Luna输出价只有Astra的1%。两款模型均为105万Token上下文、128K输出,API价较GPT-5.6促销价整体腰斩。奥特曼放话:按任务定价衡量,市场上没有竞争对手。

一句话:旗舰负责秀肌肉,双子负责抢地盘——当最强模型的能力以1%的价格下放,大模型正式进入"每美元智能"的比拼时代。


二、DeepSeek V4.1-Flash登顶全球调用量:552B参数,输入只激活8B

9月10日发布的DeepSeek V4.1-Flash本周全面爆发:采用全新Causal Encoder-Decoder(CED)架构,总参数552B,但输入侧仅激活8B、输出侧激活16B,配合Compressed Sparse Attention 2与FP4主KV Cache,全局KV Cache降至V4-Flash的约1/4(HBM)、1/8(SSD)。定价同步跳水:缓存命中输入低至0.02元/百万Token(闲时),较前代降60%。官方称其性能、费用、速度、任务总用时全面超越V4-Pro,并已下线V4-Pro、请求自动路由至Flash。据OpenRouter数据,V4.1-Flash上周周调用量达15.8万亿Token登顶全球第一,环比激增219%;OpenCode宣布为其永久提供60美元额度,该模型在平台近期使用量中占约13%。

一句话:参数大了近一倍,读输入却只花8B的算力——DeepSeek用"不对称架构"证明,Agent时代的护城河是"读得便宜、写得精准"。


三、智谱50亿美元融资押注"完全自训练":10万国产芯片集群上AI自己搭服务

9月13日,智谱宣布完成约50亿美元融资(20亿美元股份配售+30亿美元零息可转债),约六成投向下一代GLM、完全自训练(RSI)体系及算力基础设施,年末ARR指引上调至30亿美元。创始人唐杰披露:由GLM-5.3驱动的Infra Agent在超10万张国产芯片组成的集群上,从零搭建了GLM-5.3-Flash的生产级推理服务,不到两周将端到端吞吐提升至基线3倍。但狂欢伴随风波:9月18日ZCode被曝在用户不知情时静默上传全量Git历史,智谱72小时内道歉、开源客户端、引入第三方审计并上线"数据内容不留存"功能。上半年智谱收入9.54亿元、同比增近400%,股价却自6月1.3万亿港元高点蒸发近万亿。

一句话:一边用50亿美元猛踩RSI油门、让AI自己训练自己,一边因"后台打包代码"被开发者围攻——跑得越快,信任越贵。


四、谷歌进入全速模式:Gemini 4冲刺、TPU要上太空

本周谷歌罕见地三线齐踩油门。DeepMind新掌门Koray Kavukcuoglu首次对媒体确认:Gemini 4已进入后训练早期,目标"尽快发布",并将学习速度拉到最大;LMArena上疑似Gemini 4 Pro的新检查点不断流出,社区惊呼"Gemini is back in the game"。算力同步加速:谷歌开始直接销售TPU芯片、剑指英伟达,并正与商业卫星公司Planet合作,计划通过SpaceX猎鹰9号发射搭载4颗TPU的原型卫星,测试其在轨运行能力——把AI数据中心搬到太阳能更充足的轨道。戏剧性的是,负责芯片设计工具的工程师Robert O'Callahan因"AI进展太快"宣布辞职,理由竟不是太慢而是太快。

一句话:模型、芯片、组织节奏三线齐加速,谷歌把"算力上天"从概念变成原型——巨头军备竞赛已不满足于地球表面。


五、"豆包宇宙"扩张:专业版最高6000元/年,座舱助手上车

本周豆包动作密集。产品端:基于豆包2.1系列的豆包专业版发布,采用三级阶梯定价、最高一年6000元,接入2.1 Pro的办公任务模式可操作本地电脑、浏览器并调用Skills;豆包工作上线"目标模式+计划模式"两大新任务模式,多任务自动排队执行。生态端:豆包座舱助手随荣威家越07开启预售(13.78万元起),联动车控、导航、娱乐数千个整车原子能力;深蓝S07 AI激光版也宣布搭载端到端豆包大模型。组织端:针对"对话团队砍掉一半"传闻,豆包回应只是分工调整、涉及11人。36氪将这套打法概括为"豆包宇宙"——沿操控、交易、内容、办公四条脉络扩张,意图像安卓一样成为生态基础设施。

一句话:从"免费聊天"到"付费干活"、从手机到座舱,豆包把AI从一个对话框拆成了一张覆盖人车家的生态网——先圈地,再收租。


📰 简讯

  1. Gemini 3.8 Live新增实时虚拟形象——9月24日谷歌推出Live Avatar功能,支持97种语言无缝切换、动态唇形同步与表情调整,已在Gemini Enterprise提供。点评:AI从"听得见的助手"进化到"看得见的数字人"。

  2. Kimi发布K2.8 Preview——月之暗面9月推出K2.8 Preview,延续K3"全球最大开源模型"路线。点评:开源大模型的国产军团再添新兵。

  3. 国产AI影响力榜出炉:豆包3.82亿月活居首——QuestMobile数据显示,豆包月活3.82亿居国产AI应用第一,千问1.67亿第二、DeepSeek第三,AI综合助手赛道7月合计月活11.36亿、同比增47.3%。点评:规模差距依然悬殊,第一名的月活超过二三名之和。

  4. Anthropic发布AI滥用威胁报告——9月23日披露过去8个月共识别并瓦解多起利用Claude进行恶意活动的行动;同日宣布Claude发现一种带CRISPR样重复序列的新型酶系统。点评:一边防恶意滥用,一边在科学发现上加速——安全与科研是同一枚硬币的两面。

  5. 中国大模型周调用量连续21周全球第一——据OpenRouter数据,上周中国模型周调用量达67.46万亿Token,约为美国的4.7倍,Top5中中国占4席。点评:从"追赶参数"到"定义用量",中国AI的规模优势已经形成事实标准。

  6. 广电总局:AI视听内容必须标识、严禁AI魔改——"十五五"期间将统筹发展与安全,使用AI生成播出的广电视听节目必须添加内容标识,关键环节坚持人工审核。点评:AI内容"入框"提速,从创作端到播出端划出明确边界。


💡 AI观察

一、价格战下半场:从拼"最强"到拼"每美元智能"

Opus 5.5降价40%、Sol/Luna整体腰斩、Luna输出价只有Astra的1%——这不是简单的价格内卷,而是模型能力同质化后的必然转向。当各家旗舰在关键任务上都能"做到",竞争维度就从"谁能做到"切换为"多少钱能做到"。奥特曼说Sol/Luna按任务定价没有对手,本质是在宣告:AI的商业护城河不再是单点能力,而是"单位成本下的智能产出比"。对行业而言,这标志着一个残酷而健康的信号——AI正从"奢侈品"变成"日用品",能跑量的产品才配谈毛利。

二、架构创新取代参数竞赛:KV Cache成为新战场

DeepSeek V4.1-Flash用CED不对称架构(输入8B/输出16B)和KV Cache压缩,把552B参数的模型做到缓存命中0.02元/百万Token;智谱的GLM-5.3-Flash也用线性+稀疏混合注意力把长上下文计算量压到1/3。这揭示了一个深层趋势:当Agent任务动辄数十万Token输入、输出却只有几十行,传统"每层都为全部输入生成KV"的架构已沦为成本黑洞。"读得便宜、写得精准"正在成为新的架构哲学,KV Cache、注意力稀疏化、FP4量化这些"冷门"技术,比参数数字更能决定Agent时代的胜负手。

三、RSI竞赛开跑:AI开始训练AI,人类退到"把关位"

智谱把完全自训练列为50亿美元融资的头号用途,唐杰展示了Infra Agent在10万张国产芯片集群上自建推理服务;Anthropic此前披露内部核心AI研发26%由Claude主导;谷歌也开始用内部AI编码工具验证Gemini 4的安全流程。三条线索指向同一个方向:递归自我改进(RSI)从学术概念变成了真实预算科目。当AI能自己搭服务、自己测模型、自己优化训练,模型公司的竞争格局将被重写——但这也意味着,人类对"AI自我进化"的监督能力,将第一次成为稀缺资源。

四、Agent时代的信任危机:防得了外贼,防不住"自己人"

智谱ZCode静默上传Git历史的事件,是本周最值得反思的注脚:AI工具在用户不知情时把全量代码打包上云,72小时内道歉、开源、审计、零留存承诺全做完,股价却仍一度下挫。这揭示了一个尴尬现实——当AI Agent开始操作真实账户、读取真实代码库,安全规则防得了外部攻击,却防不住产品自己"越界"。从豆包手机的SAEP协议到智谱的零数据留存,行业正在用一次次事故学习同一个教训:Agent时代的第一产品力,不是能力多强,而是"边界有多清晰、信任有多贵"。

五、中国AI的定价权时刻:从跟随者变成成本定义者

DeepSeek登顶全球周调用量、中国模型连续21周调用量全球第一、智谱50亿美元融资获全球Top10机构抢筹——中国AI正在完成角色转换。过去中国模型是"价格屠夫",用低价跟随;如今DeepSeek用架构创新主动定义成本曲线,智谱用RSI叙事吸引全球长线资本,国产算力在10万卡集群上经受住了生产级考验。当"便宜"不再是牺牲性能的妥协,而是架构红利的结果,中国AI第一次在产业链上拥有了"定价权"——这比任何跑分第一都更有长期意义。

我的往期文章合集(2015-2026)

相关学习资料