digest:Qwen3.8-Max开源权重落地,DeepSeek宣布涨价
一、大模型动态(国际)
Claude Opus 5 拿下编程双榜第一
Artificial Analysis 更新最新一轮 Intelligence Index,Claude Opus 5 综合得分 61,Agentic Index 拿到 55.3,同时在 Arena 投票制编程榜坐上首位。三个榜单同时登顶,最近一年没有第二家。
看点不在分数本身,在结构。Intelligence Index 是自动化基准,Agentic Index 掺入长链路任务打分,Arena 是人类偏好——三套评价体系口味完全不同,Opus 5 都是第一,说明 Anthropic 这半年的后训练不是刷榜专用,是把 Agent 工作流的真实痛点直接压进了训练目标。Cursor、Windsurf 这些 IDE 侧的默认模型已经悄悄切到 Opus 5,付费用户切换率据几家的 Discord 反馈超过 40%。
GPT-5.6 和 Grok 4.6 在编程场景要如何回应,看下一次迭代。
Claude 全面对齐 MCP 2026-07-28 规范,连接器目录破 950
Anthropic 8月9日宣布 Claude 全线支持 MCP 2026-07-28 新规范。三个关键点:无状态核心设计(会话上下文不再强绑连接)、OAuth/OIDC 标准授权(企业侧可以直接接现有 IdP)、版本化扩展(Apps 与 Tasks 两个官方扩展与核心解耦升级)。
配套数字:Claude 官方连接器目录已收录 950+ MCP Server,日活跃调用来自数百万用户。这个数字在 6 月还是 400,两个月翻了一倍多。MCP 从"一个协议提案"到"事实标准"的窗口比大部分人预期的要短。
无状态设计是这次规范里最工程化的一步。旧版本 MCP 的会话粘性给企业部署制造了不少麻烦——横向扩容要靠 sticky session,故障恢复靠外部重放,这些在生产环境都是坑。新规范把状态外置到 Client 或独立存储,Server 层可以真正做到无差别负载均衡。
对做 MCP Server 的团队来说,这次规范升级不是可选,是必须。OAuth 授权对接现在有官方 SDK,之前自己搓的鉴权代码可以退休了。
OpenAI GPT-5.6 Luna API 降价 80%,Terra 降 20%
7月30日 OpenAI 更新 API 定价:GPT-5.6 Luna 输入 $0.20/M、输出 $1.20/M,相比上一档砍掉八成;GPT-5.6 Terra 全面降价 20%。
这是 OpenAI 今年第三次调价,节奏比往年密集。原因不复杂——DeepSeek V4 Flash 上月在 OpenRouter 周榜以 7.22 万亿 Token 蝉联第一,直接把海外中小开发者从 GPT 生态里挖走。Luna 这次的价格对齐到 DeepSeek V4 Flash 相近区间,但输出侧仍然贵一档。
Luna 定位轻量任务:分类、抽取、初步摘要、Agent 里的工具选择这类高频短交互。原来跑在 GPT-5.6 Standard 上的很多工作流,成本可以直接砍 4/5。
Genesis Mission:美国联邦 50 亿美元 AI 计划落地
白宫 8月上旬确认 Genesis Mission:联邦政府投入超 50 亿美元,覆盖 15+ 联邦机构,把 AI 嵌入国家科学研究。三个明确方向:自主实验室(Agent 驱动的实验循环)、量子计算、生物预测建模。
这个项目和昨天说的 Discovery Loop 是同一个大趋势的两条路径:自动化科研循环。区别在于 Genesis 走的是国家资助 + 联邦机构落地,Discovery Loop 走的是市场化 PBC。美国这一步的战略含义大于短期技术含义——把 AI 从"消费级应用"抬到"国家科研基础设施"层面。
对国内做基础科研 Agent 的团队,这是重要参照系:以后的对手可能不是同行创业公司,是国家队。
二、国内大模型动态
Qwen3.8-Max 开源权重今日落地:阿里首次把旗舰放出来
阿里 8 月 3 日发布 Qwen3.8-Max,当时承诺"一周内开源权重"。今天是兑现日——HuggingFace 和 ModelScope 已同步上架,Qwen3.8-27B(小尺寸配套模型,可本地运行)同日开放。
参数配置:2.4T 总参数 MoE、95B 激活、1M 上下文。这是阿里第一次把 Max 级别的旗舰模型权重开放出来——此前 Max 只有 API,Plus/Turbo 才有开源版本。许可证按目前的社区预期是 Apache 2.0,但 Max 级别是首次,最终条款以今天发布页为准。
推理侧几个数字要记:vLLM、SGLang、TensorRT-LLM 都已经完成 2.4T MoE 的推理路径预演,落地即可跑。95B 激活参数意味着单卡(H100/H200 级别)推理不现实,需要至少 4-8 卡的推理集群,但相比 2.4T 全参数常驻,KV Cache 和显存开销砍了一档。
对企业自部署市场,这是一次结构性变化。之前的选择只有 DeepSeek V4 系列(684B 全参数)、Llama 4(405B)、Qwen3-235B——今天多了一档能力更高、许可证更宽松(如果真是 Apache 2.0)的选项。国内金融、政企客户几个已经在跑的 POC 项目大概率会切过来。
阿里为什么这么做?看下面的编辑观点。
DeepSeek 官宣"显著"涨价,价格战按下暂停键
Bloomberg 8月6日报道,DeepSeek 内部沟通中确认将"近期"对 API 服务进行"显著"价格上调,具体幅度和生效时间待官方公布。这是 DeepSeek 自 2024 年发布以来第一次宣布涨价。
数字背景:DeepSeek V4 Flash 上月发布(284B 参数),在 OpenRouter 周榜连续第一,单周调用量 7.22 万亿 Token。这个规模已经不是"低价试水",是真正的商业化拐点。
DeepSeek 过去两年靠低价打穿海外中小开发者市场——GPT-5.6 的 1/10 价格、性能追平主流场景。这套策略今年在 OpenRouter 榜单上已经拿到胜利果实。现在选择涨价,官方口径没有解释,但从供给侧看只有两种可能:要么算力成本压不住了,要么估值窗口需要盈利叙事。
对海外开发者,短期影响是模型选型窗口重开:DeepSeek 涨完之后如果和 GPT-5.6 Luna 打平,那 Luna 的品牌溢价和生态优势就会赢回一批用户。对国内其他厂商(Qwen、MiniMax、智谱、Hy3),这是一次难得的空档期。
三、安全与监管
加州《前沿 AI 安全法》通过议会最终投票
今日(8月10日),加州州议会最终表决通过《前沿 AI 安全法》,等待州长签字。这是 SB-1047 在 2024 年被 Newsom 否决后的重新立法尝试,条款覆盖前沿模型开发商的透明度义务和安全报告义务:模型能力达到特定阈值前必须提交安全测试报告,重大事故需要 72 小时内向州府披露。
看点在这次条款相比 SB-1047 做了明显软化——去掉了"预测性伤害"的模糊定义,改为可量化的能力阈值。这是 OpenAI、Anthropic、Google 一年游说的结果。签字概率比上一版高得多。
EU AI Act 高风险系统条款正式生效
8月2日起,欧盟 AI Act 里针对高风险 AI 系统的核心条款和部署商透明度义务正式产生法律约束力,"合规宽限期"结束。医疗诊断、招聘筛选、信贷评估、执法辅助等场景的 AI 系统,从这一天起违规就是真罚。
对中国 AI 公司出海欧洲的直接影响:合规成本从"可延期"变成"必须马上做"。
中国 CAC:伴侣 AI 情感支持新规执行三周,罚款 420 万
7月15日《伴侣 AI 情感支持服务规范》执行,前三周 CAC 开出 12 张罚单,合计 420 万元。被罚的主要是三类问题:未成年人访问未做识别、心理干预未有专业审核、诱导消费机制不透明。
规模不大,信号明确:这个赛道进入强监管期。
四、行业应用与平台
五、一句话速览
Claude Opus 5 在 Intelligence Index、Agentic Index、Arena 三榜同时第一,编程场景 Anthropic 领跑 MCP 2026-07-28 规范把"无状态"写进核心,企业部署侧的最大痛点被官方解决 OpenAI 今年第三次调价,Luna 输入端已经进入 DeepSeek 价格区间 Qwen3.8-Max 权重今日落地,2.4T MoE / 95B 激活 / 1M 上下文,阿里首次开源旗舰级 DeepSeek 首次官宣涨价,低价策略的第一个转折点 Genesis Mission 让"科研 Agent"从创业赛道升级为国家赛道 加州 AI 安全法这次大概率能签下来,SB-1047 的教训被吸收进条款设计 欧盟 AI Act 高风险条款正式咬人,出海欧洲的合规成本再无缓冲
六、编辑观点:今天的 AI 圈,2 个信号值得细品
信号一:DeepSeek 涨价,价格战的终点
DeepSeek 宣布涨价这件事,比涨价幅度本身更重要。
过去两年 DeepSeek 是海外市场里最锋利的一把刀。GPT-5.6 的 1/10 定价、开源权重、Agent 场景够用——这三件事叠加,把 OpenAI 在中小开发者市场的份额切走了一大块。OpenRouter 月榜前六名全是中国模型,DeepSeek V4 系列占了两席,7.22 万亿 Token 的周调用量放在两年前是头部闭源模型才有的规模。
现在这把刀选择自己钝下来。官方没解释原因,但供给侧能推的可能性只有几种:第一,算力成本再压不住——284B 的 V4 Flash 跑到 7.22 万亿 Token/周,单位推理成本乘以调用量已经是天量账单,即使幻方本身有算力储备,商业化定价长期低于成本也不可持续。第二,估值叙事需要盈利——DeepSeek 母公司幻方今年被反复传融资,市场对"永远亏钱抢份额"的耐心到了尽头。第三,头部大客户已经锁死——低价的战略作用已经完成,接下来靠服务和企业合同赚钱。
哪一种都指向同一个结论:AI 大模型的价格战阶段结束了。不是所有人都跟涨,但"用零毛利换市占率"这条路已经跑到极限。OpenAI Luna 降价 80% 也在同一个逻辑里——当行业里最狠的玩家开始收敛,剩下的玩家有空间用价格换用户。
对企业采购的直接建议:如果你的推理成本模型里 DeepSeek 是核心假设,今天开始就要重新算账。涨价具体幅度未定,但按 2-3 倍空间做压力测试是合理的。
信号二:Qwen3.8-Max 开源旗舰,阿里在押注什么
阿里今天把 Max 级别的权重放出来,是 2026 年国内 AI 领域最重的一次战略动作。
先说清楚这件事的稀缺性。Max 是阿里模型序列里最高档,此前的规矩是旗舰只走 API、开源只给 Plus 及以下——这个规矩延续了三年。今天一次性打破。2.4T 总参数、95B 激活、1M 上下文的权重,任何团队都可以下载、微调、商用(如果许可证真是 Apache 2.0)。
阿里为什么现在做?我的判断有三层。
第一层是生态防守。DeepSeek V4 系列在开源社区拿到的调用量已经威胁到阿里在国内自部署市场的默认位置。如果继续只开放 Plus 级别,企业客户会持续流向 DeepSeek。Max 开源是把最重的筹码押上桌,说"想要旗舰能力自己部署的,我也给你"。
第二层是云生意。阿里云的核心逻辑是:开源模型越多人用,跑在阿里云上的推理就越多。DeepSeek 是外部资产,Qwen 是内部资产。同样的调用量落到不同模型上,对阿里云的营收贡献完全不同。开源 Max 短期损失是 API 的高利润客户,长期收益是把这些客户绑在阿里云的推理套餐上。
第三层是标准之争。Llama 4 之后,Meta 的开源节奏放缓,Mistral 走向专有化,全球开源大模型的"标杆"位置正在空缺。阿里如果能在这个窗口里把 Qwen 系列做成事实标准,未来国际化的路会好走很多——做全球开发者的默认选择,比在国内和 DeepSeek 内卷更划算。
95B 激活参数是个关键数字。它意味着企业不需要买 2.4T 全参数常驻的硬件,一个中等规模的推理集群就能跑起来——成本模型能落地。如果许可证真的是标准 Apache 2.0,Qwen3.8-Max 大概率会在未来 6 个月内成为国内金融、政企、大制造业客户自部署市场的新基线。
阿里这一步走完,接下来的问题是 DeepSeek 会不会跟。V4 Flash 涨价的同时,V4 Pro 的开源节奏会不会加速?下周之内可能就有答案。
#AI速报 #人工智能 #大模型 #每日AI资讯 #Qwen #DeepSeek #ClaudeOpus5 #MCP #开源模型
数据来源
国际:Bloomberg、TechCrunch、The Information、Artificial Analysis、Anthropic 官方 Blog、OpenAI Pricing 页 国内:HuggingFace、ModelScope、阿里云开发者社区、幻方官方微博、CSDN 监管:加州州议会官网、EU AI Office、CAC 官方通报
夜雨聆风