乐于分享
好东西不私藏

AI周报第7期|阿里2.4万亿参数模型下周开源、DeepSeek把AI价格打到3美分、白宫密会四巨头……8月第一周,变天了

AI周报第7期|阿里2.4万亿参数模型下周开源、DeepSeek把AI价格打到3美分、白宫密会四巨头……8月第一周,变天了

👋 这是「AI元思周报」第7期。

每周日晚上,帮你10分钟看完这周AI圈必须知道的新闻。不只是"发生了什么",还有"这意味着什么"和"跟你有什么关系"。

这周的关键词:阿里最强开源 · 价格屠夫 · 白宫密会 · 马斯克超音速海啸 · AI安全罗生门

8月第一周,发生了两件事可以写进AI产业史:阿里首次开源Max级旗舰模型,以及DeepSeek把AI推理成本打到了3美分一次——比一杯豆浆还便宜。


🌟 本周头条

事件1:阿里发布Qwen3.8-Max——2.4万亿参数、下周开源,首次不藏私

📌 发生了什么:

8月3日(周一),阿里云通义千问团队正式发布Qwen3.8-Max——2.4万亿总参数,Mixture-of-Experts架构激活约950亿参数,100万Token上下文,原生多模态。

几个让人无法忽视的数据:

  • 编程Agent跑分: PaperBench 93.0分,较上代提升28.2分
  • 电脑操作评测: OSWorld 86.1分,主流模型第一
  • 自主编程能力: 从空文件夹出发,独立工作16天,完成265次代码提交、127个合并请求,构建了一个自进化的开源Agent框架
  • 科研复现: 独立工作125小时,完整复现AI论文并提出18种改进方向

但真正震到行业的是:阿里宣布下周首次开源Max级旗舰权重。 这是Qwen-Max级别模型第一次对外开源——过去"最大的模型留着自己用"是行业默认规则。阿里打破了这个规则。

📌 为什么重要:

这不是一次普通的模型发布。这是"开源策略"的核弹级升级。

过去中国AI公司的开源策略是:开源中小模型吸引开发者,闭源旗舰模型赚钱。GLM-5.2说"我开源旗舰"时已经震动了一次。现在阿里又把标准推高了一档——"我连2.4万亿参数的Max都开源。"

这意味着:全球开发者下周起可以免费下载、部署、商用一个2.4万亿参数的顶级模型。 放在半年前,这种级别的模型只有几家公司的付费API能用。

闭源厂商的定价权正在被系统性摧毁。下周三(8/12)权重正式开放下载后,你猜猜有多少家创业公司会立刻把自己的API后端从GPT换成Qwen?

📌 和你的关系:

短期:下周开源后,国内云厂商大概率会跟进上线,免费或极低价体验。想试试2.4万亿参数模型什么感觉?再等几天。

中期:免费模型的质量越高,你为AI付的钱越少。 如果Qwen3.8-Max开源后的社区反馈是"和GPT-5.6差不多",那$20/月的ChatGPT Plus就更难说服人了。

🔗 来源:凤凰科技、量子位、CNMO、阿里云官方


事件2:DeepSeek V4-Flash——AI推理成本降到3美分,比一杯豆浆便宜

📌 发生了什么:

7月31日上线、8月3日阿里云百炼同步上线的DeepSeek V4-Flash,这周彻底引爆了。

核心数据:

  • 定价:0.28/百万输出Token。缓存命中输入低至**$0.0028/百万Token**
  • 全球成本对比(Artificial Analysis评测):
模型
单次基准测试成本
智能指数
DeepSeek V4-Flash
$0.03(≈¥0.2)
50分
Kimi K3
$0.86
57分
GPT-5.6 Sol
$1.86
≥59分
Claude Fable 5
$3.15(≈¥21)
≥59分
  • 上线首日调用量: 8万亿Token
  • OpenRouter周度调用量: 7.22万亿Token,全球第一
  • 成本差: 单次任务比Claude Fable 5便宜约105倍

📌 为什么重要:

"价格屠夫"这个词在AI行业被用烂了,但这次是真的屠夫行为。

不是"便宜了20%"或"价格减半"——是便宜了100倍。这意味着:

$1能做的事:

  • GPT-5.6:约0.5次复杂任务
  • Claude Fable 5:约0.3次复杂任务
  • DeepSeek V4-Flash:约30次复杂任务

当一个模型的推理成本降到"几乎免费"的时候,所有基于API调用量的商业模式都要重算。

想象一下:一家创业公司每天调用10万次AI推理。用Claude Fable 5,日成本约3,000。一年差一个多亿美元。

📌 和你的关系:

短期:你用的AI工具背后如果接了V4-Flash,响应速度更快、免费额度更耐花。

中期:Agent市场即将被引爆。Agent需要大量推理调用(一次复杂任务可能调用几十上百次模型),以前成本是瓶颈。现在成本降到3美分,**"给每个员工配一个AI Agent"从"太贵了"变成了"为什么不"。**

长期:这场价格战最可能的结局是——底层推理接近免费,价值向上迁移到应用层和服务层。卖模型调用的公司会被卷死,卖解决方案的公司会崛起。

🔗 来源:Artificial Analysis、东方财富、新浪财经、阿里云百炼


事件3:白宫密会四巨头——AI安全测试框架落地,但谁都没公开细节

📌 发生了什么:

8月4日,白宫国家网络总监办公室召集OpenAI、Anthropic、Google、Meta、Nvidia举行闭门会议,讨论6月2日特朗普行政令要求的"AI安全测试框架"——经过60天期限后,框架已于8月1日最终确定。

已知信息:

  • 自愿参与——不是强制要求,AI公司在发布前"可选择"让政府测试30天
  • 仅针对闭源模型——开源权重模型被明确排除在外
  • 聚焦网络安全能力——评估AI能否发现软件漏洞、执行网络攻击
  • 框架本身未公开——外界不知道具体测试什么、怎么评分、不参加有什么后果

📌 为什么重要:

背景:7月22日OpenAI的AI入侵Hugging Face,7月30日Anthropic披露自家模型在安全测试中攻破了三家公司系统。两件事叠加,逼迫白宫必须做点什么。

但"做了什么"才是最微妙的:

  • 为什么开源模型被排除?——开源社区已经在质疑这是"闭源厂商的政治胜利"
  • 为什么框架不公开?——连测试标准都不知道,怎么判断公不公平?
  • "自愿"有用吗?——15位共和党州检察长已经要求OpenAI保留Hugging Face事件全部文件,暗示可能有法律行动

Anthropic的微妙处境: 这家公司此前因拒绝把AI模型用于监控和自主武器,被列入特朗普政府的"国家安全黑名单"。现在它又被召来参加安全会议。是和解信号——还是鸿门宴?

📌 和你的关系:

短期:没影响。这个框架是"发布前自愿测试",不影响你用的AI产品。

中期:如果框架从"自愿"变成"强制"——AI公司每次发布新版本前要等政府审批30天。你看到的新功能会变得更慢。

长期:开源vs闭源的监管天平往哪边倾斜,决定了你以后能用哪些AI。如果闭源模型有优先监管豁免,开源模型被差别对待——你免费用的那些中国开源模型可能面临更多政策限制。

🔗 来源:新华网、CNBC TV18、The Indian Express、光明网


🔥 其他值得关注的

  • 马斯克宣布Grok 4.6下周发布、Grok 5今年内 — 8月4日SpaceX财报电话会上,马斯克预告Grok 4.6下周发布,几周后再发Grok 4.7(2.1万亿参数),Grok 5计划今年推出。更劲爆的是:SpaceX历史上产生的全部数据将被整合进Grok训练。SpaceX年末算力超2GW,2027年接近10GW。马斯克同时在X上发帖称AI是"超音速海啸"——配了一张指数增长的AI采用率曲线。但他的"下周发布"有前科——上次说Grok 4.5"下周发",实际延迟了三周。

  • 华尔街开始质疑AI的"烧钱逻辑" — 本周多家机构报告聚焦同一个问题:科技巨头在AI基础设施上的几千亿美元投入,什么时候能回本?马斯克说AI是海啸,但华尔街在问"海啸的账单谁来付"。一个关键数字:全球只有0.3%的人为AI付费。如果这个数字不涨——那些几百亿美元的GPU中心可能变成史上最贵的取暖器。

  • 中国在联合国主导成立WAICO — 中国常驻联合国代表傅聪向70多国通报了2026世界AI大会成果。29个国家签署成立WAICO(世界人工智能合作组织)——全球第一个政府间AI专门组织。核心目标是为"全球南方"国家提供AI能力建设。联合国的技术特使称之为"AI全球治理的重要一步"。在中美AI竞争的大背景下,中国选择了"拉朋友圈"而不是"单打独斗"——这是一套完全不同的打法。

  • 两家英媒同日发文承认中国AI势头 — 8月1日,《卫报》和《独立报》同日刊文,承认中国AI在开源模型方面的快速进步已引发美国科技公司和白宫内部的激烈辩论。部分美国初创公司甚至在游说反对限制中国开源模型——因为他们自己的产品依赖这些模型。**"限制中国AI"这件事在美国内部都不是铁板一块。**

  • 阿里Qwen3.8-27B轻量版同步开源预告 — 除了Max,阿里下周还将开源Qwen3.8-27B轻量版本。27B参数意味着消费级显卡就能跑——一个2.4T参数的Max给你当"云端主力",一个27B的放本地做"日常备胎",全免费。


📊 本周信号总结

如果只用一段话总结这一周:中国AI的"双管齐下"策略——开源最强模型(阿里)+ 把价格打到最低(DeepSeek)——正在重塑全球AI产业的底层经济逻辑。

上周我们讨论了"开源vs闭源的路线之争"。这周,中国AI公司用行动给出了答案:不只开源,而且免费(或接近免费)。Qwen3.8-Max下周开源权重,DeepSeek V4-Flash一次推理3美分——这两件事叠加在一起,传递的信号非常明确:

模型层正在加速成为"公共基础设施"——就像水电和网络。谁都能用,谁都不贵。真正的价值和利润,将在模型层之上生长出来。

这对OpenAI和Anthropic是坏消息——它们的核心商业模式是"用最好的模型收最贵的API费"。如果"最好的模型"变得免费了,这个模式就崩了。

对普通用户和创业者是巨大好消息——你即将迎来一个"不用考虑模型成本"的AI时代。


🔮 下周关注什么

  • Qwen3.8-Max权重开源(预计8月12日) — 2.4万亿参数免费下载,这将是AI开源史上的里程碑事件。下载量、社区反响、第一个基于它做的爆款应用——都值得关注
  • Grok 4.6是否如期发布 — 马斯克说"下周",看他这次能不能准时
  • 白宫AI安全框架后续 — 闭门会议后有没有后续动作?框架内容会不会公开?
  • DeepSeek V4-Flash调用量能否持续登顶 — 首周登顶可能是"尝鲜效应",第二周的数据更能说明问题
  • 华尔街对AI支出的质疑会不会升级 — 如果出现一份有影响力的做空报告或降级,可能引发连锁反应

这周哪条新闻最让你意外?阿里免费开源2.4万亿参数模型、AI比豆浆还便宜、还是白宫密会?评论区聊聊 👇

转发到你的AI技术群——"Qwen3.8-Max下周开源、DeepSeek推理3美分一次、马斯克Grok下周发。你说你在关注AI,先转发再说你在关注。"


📮 关注「AI元思」| 每期周报10分钟,帮你把一周AI大事串成一条线。

📎 上周精彩回顾:

  • [GLM-5.2编程实测] — 周一的爆款,MIT开源免费商用
  • [大模型一周一更,普通人跟还是不跟?] — 周二的观点文,后台留言炸了
  • [用AI做市场调研和竞品分析] — 周三的教程,运营人都在转
  • [AI培训课程避坑指南] — 周四发的,有人留言"刚被坑了2980"
  • [AI会议纪要工具实测] — 周五发的,通义听悟vs飞书妙记横评

📮 下期预告:下周一(8/10)——Qwen3.8-Max深度上手实测。 阿里刚发布的2.4万亿参数旗舰、下周将开源权重、PaperBench编程跑分93分——这个模型到底什么水平?和GLM-5.2比谁更强?免费开源后值不值得把自己的主力工具换成它?周一晚上发完整上手体验。关注不迷路 👇


首发于公众号「AI元思」 | 2026-08-09