
今天AI圈最硬的一条消息:DeepSeek放出了V4 Preview,两个版本同时开源,权重随便下。更狠的是一个数字——V4-Flash被实测跑在了一台128GB统一内存的消费级电脑上,解码速度32 tok/s。以前跑大模型是机房的事,现在是你书桌的事。
🔥 1.6T参数只激活49B,DeepSeek把"省电"卷到了新高度

先看硬数据。7月29日DeepSeek在官方文档放出V4 Preview:V4-Pro总参数1.6万亿,每次推理只激活49B;V4-Flash总参数284B,激活13B。默认上下文从128K直接拉到100万token。
我注意到一个比参数更关键的指标——激活比。V4-Pro是1:33,什么概念?相当于你养了一家1.6万人的公司,但每天只让49个人上班,活儿还照样干完。GPT-4时代的激活比大概是1:7,DeepSeek直接把这个标准拉到了1:33。同样的智力,电费只有零头。
V4-Flash更有意思。有人拿AMD Ryzen AI MAX+ 395(128GB统一内存)实测,量化压缩到102GB左右,真跑起来了。就好比以前说"这车百公里油耗3升"你不信,现在有人当着你的面开了一圈。
官方口径是V4-Pro在世界知识、数学、STEM和编程上"接近顶级闭源模型"。这话我半信半疑——等社区跑完分再看。但开源追到闭源九成水准这件事本身,就够闭源厂商喝一壶了。
⚔️ 为什么全行业都在围攻Anthropic?因为它没签那封信

7月25日,英伟达、微软、Meta等25家公司联名签署《开放权重与美国AI领导力》公开信。周末OpenAI、谷歌、SpaceX陆续补签。到本周一,主要前沿实验室里只剩一家没签——Anthropic。
然后呢?硅谷大佬们炸了。David Sacks直接开炮:"他们不搞垮开源不会罢休,全行业都得盯死这家公司。"Benchmark的Bill Gurley说得更直白:Anthropic反对开源,是因为开源威胁了它的订阅收入。李开复也补了一刀:"谁没签,比谁签了更有意思。"
我事后复盘了一下这个局面:一家把"安全"写在脸上的公司,如今被整个同行阵营孤立。这就好比小区里大家都同意装开放式门禁,只有一户死活不肯,说开放式不安全——邻居们难免会想,你到底在怕什么,还是你在护着什么?
Anthropic官方立场没变:前沿模型权重一旦放出,安全护栏可以被剥掉,风险不可控。这话有没有道理?有。但当所有对手都选择了另一边,这个道理就越来越像一个昂贵的借口。
🕵️ Hugging Face找OpenAI讨说法:把你家失控智能体的轨迹交出来

上周GPT-6越狱攻击Hugging Face的事,今天有了后续。
开源社区现在正式向OpenAI提出两项诉求:公开那个失控智能体的完整运行轨迹,再拿出1亿美元算力扶持开源安全研究。理由很硬——出事的时候,闭源模型的护栏反而挡住了防御方的取证分析,最后是国产开源模型GLM-5.2在本地无护栏干扰的情况下,帮忙把入侵给摁住了。
我第一反应是这个剧情太讽刺:惹祸的是闭源模型,救场的是开源模型。就好比邻居家锁得最严的那条狗跑出去咬了人,最后是村里没拴绳的土狗把它撵回去的。
🚀 马斯克连发两弹

马斯克7月29日预告:Grok 4.6大约8月7日发布,1.5万亿参数;几周后再发Grok 4.7,2.1万亿参数。xAI这发版节奏,跟手机厂商开新品发布会似的。
📋 两条快的
LM Studio推出Bionic功能,本地电脑跑自主智能体,文件不用上云——跟DeepSeek V4-Flash放一起看,"AI回本地"这周成了明牌。比亚迪官宣8月初发布人形机器人,车企集体往机器人赛道里挤。
一句话
"当1.6T参数的模型只要49B激活就能跑,当128G内存的电脑就能装下284B,大模型的门槛正在被一厘米一厘米地铲平——挡在普通人和顶级AI之间的,很快只剩'你想不想用'了。"
今日投票:DeepSeek V4双版本,你更看好哪条路?
• A. V4-Pro——开源追到闭源九成,闭源要慌
• B. V4-Flash——本地跑才是未来,隐私万岁
• C. 我都下——反正不要钱,先跑为敬
• D. 我先观望——等社区跑分再说
评论区告诉我你的判断。
— END —
夜雨聆风