

深夜,硅谷很多工程师的手机屏幕同时亮起。
马斯克又在 X(原 Twitter)上发推了。简短的预告迅速搅动了整个生成式 AI 圈子:
“快去试试 Grok 4.6!至于 Grok 4.7,这是一次重大升级,即将到来。”
所有人都在倒吸凉气
要知道,xAI 刚刚发布的旗舰模型 Grok 4.6 才上线几天,凭借着极其凶残的性价比把 OpenAI 的 GPT-5.6 Sol 逼到了墙角;
然而大家还没从 4.6 的冲击波里回过神,马斯克就迫不及待地掀开了下一张底牌,参数量高达 2.1 万亿、灌注了 SpaceX 顶级工程数据的庞然大物:Grok 4.7。
这哪里是正常的大模型迭代?这分明是把造火箭的加特林机枪架在了大模型赛道上,一梭子接着一梭子,根本不给对手喘息的机会。
4.6 的“贴脸开大”:同分考卷,他只要两成学费
要理解 4.7 的震撼,我们必须先看清 4.6 刚刚打出了一场多么漂亮的“突袭战”。
在独立权威评测机构 Artificial Analysis 的综合智能指数(Intelligence Index)大榜上,Grok 4.6 拿到了 61 分的高分,直接追平了 OpenAI 的主力旗舰 GPT-5.6 Sol。

▲ XFreeze 整理的 Grok 4.6 与 GPT-5.6 Sol 性价比对比
什么是 61 分?
简单来说,这个指数综合加权了长程智能体任务、编程协作、复杂科学推理等几十项极端考验。能在这一项上拿到 61 分,说明它已经稳稳踏进了全球第一梯队的极窄门槛。
更受业界关注的,是它的价格
我们来看一组让开发者心跳加速的数字:
调用 GPT-5.6 Sol:每百万输入 Token 要花 5 美元,每百万输出 Token 要花 30 美元。 调用 Grok 4.6:每百万输入只要 2 美元,输出只要 6 美元!
这是什么概念?
这就好比两位考生参加同一场高考,不仅考了同样的高分,而且做同一套高难度压轴题时,Grok 4.6 的收费只有对手的五分之一,速度甚至更快!
长期以来,顶尖大模型就像奢侈品店里的高定礼服,性能每提高一点,账单就得翻上好几倍。
而 xAI 这一记重拳,直接击碎了“强模型必须天价”的行业潜规则。在保持 50 万 Token 超大上下文窗口的同时,硬生生把顶级 AI 的使用门槛打成了“白菜价”。
难怪不少开发者在社区里直呼:“Grok 4.6 成了让我最终下定决心抛弃竞品的唯一理由。”

▲ 用户反馈 Grok 4.6 的卓越表现促使其转向 xAI
4.7 的核动力燃料:当火箭数据被灌进 AI 大脑
如果说 4.6 是一记响亮的耳光,那么马斯克嘴里那个“即将到来”的 Grok 4.7,就是悬在所有竞品头顶的一柄重锤。
根据马斯克此前陆续透露的信息,Grok 4.7 的变化覆盖参数规模、训练进度和补充数据:
- 参数规模的狂暴拉升
:从 4.6 的约 1.5 万亿参数,直接狂飙到 2.1 万亿参数。 - 训练进度的临界点
:基础训练已经全部敲定,目前正在进行高强度的强化学习与补充训练。 - 最神秘的终极武器
:注入了海量的 SpaceX 真实公司内部数据!

▲ 马斯克透露 Grok 4.7 正在加入大量 SpaceX 真实数据
为什么把 SpaceX 的数据喂给大模型,会是一件让科技界极其兴奋甚至恐惧的事?
稍微懂一点大模型原理的人都知道,现在的 AI 为什么经常“看似很懂,一做就废”?
因为互联网上公开抓取的数据,充斥着大量的段子、空话、二手水文和理想化代码。AI 学会了写出漂亮的空话,却根本不懂真实物理世界的残酷法则。
而 SpaceX 拥有什么?
是星舰发动机在极端高温高压下的实时遥测数据,是几万次火箭发射与回收的故障排查日志,是精密到微米级的航天制造公差分析,是复杂到极致的分布式控制与工业仿真代码!
这些数据,是全人类商业航天最宝贵的工业结晶,也是在公网搜索引擎里哪怕翻底朝天也绝对找不到的“硬核物理真理”。
当 2.1 万亿参数的巨脑,遇上这些带有真实力学、热学、工程学约束的顶级语料,Grok 4.7 正在完成一次关键的基因突变:
它正从陪人聊天的“文科状元”,转向能在真实物理工程与高难度复杂系统里解决实际问题的“硬核工程师”。
马斯克甚至撂下狠话:“如果有任何模型能在真实工程能力上击败 4.7,我会感到不可思议。”
极其清醒的马斯克,与逼疯硅谷的“周更地狱”
有意思的是,在这一波宣发狂潮中,马斯克罕见地展现出了一种极其务实、甚至略带谦逊的清醒。
在面对宿敌 Anthropic 的顶尖模型 Claude Fable 5 时,马斯克公开承认 4.6 仍有不足:
“Fable 5 在整体智能上确实更聪明一些。但 Grok 4.6 跑得更快,成本更低。而接下来的 Grok 4.7,极有希望在智力上全面超越当前的所有模型。”

▲ 马斯克客观对比竞品,并表示 4.7 极有希望全面超越现有模型
这种“田忌赛马”式的打法,展现出了一种令人畏惧的商业侵略性:
- 打现在
:我用 4.6 咬住你的性能及格线,然后用极低的价格和极快的速度洗劫你的中腰部开发者市场; - 谋未来
:我用 4.7 作为达摩克利斯之剑悬在半空,让每一个准备签长期合同的企业客户犹豫不决,“再等等,马斯克的 2.1T 火箭版马上就来了”。
他的发版节奏同样惊人
在传统的软件工业时代,旗舰系统的更新以年为单位;大模型兴起后,半年一迭代已经是极限速度。
但马斯克把他在特斯拉和 SpaceX 的极限压榨模式搬到了 xAI:
- 7 月底
预告 4.6 两周后、4.7 四周后; - 8 月 12 日
正式端出 4.6; - 8 月 18 日
再次敲响 4.7 即将发布的倒计时钟声!
这种以“周”为单位推进万亿参数模型演进的压迫感,正在把整个大模型生态逼进一种前所未有的“快节奏疲惫”中。
开发者们刚刚把 Grok 4.6 接入代码编辑器 Cursor 和 GitHub Copilot,著名的 Ruby on Rails 之父 DHH 就已经按捺不住,主动在推特下方留言请缨:愿用自己的大型开源项目 Omarchy 为 Grok 4.7 充当外部测试小白鼠!

▲ 知名开发者 DHH 主动请缨愿为 Grok 4.7 做测试
终局推演:AI 竞争的下半场,彻底变天了
从 Grok 4.6 的性价比屠榜,到 Grok 4.7 的硬核工程狂想,这场由马斯克一手掀起的大戏,实际上向整个行业释放了三个不可逆转的底层信号:
1. 虚荣的“单项状元”时代结束,“帕累托最优”才是王道
过去大模型发布,大家都在争那 0.5 分的排行榜领先。但企业和开发者的钱包是诚实的
在综合能力达到 60 分以上的及格线后,单位任务的调用成本(Cost per Task)将直接决定谁能成为工业界的基础设施。
Grok 4.6 证明了“涨分不涨价”完全可行,这迫使所有闭源大厂不得不重新核算自己的利润空间。
2. 公网数据吃干榨净,专有工业语料成为新护城河
互联网上的文本已经被全球顶尖实验室清洗过成百上千遍,通用语料的红利正在迅速见顶。
接下来的竞争焦点落在谁手里拥有别人无法获得的垂直世界真实数据。
OpenAI 拥有海量的通用对话反馈,Anthropic 拥有极高质量的代码与推理对齐数据,而马斯克身后,站着的是拥有天量多模态自动驾驶数据的特斯拉,以及拥有尖端航天工程资产的 SpaceX。
这种实体工业与数字 AI 的深度咬合,才是纯软件算法公司最难构筑的壁垒。
3. 战场从网页聊天框延伸到每一个敲代码的指尖
Grok 4.6 发布后火速进入 Cursor、Grok Build 和 GitHub Copilot。
升级的体感由此走出社交媒体的跑分图,直接发生在全球几千万程序员每天保存代码、调试 Bug、构建复杂项目的毫秒之间。
谁能占领开发者的主屏幕,谁就掌握了下一代应用软件的底层话语权。
一浪接着一浪,狂飙向前
当 4.6 还在以每百万 Token 几美元的杀手价重塑开发者的账单时,那个背负着 2.1 万亿参数、满载着星舰制造数据的 Grok 4.7 已经呼啸而至。
大模型赛道的残酷淘汰赛,才刚刚进入最精彩的深水区。

夜雨聆风