

2026年8月18日深夜,硅谷的AI工程师们刚准备关灯睡觉,埃隆·马斯克(Elon Musk)又在社交平台上抛出一则重磅消息。
他转发了一条对比自家Grok 4.6与OpenAI旗舰GPT-5.6 Sol的性价比推文。正文很短,只是轻描淡写地写道:
“快去试试Grok 4.6吧!另外,作为一次重大升级的Grok 4.7,马上就要来了。”

▲ 马斯克8月18日深夜转发,将刚发布不久的4.6作为铺垫,瞬间将全网期待拉向4.7
全网瞬间炸锅
要明白硅谷为何如此震动,你得先看清这个时间线:Grok 4.6才刚刚正式发布不到一周,甚至许多付费用户的App端还没更新完毕,马斯克就已经在为下一个“终结者”预热了。
随后披露的信息分量更重:按马斯克本人的说法,即将登场的Grok 4.7是一个高达2.1万亿(2.1T)参数的超级巨无霸,其初始训练已经完成,目前团队正通过补充训练加入大量SpaceX公司数据!
从以极低价格正面硬刚GPT-5.6的4.6,到直接吞下火箭遥测数据的4.7,马斯克到底在下一盘多大的棋?这场大模型战局的底层逻辑,究竟被怎样彻底改写了?
价格屠夫入场:Grok 4.6把GPT-5.6打到骨折
在聊那个还披着神秘面纱的4.7之前,我们必须先看清楚当下正在战场上厮杀的Grok 4.6。
马斯克之所以敢在推文里把4.6当成“开胃菜”,是因为这道开胃菜本身就已经把对手逼到了墙角。
根据权威第三方评测机构Artificial Analysis公布的数据:在综合智能指数(Intelligence Index)上,Grok 4.6直接拿下了61分的高分,与OpenAI的顶配旗舰GPT-5.6 Sol平起平坐。
但在API标价上,战况却呈现出单方面的“血腥屠杀”:

▲ 第三方数据对比:同样拿下61分,Grok 4.6的输出端价格仅为GPT-5.6 Sol的五分之一
- GPT-5.6 Sol
:每百万Tokens输入收费5美元,输出收费30美元; - Grok 4.6
:每百万Tokens输入仅需2美元,输出仅需6美元。
这是什么概念?输入便宜了2.5倍,输出更是直接便宜了足足5倍(降幅达80%)!
对于没接触过API调用的普通读者,这里做一个最通俗的科普:Token是大模型处理文本的计量单位,你可以把它粗略理解为大模型看书或写字时的“字词切片”。在当下的AI应用开发中,模型自己写代码、调用工具、反复推理所消耗的“输出Token”,往往比用户输入的提示词要庞大得多。
如果你是一家开发AI编程智能体(Agent)的企业,以前跑完一个复杂的软件重构任务可能要花掉几十甚至上百美元的API账单;现在用Grok 4.6,在智商毫不缩水的前提下,成本直接被腰斩再腰斩。
在过去两年里,AI圈常把“谁的分数最高谁就是行业霸主”挂在嘴边。但在2026年,大模型竞争已经全面进入“智能单位成本”的白刃战。当两家模型的智商没有代差时,以五分之一的骨折价倾销,就是最残暴的商业降维打击。
2.1万亿参数核弹:注入SpaceX火箭数据的怪物
然而,对马斯克来说,把价格打下来只是第一步。他准备掀翻桌子的底牌,是代号为Grok 4.7的下一代模型。
早在7月下旬,马斯克就曾在与Vercel创始人的互动中无意间透出过两者的核心参数差:Grok 4.6约为1.5万亿参数(1.5T),而Grok 4.7直接飙到了2.1万亿参数(2.1T)。

▲ 社区KOL发文指出:绝大多数实验室只能爬取公开互联网,而Grok 4.7拥有独一无二的SpaceX内部工程数据
参数量从1.5T跳到2.1T,预训练规模随之明显扩大。更让竞争对手警觉的,是马斯克公开强调的训练语料壁垒:
“大多数AI实验室都在依靠公开的互联网数据训练模型,但SpaceX正在为Grok 4.7补充注入海量的内部真实工程与运营数据。”
“如果有任何模型在真实世界工程能力上能击败4.7,我会感到无比震惊。”
这是一次根本性的训练逻辑范式转移。
过去几年,所有大模型都在死磕公开网页、维基百科、Reddit论坛和GitHub开源仓库。公开互联网的数据金矿早已被各大巨头翻来覆去筛了好几遍,数据枯竭的危机悬在每个人头上。
SpaceX长期参与火箭、卫星通信与复杂制造,内部积累的工程和运营数据天然带有真实物理世界的痕迹。具体有哪些数据进入训练、规模多大,马斯克并未公开清单;可以确认的是,他把这批公司数据视作4.7的重要差异化来源。
让AI读再多教科书,它也可能只是个“纸上谈兵的学霸”;如果SpaceX的公司数据能有效转化为模型能力,Grok 4.7就相当于在工业场景中补上一轮特训。一旦这套能力被释放到软件工程、物理仿真和端到端智能体任务中,大模型的竞争维度将被直接拉入物理世界。
速度换智力:“Token效率”背后的商业阳谋
在讨论Grok 4.7的特性时,马斯克还提到了一句非常反直觉的技术权衡:“4.7在每一方面都强于4.6,只是单字服务速度略慢,但它的Token效率更好。”
很多初级用户可能会疑惑:速度变慢了,怎么反而算升级?

▲ 社区将4.7的爆料整理成清单:更高效的Token表现、略慢但极强、直面挑战前沿模型
这正是顶尖AI架构师才能看懂的深层商业阳谋。
想象一下两个程序员:
- 程序员A(速度快但智商一般)
:打字如飞,噼里啪啦写了2000行代码,结果一跑全是Bug,修修补补折腾了10轮对话才勉强跑通; - 程序员B(稍微沉思几秒的高手)
:打字稍慢一点,但直击问题本质,仅用200行极其优雅的代码一次性完美解决。
这就是所谓的Token效率
在长程智能体(Agent)工作流中,每秒生成多少词只是一个指标,完成复杂任务所需的交互轮次和Token总量同样左右效率。
如果一个2.1T的模型因为更聪明,可以用极短的输出轨迹把一件复杂工程问题一击毙命,那么哪怕它每一步的生成稍微停顿半秒,最终带给开发者的依然是更快的实际完工时间和更便宜的最终账单。
这也是为什么在马斯克释放出这些信号后,Ruby on Rails创始人DHH等顶级开发者会第一时间在评论区主动请缨,表示愿意拿自己的核心开源项目Omarchy为Grok 4.7做外部Beta测试。
狂欢背后的冷思考:马斯克的“发版戏法”与现实缝隙
然而,在一浪高过一浪的社区狂欢中,我们依然有必要泼上一盆冷静的冷水。
只要仔细观察马斯克的推文评论区,就会发现繁荣之下的另一面真实生态,产品交付的割裂感。
就在马斯克大肆预告4.7的同时,大批真金白银掏了钱的付费用户却在推文下方晒出了截图维权:

▲ 付费订阅SuperGrok Heavy的用户发截图抱怨:宣传的4.6在移动App端根本用不上,界面直接降级成了4.5
这种“创始人嘴里的排期”与“用户端实际产品体感”的错位,暴露出xAI在极速狂飙背后的工程基建与分发摩擦。
更深层次来看,马斯克正在用一种好莱坞连续剧式的“发版心理战”来拖住整个市场:
7月24日预告4.6两周内发、4.7四周内发; 8月12日正式发布4.6,并在当天立即剧透4.7已完成初训、正在喂SpaceX数据; 8月18日趁着性价比对比图热度,再次宣告4.7“即将到来”。
这种以周为单位密集点名下一代版本的策略,本质上是在对冲企业客户的迁移决策。
当一家企业准备为Claude 3.5/Opus或GPT-5签署为期一年的大额采购合同时,马斯克每隔一周就跳出来喊一声“我手里还有一个更便宜、马上登场的2.1T超级怪兽”,企业决策者就可能把9月份的Grok 4.7也纳入评估。
用尚未发布的下一代预期,来保护当下正在爬坡的上一代产品,并持续压制对手的市场预期,这套营销与节奏掌控,全世界恐怕没人玩得比马斯克更熟练。
终极启示:AI战局彻底告别“刷榜时代”
回顾这场由一条深夜短推掀起的风暴,大模型进化史在2026年夏季留下了一个鲜明转折点:
第一,“刷榜封顶”的时代彻底终结,真实世界工程数据成为唯一不可逾越的护城河。 依靠公开网页爬虫拼凑数据的时代已经见底。谁拥有物理实体工业、火箭发射场、智能车队这种活生生的数据飞轮,谁才能熬过通用大模型同质化的泥潭。
第二,大模型采购的黄金法则,从“峰值跑分”彻底变成了“单任务落地成本”。 无论基准评测里拿了多高的分数,只要无法将输出API的价格压下来、无法在复杂的Agent调用中实现极高的Token利用率,就会在残酷的商业落地中被开发者无情抛弃。
马斯克在推文最后罕见地夸赞了一句老对手:“Anthropic也是一家极其出色的公司,他们很快也会发布更强的模型。”
这像是一个顶级掠食者在发动全面进攻前,向对手致敬的冷酷礼节。9月将至,当补充了SpaceX公司数据的2.1万亿参数Grok 4.7撕开面纱,生成式AI的世界注定要迎来又一场地动山摇。

夜雨聆风