

北京时间8月19日凌晨,硅谷的空气再次被马斯克的一条推文点燃。
马斯克没有召开发布会,只是在社交平台X上轻描淡写地转发了一张对比图,顺手写道:
“去试试Grok 4.6吧!Grok 4.7是一次重大升级,很快就来。”
短短二十几个英文单词,瞬间在整个全球科技圈激起滔天巨浪。
被马斯克引用的那张图,足以让任何一家AI大厂的财务和高管背后发凉。
第三方权威评测机构Artificial Analysis的最新榜单显示:xAI刚刚发布的Grok 4.6,在综合智能指数(Intelligence Index)上拿到了61分,与OpenAI的当家王牌GPT-5.6 Sol直接打平!
然而,翻开两家的API价格表,差距大到令人眩晕:在决定实际使用成本的输出端,GPT-5.6 Sol每百万Token收费30美元;而Grok 4.6只要6美元
同样的基准跑分,价格直接砍掉五分之四!便宜整整5倍!
马斯克的后半句话又抬高了外界的预期:这个把OpenAI按在地上打价格战的Grok 4.6,居然只是一道“开胃菜”。拥有2.1万亿参数、正在补充训练中加入SpaceX公司工程数据的Grok 4.7,已经在路上。
大模型世界的游戏规则,正在被彻底改写。
5倍性价比屠榜!马斯克打响AI界的“平价核战争”
很多人可能对“便宜5倍”没有直观的概念。
在大模型的世界里,Token(词元)就是数字时代的石油与通行货币。
你可以把模型服务想象成坐出租车:你给模型输入一段几万行的代码或资料,是输入Token(Input),相当于上车起步价;模型思考后洋洋洒洒给你写出复杂的程序、分析报告或系统架构,是输出Token(Output),相当于按行驶里程持续计费。
对于现代软件开发、企业自动化Agent(智能体)以及复杂的长程任务来说,模型往往会输出成千上万行内容,输出Token的单价,直接决定了一家科技公司的生死账单。

▲ 截图:博主@XFreeze制作的对比图,Grok 4.6在同等跑分下输出端便宜5倍
看一眼博主@XFreeze列出的残酷对比:
- GPT-5.6 Sol
:输入每100万Token收5美元,输出收30美元; - Grok 4.6
:输入每100万Token收2美元,输出收6美元。
按输出端的价差估算,同样运行一个大型企业级的多智能体工作流,如果在OpenAI那边每天要烧掉10万美元,换到Grok 4.6上,可能只要2万美元出头。

▲ 截图:Artificial Analysis评测首页,Grok 4.6以61分并列第一梯队且处于成本帕累托前沿
在独立评测机构Artificial Analysis的坐标系里,Grok 4.6横空出世后,直接杀到了“高智能-低成本”的最优前沿位置。无论是多轮工具调用、终端长任务还是编写底层代码,4.6的表现都极度亮眼。
马斯克用最粗暴的商业逻辑撕开了竞争的口子:当两款顶级AI智商相差无几时,谁能把工业化成本压到极致,谁就能把对手从开发者的服务器里赶出去。
但这还只是第一波冲击波
1.5T到2.1T!4.7准备更换底座
如果只是便宜,大洋彼岸的对手们或许还能靠技术壁垒稳住阵脚。但马斯克接下来抛出的参数信息,又把预期推高了一截。
在硅谷以往的发布惯例中,版本号的小数点后一位通常只是“小修小补”(比如调调安全策略、做做微调对齐)。但马斯克早在7月底就已经提前剧透:4.6和4.7,根本就是两代完全不同量级的模型!

▲ 截图:马斯克明确透露4.6为1.5T参数,而4.7则是2.1T的全新模型
马斯克在推文中毫无保留地拆解了技术细节:
- Grok 4.6
:是一个1.5万亿(1.5T)参数的模型,重点在于经历了极其漫长的后训练强化,重构了监督微调(SFT)和强化学习(RL)轨迹; - Grok 4.7
:则是直接跃升到2.1万亿(2.1T)参数的庞然大物,完成一次底层预训练底座跨越!
这里有一个极其反直觉、但极具技术含金量的细节。马斯克在推特上坦诚直言:“Grok 4.7在各方面都会彻底碾压4.6,唯一的小代价是,它的单字生成速度(推理服务)可能会稍慢一点,但它的Token效率(Token efficiency)会大幅提高!”

▲ 截图:SpaceXAI官方账号发布Grok 4.6,并展示多项基准成绩
什么叫“速度稍慢,但Token效率更高”?
通俗来说,普通的模型智商有限,面对一个复杂的工程难题,它需要“啰里啰嗦”地写下1000个Token的推导过程,中间可能还要反复走弯路、试错,最后才能勉强给出答案;而一个2.1T的超级大脑,因为理解力极度深刻,它可能只需要精准吐出200个高质量Token,一针见血地直击本质。
如果完成同一项任务所需的Token更少,即使每秒生成速度略慢,拿到正确代码的总时间和Token消耗仍有机会下降,总账单和等待时间也可能随之降低。
这正是马斯克所说的取舍:用更大的参数底座,争取更高的Token效率。
终极大杀器:把SpaceX火箭工程数据倒进大模型!
如果说算力和参数量是大家花钱都能买到的“硬件武器”,那么马斯克手里握着的另一张王牌,则是全行业任何AI巨头做梦都得不到的物理世界特权。
当前大模型行业正集体撞上一堵无形的墙,“公开互联网数据枯竭危机”。维基百科被扒空了,GitHub代码库被洗劫了,各大论坛的帖子全被爬了个底朝天。当所有模型都在吞食相同的公网数据时,AI的智商增长开始放缓,甚至开始出现互相吞食合成数据导致的“模型退化”。
而马斯克在这个节点,做了一件震撼整个AI界的事。

▲ 截图:马斯克发文证实4.7初始训练完成,正在注入大量SpaceX数据
8月12日,在Grok 4.6上线的当天,马斯克就透露:Grok 4.7的初始预训练已经完成,目前正在进行高强度的补充训练,而注入的核心养料,是海量的SpaceX内部真实工程数据!
马斯克在随后的推文中意味深长地补充道:“这将会带来极其特殊的东西(This will be something special)。”
这绝非营销噱头想一想,SpaceX拥有什么?SpaceX长期积累的工程与运营数据,可能涉及火箭动力学、气动仿真、材料力学、回收控制和传感器遥测等领域。马斯克并未公开此次补充训练所用数据的具体清单和规模。
以往的大模型,本质上还是一个“饱读诗书的文科生+刷题无数的程序员”,擅长写文案、总结报表、写网页前端;而加入SpaceX工程数据的Grok 4.7,有望强化模型对物理规律、现代制造业和真实工程问题的理解。
这种专有数据壁垒,是任何纯软件AI实验室在象牙塔里无论如何也造不出来的。大模型竞争的战火,已经从虚拟的网络世界,一路烧进了物理世界的工业腹地。
连环施压与心理战!马斯克的“窒息式发布”
把时间线拉开,你会发现马斯克正在硅谷上演一场教科书级别的“心理与节奏掌控术”。
回顾这一个月的时间线:
- 7月下旬
:放出“两周后4.6,四周后4.7”的精确倒计时; - 8月12日
:Grok 4.6踩点发布,直接上线Cursor、Grok Build与API开发者平台,用打平GPT-5.6 Sol的高跑分与5倍性价比掀翻桌子; - 8月15日
:在推特上展现出罕见的务实与坦诚,直言“不得不承认Anthropic的Fable 5整体确实更聪明,但Grok更快更便宜”,紧接着笔锋一转:“Grok 4.7很有机会超越目前所有模型!” - 8月19日
:在4.6热度达到顶峰之际,再度公开补刀,将4.7定性为“Major upgrade(重大升级)”,彻底锁死全球开发者的预期。

▲ 截图:马斯克承认竞品优势,同时放言4.7极大概率登顶全球第一
这种“发布一代、预热一代、压制一代”的连环轰炸,把竞争对手逼到了极其难受的境地。
对于开发者来说,原本还在犹豫要不要给OpenAI或Anthropic充值高昂的年费,转头一看:现成的Grok 4.6便宜5倍,而更恐怖的2.1T版本可能在接下来几周端上桌来。
在X平台的评论区里,这种情绪正在疯狂蔓延。有深度使用Claude的开发者公开表态:“如果4.7真如预期般强大,我将立刻全面迁移。”

▲ 截图:用户在推文下直言,若4.7表现达标将彻底告别竞品阵营
也有极客调侃:“4.6的机房还没凉透,4.7就冲进来了,工程团队不用睡觉吗?”
终局推演:谁能在王座上坐稳?
大模型的2026年,正在脱离早期“拼谁参数吹得大”的草莽时代,进入到最残酷的“全维综合战”。
这场战争由三个硬指标构成:
- 智商上限(Intelligence Ceiling)
:能否在长程逻辑、复杂编程、深度物理推理中不掉链子? - 推理成本(Token Cost)
:能否把高智商模型的调用成本打到白菜价,让千万开发者都用得起? - 数据护城河(Data Moat)
:在公网语料枯竭的死局下,谁能把现实世界的专有数据注入模型?
Grok 4.6的低价突袭,打响了第一枪;即将落下的Grok 4.7,则押上了SpaceX数据资产与大规模算力集群。
当2.1万亿参数的神经突触,连通了人类最顶尖的航天物理数据库;当5倍性价比的利刃,刺向旧时代的AI霸主,
属于大模型的新一轮风暴,已经扑面而来。我们唯一能确定的,就是系好安全带,准备迎接那个更加疯狂、更加不可思议的AI奇点。

夜雨聆风