乐于分享
好东西不私藏

掀翻OpenAI!马斯克深夜扔下核弹:5倍性价比血洗GPT-5.6,2.1万亿参数Grok 4.7装填SpaceX工程数据!

掀翻OpenAI!马斯克深夜扔下核弹:5倍性价比血洗GPT-5.6,2.1万亿参数Grok 4.7装填SpaceX工程数据!

北京时间8月19日凌晨,硅谷的空气再次被马斯克的一条推文点燃。

马斯克没有召开发布会,只是在社交平台X上轻描淡写地转发了一张对比图,顺手写道:

“去试试Grok 4.6吧!Grok 4.7是一次重大升级,很快就来。”

短短二十几个英文单词,瞬间在整个全球科技圈激起滔天巨浪。

被马斯克引用的那张图,足以让任何一家AI大厂的财务和高管背后发凉。

第三方权威评测机构Artificial Analysis的最新榜单显示:xAI刚刚发布的Grok 4.6,在综合智能指数(Intelligence Index)上拿到了61分,与OpenAI的当家王牌GPT-5.6 Sol直接打平

然而,翻开两家的API价格表,差距大到令人眩晕:在决定实际使用成本的输出端,GPT-5.6 Sol每百万Token收费30美元而Grok 4.6只要6美元

同样的基准跑分,价格直接砍掉五分之四!便宜整整5倍!

马斯克的后半句话又抬高了外界的预期:这个把OpenAI按在地上打价格战的Grok 4.6,居然只是一道“开胃菜”。拥有2.1万亿参数、正在补充训练中加入SpaceX公司工程数据的Grok 4.7,已经在路上。

大模型世界的游戏规则,正在被彻底改写。

5倍性价比屠榜!马斯克打响AI界的“平价核战争”

很多人可能对“便宜5倍”没有直观的概念。

在大模型的世界里,Token(词元)就是数字时代的石油与通行货币

你可以把模型服务想象成坐出租车:你给模型输入一段几万行的代码或资料,是输入Token(Input),相当于上车起步价;模型思考后洋洋洒洒给你写出复杂的程序、分析报告或系统架构,是输出Token(Output),相当于按行驶里程持续计费。

对于现代软件开发、企业自动化Agent(智能体)以及复杂的长程任务来说,模型往往会输出成千上万行内容,输出Token的单价,直接决定了一家科技公司的生死账单。

▲ 截图:博主@XFreeze制作的对比图,Grok 4.6在同等跑分下输出端便宜5倍

看一眼博主@XFreeze列出的残酷对比:

  • GPT-5.6 Sol
    :输入每100万Token收5美元,输出收30美元
  • Grok 4.6
    :输入每100万Token收2美元,输出收6美元

按输出端的价差估算,同样运行一个大型企业级的多智能体工作流,如果在OpenAI那边每天要烧掉10万美元,换到Grok 4.6上,可能只要2万美元出头

▲ 截图:Artificial Analysis评测首页,Grok 4.6以61分并列第一梯队且处于成本帕累托前沿

在独立评测机构Artificial Analysis的坐标系里,Grok 4.6横空出世后,直接杀到了“高智能-低成本”的最优前沿位置。无论是多轮工具调用、终端长任务还是编写底层代码,4.6的表现都极度亮眼。

马斯克用最粗暴的商业逻辑撕开了竞争的口子:当两款顶级AI智商相差无几时,谁能把工业化成本压到极致,谁就能把对手从开发者的服务器里赶出去。

但这还只是第一波冲击波

1.5T到2.1T!4.7准备更换底座

如果只是便宜,大洋彼岸的对手们或许还能靠技术壁垒稳住阵脚。但马斯克接下来抛出的参数信息,又把预期推高了一截。

在硅谷以往的发布惯例中,版本号的小数点后一位通常只是“小修小补”(比如调调安全策略、做做微调对齐)。但马斯克早在7月底就已经提前剧透:4.6和4.7,根本就是两代完全不同量级的模型!

▲ 截图:马斯克明确透露4.6为1.5T参数,而4.7则是2.1T的全新模型

马斯克在推文中毫无保留地拆解了技术细节:

  • Grok 4.6
    :是一个1.5万亿(1.5T)参数的模型,重点在于经历了极其漫长的后训练强化,重构了监督微调(SFT)和强化学习(RL)轨迹;
  • Grok 4.7
    :则是直接跃升到2.1万亿(2.1T)参数的庞然大物,完成一次底层预训练底座跨越

这里有一个极其反直觉、但极具技术含金量的细节。马斯克在推特上坦诚直言:“Grok 4.7在各方面都会彻底碾压4.6,唯一的小代价是,它的单字生成速度(推理服务)可能会稍慢一点,但它的Token效率(Token efficiency)会大幅提高!”

▲ 截图:SpaceXAI官方账号发布Grok 4.6,并展示多项基准成绩

什么叫“速度稍慢,但Token效率更高”

通俗来说,普通的模型智商有限,面对一个复杂的工程难题,它需要“啰里啰嗦”地写下1000个Token的推导过程,中间可能还要反复走弯路、试错,最后才能勉强给出答案;而一个2.1T的超级大脑,因为理解力极度深刻,它可能只需要精准吐出200个高质量Token,一针见血地直击本质。

如果完成同一项任务所需的Token更少,即使每秒生成速度略慢,拿到正确代码的总时间和Token消耗仍有机会下降,总账单和等待时间也可能随之降低。

这正是马斯克所说的取舍:用更大的参数底座,争取更高的Token效率。

终极大杀器:把SpaceX火箭工程数据倒进大模型!

如果说算力和参数量是大家花钱都能买到的“硬件武器”,那么马斯克手里握着的另一张王牌,则是全行业任何AI巨头做梦都得不到的物理世界特权

当前大模型行业正集体撞上一堵无形的墙,“公开互联网数据枯竭危机”维基百科被扒空了,GitHub代码库被洗劫了,各大论坛的帖子全被爬了个底朝天。当所有模型都在吞食相同的公网数据时,AI的智商增长开始放缓,甚至开始出现互相吞食合成数据导致的“模型退化”。

而马斯克在这个节点,做了一件震撼整个AI界的事。

▲ 截图:马斯克发文证实4.7初始训练完成,正在注入大量SpaceX数据

8月12日,在Grok 4.6上线的当天,马斯克就透露:Grok 4.7的初始预训练已经完成,目前正在进行高强度的补充训练,而注入的核心养料,是海量的SpaceX内部真实工程数据!

马斯克在随后的推文中意味深长地补充道:“这将会带来极其特殊的东西(This will be something special)。”

这绝非营销噱头想一想,SpaceX拥有什么?SpaceX长期积累的工程与运营数据,可能涉及火箭动力学、气动仿真、材料力学、回收控制和传感器遥测等领域。马斯克并未公开此次补充训练所用数据的具体清单和规模。

以往的大模型,本质上还是一个“饱读诗书的文科生+刷题无数的程序员”,擅长写文案、总结报表、写网页前端;而加入SpaceX工程数据的Grok 4.7,有望强化模型对物理规律、现代制造业和真实工程问题的理解。

这种专有数据壁垒,是任何纯软件AI实验室在象牙塔里无论如何也造不出来的。大模型竞争的战火,已经从虚拟的网络世界,一路烧进了物理世界的工业腹地。

连环施压与心理战!马斯克的“窒息式发布”

把时间线拉开,你会发现马斯克正在硅谷上演一场教科书级别的“心理与节奏掌控术”

回顾这一个月的时间线:

  • 7月下旬
    :放出“两周后4.6,四周后4.7”的精确倒计时;
  • 8月12日
    :Grok 4.6踩点发布,直接上线Cursor、Grok Build与API开发者平台,用打平GPT-5.6 Sol的高跑分与5倍性价比掀翻桌子;
  • 8月15日
    :在推特上展现出罕见的务实与坦诚,直言“不得不承认Anthropic的Fable 5整体确实更聪明,但Grok更快更便宜”,紧接着笔锋一转:“Grok 4.7很有机会超越目前所有模型!”
  • 8月19日
    :在4.6热度达到顶峰之际,再度公开补刀,将4.7定性为“Major upgrade(重大升级)”,彻底锁死全球开发者的预期。

▲ 截图:马斯克承认竞品优势,同时放言4.7极大概率登顶全球第一

这种“发布一代、预热一代、压制一代”的连环轰炸,把竞争对手逼到了极其难受的境地。

对于开发者来说,原本还在犹豫要不要给OpenAI或Anthropic充值高昂的年费,转头一看:现成的Grok 4.6便宜5倍,而更恐怖的2.1T版本可能在接下来几周端上桌来。

在X平台的评论区里,这种情绪正在疯狂蔓延。有深度使用Claude的开发者公开表态:“如果4.7真如预期般强大,我将立刻全面迁移。”

▲ 截图:用户在推文下直言,若4.7表现达标将彻底告别竞品阵营

也有极客调侃:“4.6的机房还没凉透,4.7就冲进来了,工程团队不用睡觉吗?”

终局推演:谁能在王座上坐稳?

大模型的2026年,正在脱离早期“拼谁参数吹得大”的草莽时代,进入到最残酷的“全维综合战”

这场战争由三个硬指标构成:

  1. 智商上限(Intelligence Ceiling)
    :能否在长程逻辑、复杂编程、深度物理推理中不掉链子?
  2. 推理成本(Token Cost)
    :能否把高智商模型的调用成本打到白菜价,让千万开发者都用得起?
  3. 数据护城河(Data Moat)
    :在公网语料枯竭的死局下,谁能把现实世界的专有数据注入模型?

Grok 4.6的低价突袭,打响了第一枪;即将落下的Grok 4.7,则押上了SpaceX数据资产与大规模算力集群。

当2.1万亿参数的神经突触,连通了人类最顶尖的航天物理数据库;当5倍性价比的利刃,刺向旧时代的AI霸主,

属于大模型的新一轮风暴,已经扑面而来。我们唯一能确定的,就是系好安全带,准备迎接那个更加疯狂、更加不可思议的AI奇点。