我做了多年AI产品,亲历过各种“颠覆性发布”的前夜。但这一周,空气里的焦灼感不太一样。

圈内几个从不轻易激动的人,这次都坐不住了。

a16z合伙人Martin Casado说,他最近接触到了“今年最重磅的新模型”。

科技观察者Andrew Curran补了一刀:这次突破不是来自OpenAI或Google这种主流大厂,而是一家独立实验室——这让事情“非常真实”。

最夸张的是AI观察家Dan McAteer,直接放话:“Ilya真正创造了超级智能,游戏规则已经被改变了。”
所有人目光都锁向同一个地方:Ilya Sutskever的SSI,Safe Superintelligence,『安全超级智能实验室』。据月初投资人Gavin Baker在播客里透露,SSI说他们将在8月发布模型。现在是8月底,时间对上了。

真金白银的流向往往比嘴上的期待更诚实。7月27日,英伟达突然宣布和这家没有收入、没有产品的公司达成战略合作,把SSI的算力规模未来一年内提升10倍。

猛料随后爆出:这笔投资高达50亿美元,英伟达还给了SSI下一代Vera Rubin系统的独家访问权限。黄仁勋在新闻稿里说得很含蓄,他们是在“获得了对其严密保护的研究成果的罕见访问权”之后,才决定押注。
黄仁勋看到了什么?结合今天的爆料,答案呼之欲出。SSI这次曝光的,是基于测试时训练,也就是Test-Time Training的全新架构。这词听起来学术,但它的商业含义,我这个做产品的人一听就后背发凉。
现在的AI,不管参数多大,本质都是“预训练”阶段把知识冻进权重里。训练一结束,大脑就固定了。为了让模型处理新信息,大厂们疯狂卷上下文窗口,从100K卷到百万级。这就像开卷考试——模型的大脑没变聪明,只是你允许它带进考场的小抄越来越厚。即便是o1这种主打推理的模型,也只是在草稿纸上多花时间思考,脑细胞本身依然静止。

但TTT不一样。当模型读你给的一份长文档时,它不是把文档塞进小抄,而是真的去“学”它,产生梯度更新,改变自己的神经网络结构。读完,它已经变成一个微小但全新进化的AI。它不再需要巨大的上下文窗口,因为它把读到的东西变成了自己真正的内化知识。
这话翻译成产品语言就是:行业里目前竞争的是“模型能思考多久”,而Ilya下注的是“模型能不能改变自己”。这是两条完全不同的路线。前者堆算力,后者改范式。
回看Ilya过去两年的表态,会发现他一直在给这条路做铺垫。2024年NeurIPS,他说预训练时代即将结束。

(在2024年的NeurIPS大会上,他就做出了这个惊人预言)
2025年11月,他说我们正从Scaling的时代迈向Research的时代。

他反复强调一个比喻:真正的超级智能不是背下全网数据的庞大机器,而是一个极其聪明、充满好奇心的15岁天才。起初什么都不懂,但放在任何一个岗位上,通过试错和学习,能迅速掌握编程、医学、法律。人类本身不是“出厂即全能”的AGI,而是依赖持续学习。真正的超级智能也应该这样:部署本身就是学习过程。
这套理念直接决定了SSI的战略。不追求短期产品,不发布中间模型,只做“straight shot to safe superintelligence”,把重心放在高效持续学习与对齐上。

这也解释了SSI为什么两年零产品零论文,异常低调。如果你正在建造一个彻底颠覆现有范式的新物种,你不会在范式还没搭好时就到处发博客。
现在回头看那些埋下的线索。2024年7月,Yu Sun等人发表了原始TTT论文。SSI投资人、Stellar联合创始人Jed McCaleb合著了一篇论文,里面有一句话很关键:长上下文语言建模根本不是架构问题,而是连续学习问题。

研究方向一致,投资人亲自下场联名论文,再到现在密集的爆料,所有线索都指向同一个事实:SSI把TTT从学术概念变成了商业武器。
我知道很多人会问:这会不会又是一次狼来了?我的判断是,即使SSI这周发布的只是个有限测试版,它的意义也不在于跑分超过谁,而在于证明一件事——AI的竞赛,根本没有到“拼财力和算力就能赢”的收官阶段。真正的技术飞跃,依然藏在那些敢于打破常识的顶级大脑里。
如果模型真的能边用边学、实时更新权重,大厂堆积在数据中心的算力护城河、按百万Token计费的商业模式、甚至开源权重的争论,都会面临降维打击。一个小的、能在岗位上持续进化的模型,可能比一个用海量算力堆出来却不知变通的巨兽,更适配真实世界的复杂任务。
当年,是Ilya的一段代码让深度学习重见天日。如今,他可能亲手终结大模型的“预训练时代”。这个8月的最后几天,所有人都在等他的交卷。答案揭晓的那一刻,AI的下半场才真正开始。
SSI首模型将至,Ilya要用TTT把AI从“背题库”变成“会学习”:一个会自己长记性的AI
文中金句回顾
“Ilya真正创造了超级智能,游戏规则已经被改变了。” 这笔投资高达50亿美元,英伟达还给了SSI下一代Vera Rubin系统的独家访问权限。 这就像开卷考试——模型的大脑没变聪明,只是你允许它带进考场的小抄越来越厚。 它不再需要巨大的上下文窗口,因为它把读到的东西变成了自己真正的内化知识。 行业里目前竞争的是“模型能思考多久”,而Ilya下注的是“模型能不能改变自己”。 真正的超级智能不是背下全网数据的庞大机器,而是一个极其聪明、充满好奇心的15岁天才。 如果你正在建造一个彻底颠覆现有范式的新物种,你不会在范式还没搭好时就到处发博客。 长上下文语言建模根本不是架构问题,而是连续学习问题。 AI的竞赛,根本没有到“拼财力和算力就能赢”的收官阶段。
夜雨聆风