你的笔记本电脑,可能正在被判"死缓"
电池和硬盘都好好的,OpenAI自家人却亲口宣布:你现在用来跑AI写代码的那台机器,很快就不够用了。 他给出的时间是两到三个月
8月4日,OpenAI负责Codex与ChatGPT产品沟通的核心人物Thibault Sottiaux(网名Tibo)在X上发出一条不到50个英文单词的帖子,迅速引发全球开发者讨论。
他说了什么?大意是:我最近看到了一些结果,Codex确实是一套不错的harness(骨架);但两三个月后它就会显得原始;前沿AI的使用方式即将再来一次重大演进;下一代模型需要的资源,已经超出了你的笔记本电脑。
一个产品的亲爹,公开说自己的孩子两个月后就会被甩在身后,这到底是什么级别的信号?
"最诚实的判断"
开发者圈子里的第一反应,是一阵集体屏息。
Every创始人Dan Shipper直接回了四个字:"My body is ready(我准备好了)。"知名开发者Theo只丢了一个"👀"这些高互动但几乎零信息量的回复,恰恰说明一件事:许多人把这条帖子当成了路线图级别的信号,分量远超茶余饭后的闲聊。

▲ Dan Shipper的回复简短到近乎本能反应
把这条帖子推向更深一层讨论的,是前端开发者Jan Stevens的一段长评。他认为,"两三个月后就会显得原始",可能是今年关于AI工具最坦率的判断。

▲ Jan Stevens:别对任何工具产生感情,因为约束每两三个月就会被改写一遍
Stevens的核心论点犀利得像手术刀:过去每一轮"AI又变强了"的故事,本质上都是本地升级,更大的上下文窗口、更聪明的代码补全、在同一台机器上跑一个更好的模型。Tibo后半句把讨论推向一次结构性的断裂:工具继续变化,承载工具的机器也将换一种形态。
他最后的忠告像一盆冰水:"别对任何工具产生过度依恋,因为约束条件每两三个月就会被重写一遍。"
你的笔记本,正在沦为"遥控器"
如果Tibo说的是真的,那未来的AI编程到底长什么样?
社区里讨论较多的一条推演,来自一个叫Token Gremlin的账号。他把Tibo的话拆解成了一张清晰的路线图:更长时间运行的agent、更大的工作记忆、持久化的云端环境、更强的工具编排、并行的子代理,以及足以让你的笔记本退化为一块"控制面板"的远程算力。


▲ Token Gremlin的推演:笔记本将变成纯粹的"控制面"
换句话说,你打开MacBook,用它遥控一个在云端7×24小时不停转的AI工程师军团。你关上盖子去睡觉,它们还在干活你第二天醒来,邮箱里躺着一堆等你审阅的Pull Request。
医学研究者Derya Unutmaz在引用Tibo的帖子时,也畅想了这个画面:"即使笔记本关机,agent也能24/7工作,同时跑几十条并行线程。"
而Jeffrey Emanuel,一位重度开发者,直接用自己的装备清单回应了"超出笔记本"这层意思:家里8台机器同时轰鸣,云上15台服务器(其中大部分用来跑Rust编译),有些机器配了256GB内存。

▲ Jeffrey Emanuel:我已经在"超出笔记本"的世界里了
这哥们儿用硬件堆叠证明了一件事:前沿用户早就知道一台笔记本不够了,Tibo只是把这个秘密说出了口。
能力暴涨的代价:旧世界正在被撑破
要理解Tibo为什么在这个时间点说出这番话,必须回看过去几周发生的事。
2026年7月,OpenAI发布了GPT-5.6家族,旗舰模型Sol在编程和长程agent任务上表现凶猛。但凶猛是有代价的Sol更愿意长时间工作、发起更多工具调用、跨工具和子代理协调复杂流程,同样的推理难度,它"用力"的方式更重,token消耗更猛。
就在主帖发布前不久,Tibo自己刚写了一篇长文解释用户额度为什么掉得比以前快。他强调配额并未下调,模型变强后会主动消耗更多资源。中度用户可能觉得更省了,但重度用户做复杂任务时,额度像冰淇淋遇到夏天。



▲ Tibo此前的长帖:Sol更强了,但也更"烧"了
这就是"能力先于基础设施"的典型摩擦:模型的胃口已经长到了现有管道喂不饱的程度。Tibo说"good harness",是在说当前这套骨架能用;说"primitive",是在说这套骨架正在被撑破。
前Apple工程师Ray Fernando的说法更尖锐,他直接喊话Tibo:"请做一个agentic runtime吧!现在的harness就像用吸管喝智能。" 他抱怨委派任务给子模型仍然很原始,Ultra模式在无需深度推理的任务上也会疯狂烧token。

▲ Ray Fernando:用吸管喝智能,对当前harness最犀利的吐槽
一百万行代码,零行手写
如果你觉得"云端AI军团"还太遥远,OpenAI自己的内部实验会让你重新校准距离感。
2026年2月,OpenAI工程团队公开了一篇名为《Harness Engineering》的文章,记录了一场激进实验:从一个空的Git仓库出发,约五个月时间,人类几乎不手写一行业务代码,所有应用逻辑、测试、CI、文档、可观测性工具,全部由Codex agent生成。最终产出:约一百万行代码,上千个Pull Request,一个有内外部用户的真实产品。
工程师的工作变成了什么?设计环境、拆解目标、补齐agent的能力缺口、让UI和日志和监控指标对agent"可读"。 在这个团队里,代码交给agent生成。
用户beny在引用Tibo帖子时补了一刀产业史:Codex一开始就是纯云端agent,后来为了对抗Claude Code的CLI势头才快速补齐本地体验。 他注意到,即便CLI版上线后,Codex也常常先花10到15分钟阅读代码再动手,这种行为模式,只有在为长程自主工作训练的模型身上才说得通。


▲ beny:Codex的DNA里写着"云端长程"四个字
开源世界的一声冷笑
"云端大基建"也招来了一声冷笑
Jun Song贡献了整个讨论中最精准的对照幽默:OpenAI认为下一代模型所需资源将超出笔记本;Qwen的回答则是,新27B模型直接在笔记本上跑。

▲ Jun Song:当前沿闭源路线与本地开源路线在同一条引用树下相撞
这个段子精准地捕捉到了当下AI工具生态中最大的结构性张力:一边是OpenAI们推着前沿向"重基础设施、云端常驻、企业级编排"狂奔;另一边是开源社区用越来越小、越来越能打的模型证明,很多活儿,一台笔记本就够了。
两种路线很可能长期共存:控制面留在本地,执行面飞向云端,简单任务在你的机器上秒级完成,复杂工程由云端agent集群接管。你的笔记本不会消失,但它的角色会从"工作台"降级为"指挥台"。
两个月后见分晓
回到Tibo那条帖子
Andrew Peacock的回复或许道出了很多人内心深处的不安:"这一点都不让人不安吗?没有别人担心吗?"


▲ Andrew Peacock:有人和我一样觉得这很不祥吗?
担心是正常的当一个产品的核心负责人告诉你"你现在用的东西两个月后就是古董",任何理性的人都应该同时感到兴奋和眩晕。
情绪之外,这条帖子释放的信号更值得关注。Tibo没有附演示视频、白皮书或发布日历,整条帖子就是一块路标。它指向的方向已有多条独立线索呼应:OpenAI长程任务博客记录的25小时连续工作实验、GPT-5.6的多agent并行架构、百万行代码零手写的harness engineering实践、以及Sol模型"更强但更烧"暴露出的基础设施瓶颈。
所有的线索都指向同一个结论:我们正站在"AI编程1.0"的尾声。 在1.0时代,AI是你笔记本上一个聪明的副驾驶。在即将到来的2.0时代,AI是一支驻扎在云端的工程师部队,你只负责下达命令和验收成果。
等到两个月后再回看这篇文章,Tibo的预言究竟是先见之明,还是又一次硅谷式的过度承诺,届时自有答案。
不过说真的,以这个行业最近的迭代速度,我赌前者。
夜雨聆风