每次新模型要发布,朋友圈和推特总会准时上演同一幕。
一批人忽然集体解禁,长测、跑分、体验视频扎堆冒出来,配文永远是那句"我其实已经用了好几周"。剩下的人只能在评论区反复问同一个问题:凭什么是他先用?
2026年7月8日,这个问题终于被摆到了台面上。
一个被憋了很久的追问
OpenAI官方账号刚宣布,新一代旗舰模型GPT-5.6 Sol,连同Terra、Luna两个分支,将在本周四公开上线,并且正在全球范围扩大预览。
产品博主Peter Yang(@petergyang)在评论区留下一句朴素、却让人无法回避的追问:
"So what is the qualification criteria for folks to get early access to this model?"
「那么,普通人想拿到这个模型的提前访问权,资格标准到底是什么?」
这条推文的浏览量冲到8万+,回复区却没等来官方答案,只等来一片心照不宣的调侃:
"愿意在解禁瞬间立刻全网晒图的人" "得先有钱,或者有名气" "评价必须清一色正面才行" "大公司员工天然占便宜" "以前拿过内测资格的人,这次接着拿"
没人真的给得出答案。大家不过是借着玩笑,把一个憋了很久的问题重新问了一遍。

▲ Peter Yang在OpenAI官宣GPT-5.6 Sol扩大预览的推文下追问资格标准,浏览量8.1万
第二天,OpenAI真的回答了
7月9日,太平洋时间中午,科技直播节目TBPN放出预告:OpenAI负责Codex与ChatGPT产品线的工程负责人Thibault "Tibo" Sottiaux(@thsottiaux)将做客直播间。
节目播出后,TBPN剪出一段约1分26秒的切片,标题直接点破了所有人都在等的那件事,OpenAI挑人给早期访问权时,到底在看什么。
Tibo给出的答案,浓缩成了四条标准:
"When we give access to folks outside of OpenAI, [we look for someone with] high-bandwidth engagement, good feedback, and someone who's shown to be unbiased in the past. Someone who has talked honestly about all sorts of model harnesses."
「当我们把访问权给到OpenAI以外的人时,我们会找:高带宽互动、好反馈、过往被证明不带偏见的人,以及那些会诚实讨论各种model harness的人。」
这称不上一份能打印出来的申请表,甚至算不上一套完整的内部制度。但它头一回把一个长期被当成"神秘名单"的东西,拆成了四条可以拿出来讨论的标准。
这条切片播放量不算惊人,点赞不到百次。可转发它的人,几乎都在评论区补一句:终于说了。


▲ TBPN发布的视频切片,引述Tibo在直播中对早期访问权标准的说明,发布于2026年7月9日下午3:50
拆开这四条标准,一条比一条卷
四条标准乍看像场面话,拆开看,每一条都在悄悄提高门槛。
第一条,高带宽互动。
网友Jamaur Bronner在评论区直接追问:
"Can you break down 'high bandwidth engagement' for us? Does that just mean folks who are thoughtful in how they give feedback and engage with the product?"
「能不能帮忙拆解一下'高带宽互动'?这是否就是指那些反馈和产品互动比较有深度、有想法的人?」
到发稿,这条追问还没等到Tibo本人回复。结合OpenAI自己写过的工程博客,答案大致可以拼出来:高带宽比拼的,从来是信息密度。复现步骤讲不讲得明白,失败模式描述不描述得出来,跟上一代模型的差异对比不对比得上,这些才决定一个人能不能替产品团队省下一整轮内部调试的功夫。天天在评论区刷存在感,换不来这份认可。
第二条,好反馈。
OpenAI在GPT-5.5发布文里透露过一个数字:发布前,他们从将近200个受信任的早期访问伙伴那里收集了真实用例反馈。两三百人,是一个卡在"极少数密友"和"全体付费用户"中间的规模,早期反馈圈子确实存在,门槛也确实不低。真正被采纳的反馈,得指得出"这类任务变强了、那类任务反而退步了",还得赶在预览窗口关闭前交上来。
第三条,过往不带偏见。
这一条最有意思。Tibo没有要求测试者对OpenAI一味唱赞歌,反而强调"过往被证明不带偏见"。对一家实验室来说,发布前收到的失真赞美,比尖锐批评危险得多,它会污染决策,还会在产品公开后被真实用户当场打脸。
第四条,诚实讨论model harness。
这是四条里最带2026年行业气味的一条。
Harness,可以理解成模型的"底盘",系统提示词、工具协议、检索与记忆脚手架、终端与IDE的连接方式,甚至评测跑分用的环境,全都算在内。同一个模型,换一套harness,体验可能天差地别;跑分脚手架一换,名次也可能跟着变动。
OpenAI在今年2月发过一篇长文《Harness engineering》,讲团队如何靠"零手写代码"的约束打造内部产品:人类负责设计环境和反馈回路,模型负责写代码。文章里提到了两类使用者,内部日活员工,和外部alpha测试者。
Tibo这次把"诚实讨论harness"直接写进选人标准,等于在说:他们要找的人,得分得清哪部分提升来自模型本身,哪部分只是脚手架带来的错觉。

▲ OpenAI 2026年2月发布的技术博客《Harness engineering: leveraging Codex in an agent-first world》,文中明确提到内部日活用户与外部alpha测试者
标准摆上台面,焦虑却没减少
标准被摆上台面后,随即被网友当成段子解构。账号clanker(@clanker_)转发TBPN切片时,留了一句俏皮话:
"I'm half-considering turning this into a model harness account to get early access."
「我有点在考虑把这个号改成model harness账号,好拿到早期访问权。」
这句玩笑戳破了一个尴尬的可能性:标准一旦公开,就可能被表演出来。一个真心记录复现步骤的独立开发者,和一个连夜把简介改成"专注model harness讨论"的投机者,摆在外部看,长相可能一模一样。


▲ 网友clanker转发TBPN切片并调侃考虑"转型"以获取早期访问权,发布于2026年7月10日
说这番话的人,自己在忙什么
Tibo的身份,值得多说一句。
他的X简介只有一行:Codex & ChatGPT @OpenAI。长期以来,他被视为推动Codex这款编程agent产品化的关键人物;2026年之后,精力更多转向ChatGPT本身的改造,外界常用"超级应用"来形容这场改造的野心,把ChatGPT从一个聊天框,变成一个真能替人办事的入口。
上TBPN的同一天,Tibo自己还发了一条产品向推文:
"ChatGPT Work is now rolled out to 100% of our Pro users... One advice: Raise your ambition. GPT 5.6 Sol is different from what you might have seen before."
「ChatGPT Work已经向100%的Pro用户推送……一条建议:把野心抬高一点。GPT-5.6 Sol和你以前见过的都不一样。」
这条推文,把他的立场交代得明明白白:他真正想要的,是那些把AI当同事用、愿意把使用心得讲出来的人。安静的付费用户,很难挤进他此刻最在意的名单。四条标准偏向开发者、偏向重度用户,算不上巧合,服务的正是他自己正在推的这套"让AI办事"的产品路线。

▲ Tibo同日发布的产品推文,宣布ChatGPT Work向全体Pro用户推送,浏览量27.1万
早期访问权,更像一份工作,而非一张彩票
把这次的四条标准和过去几年的信息拼在一起,能看出一条更大的线索。
两年前,早期测试者比拼的还是谁的prompt玩得花、谁的聊天截图更抓眼球。今天,比拼的变成了谁能诚实分清"这是模型的功劳,还是脚手架的功劳"。这个转变背后,是agent产品本身的变化,模型开始连续操作电脑、调用工具、完成一整条任务链,早就超出了"回答一个问题"的范畴。工具调用卡死、权限出错、长任务中途遗忘、安全边界模糊,这些毛病只有真实使用者才能稳定地暴露出来。
于是早期访问权正在被重新定义成一份需要交付成果的非正式工作:高密度的沟通、能落地的反馈、经得起检验的判断力,外加一双能分清脚手架和模型区别的眼睛。等着被翻牌子的福利,早就不够格描述它了。
这也说明了为什么标准摆得再明白,大多数人依然会觉得不公平。能产出高带宽反馈,本身就需要时间、技术能力和合适的使用场景;已经被看见的人,天然更容易被继续看见;没有一个公开的申请入口挂在那里,标准写得越透彻,读起来就越像一份说明书,只是读者恰好都还站在门外。
对大多数人,真正值得花力气的,是把日常的每一次使用,都沉淀成一份可复现、可对比、敢认缺点的反馈能力,这比琢磨怎么挤进那张看不见的名单,实际得多。这既是Tibo口中理想候选人的样子,也是这个agent当道的年份里,每一个认真用户迟早要练成的基本功。
夜雨聆风