夜雨聆风学习资料网

ARTICLE · 1112418

OpenAI 7天紧急换头!日文文档露馅:GPT-6.1 Sol竟是偷跑的次旗舰?

OpenAI 7天紧急换头!日文文档露馅:GPT-6.1 Sol竟是偷跑的次旗舰?

作者 | 负一· 编辑 | 负一

科技圈见过迭代快的,但没见过跑得这么狼狈的。

2026年9月末,OpenAI在一年一度的开发者大会(DevDay)上带来关键更新:GPT-6.1 Sol 正式上线。

▲ OpenAI 官方发布页:高调打出“五分之一价格享近 Astra 级智能”

官方宣传语写得极其漂亮,“仅需五分之一的价格,即可拥有逼近旗舰 Astra 的智能”。

但翻开日历对照便能发现:距离上代模型 GPT-6 Sol 的发布,仅仅过去了整整7天。

7天,连一次完整的预训练参数检查都跑不完。

这款看似仅有“0.1跨度”的小版本升级,在写代码、漏洞挖掘和复杂推理上的表现,大幅拉开了与一周前 6.0 版本的差距。

天下没有凭空掉下来的算力

一场横跨硅谷社区的“赛博大侦探”行动随即爆发。随着一份日文支持文档的意外“翻车”和一份绝密安全评测的曝光,一个被掩盖的真相浮出水面:

社区普遍推断,GPT-6.1 Sol 脱离了普通的常规演进序列,其真实底座正是 OpenAI 原定用来对标高阶竞品的秘密次旗舰,“GPT-6 Astra Minor”。

为了狙击对手,OpenAI 亲手撕掉了原本的价签,掀翻了自家的牌桌。

017天神迹?连改代码的动画都“换了灵魂”

事情的怪异,是从一线开发者的实测开始发酵的。

在 OpenAI 最初的官方定位中,GPT-6 家族有着森严的阶级:

  • GPT-6 Astra
    :皇冠上的明珠,最强、最深邃、最贵。
  • GPT-6 Sol
    :中端“干活模型”,主打日常高强度写代码和自动化工作。
  • GPT-6 Luna
    :轻量级小模型,跑在边缘和廉价推理端。

▲ 9月22日发布的 GPT-6 Sol 页面,没过几天顶部就被挂上了跳转 6.1 的紧急更新条

9月22日,GPT-6 Sol 刚上线时,社区反响平平。许多开发者抱怨其能力平庸,在复杂多步逻辑任务中频频卡壳,甚至被讽刺为“套壳缩水版”。

然而仅仅一周后,6.1 登场,画风突变

开发者 Harshith 在代码平台 Codex 中输入了完全相同的提示词:“制作一个骑自行车的动画”,并同时开启最高推理档位(xhigh)。

▲ 开发者 Harshith 实测感叹:6.1 终于展现出 Sol 该有的水准,两者差距宛如鸿沟

结果令人目瞪口呆:6.0 版本生成的动画肢体僵硬、代码逻辑错漏;而 6.1 版本一气呵成,不仅物理运动轨迹流畅,代码封装更是无可挑剔。

第三方评测机构的“智能指数”(Intelligence Index)更是测出了惊人断层:6.1 Sol 的得分在短短7天内直接跳升了整整5分。

在通用大模型的技术周期里,常规的微调或后训练(Post-training)很难在短短7天内跨越如此巨大的差距。

“这完全来自两套不同的底层模型” 社交媒体上,质疑声四起

02日文文档露马脚:全世界都在找的“Astra Minor”

如果是两套完全不同的模型,那 6.1 究竟是谁?

其实,早在 6.1 发布前几天,安全研究员 Token Gremlin 就曾在 OpenAI 的企业安全白名单里抓取到一个诡异的名字,Astra Minor。

▲ 发布前夕,研究员在企业安全文档中首次捕捉到了 Astra Minor 的踪迹

当时大家都以为,这是 OpenAI 准备在旗舰 Astra 和中端 Sol 之间推出的“中高档”新型号。

但谁也没想到,这个名字在 6.1 发布后,竟然在一夜之间从英文官网上被清洗得干干净净。

OpenAI 以为抹去了所有痕迹,却忽略了多语言翻译系统的缓存时间差。

日本开发者 @hikawoai 在翻阅 OpenAI 官方企业帮助中心时,顺手比对了一下英文版与日文版的同一篇引导文档。

这一比,抓了个现行

▲ 日文文档未及时同步更新,直接将 6.1 Sol 的位置暴露为 Astra Minor

英文版页面赫然写着:

“Astra and GPT-6.1 Sol retain standard safeguards with Blue...”

而对应的日文版页面由于翻译滞后,清清楚楚地印着:

“Astra と Astra Minor は、Blue では標準の安全対策を維持し……”

▲ 现行英文文档:Astra 与 GPT-6.1 Sol 并列

▲ 未修改的日文文档:在完全相同的功能槽位上,赫然写着 Astra Minor

铁证如山

在底层的代码槽位与功能定义中,GPT-6.1 Sol 就是 Astra Minor。它原本的名字里带着象征最高算力的“Astra”,却在发布会前夕被临时撕下标签,扣上了“Sol”的帽子。

03硬核铁证:连安全卡都直接照抄“旗舰待遇”

如果说文档差异只是前台运营的乌龙,那么随之曝光的安全评测数据,则从工程底层坐实了它的旗舰血统。

在 OpenAI 内部,有一套极其严苛的《准备度框架》(Preparedness Framework),专门用来监测模型是否具备制造生化武器、发动毁灭级网络战的“危险智能”。

根据披露的技术数据,GPT-6.1 Sol 在网络安全维度的评估中,被直接定级为最高风险的 Critical(严重危急) 档!

测试维度
GPT-6.0 Sol
GPT-6.1 Sol (Astra Minor)
旗舰 GPT-6 Astra
网络安全危险定级
High
Critical (危急)Critical (危急)
未公开新漏洞利用率 (ExploitBench)
5.5%
21.5%(提升近4倍)
31.5%
常规漏洞攻防得分 (Max Effort)
81.7%
99.7%(逼近极限)
100%

看懂这组数据,你就会明白为什么它不可能是普通的 Sol。

面对2026年夏季最新披露的真实零日漏洞,6.0 Sol 的利用成功率只有可怜的 5.5%;而 6.1 Sol 直接飙到了 21.5%,在常规测试中跑出了 99.7% 的恐怖成绩,几乎与 100% 满分的旗舰 Astra 并驾齐驱。

由于杀伤力过大,OpenAI 的安全团队不得不给它套上了与 Astra 完全相同的重型防御护栏栈(Safeguards Stack)。

在官方的 Daybreak(授权网络安全准入计划)体系中,这种“区别对待”更是显露无遗:

普通企业想要调用常规的 gpt-6-sol,只需要普通的 Daybreak Blue 审查即可;但如果想要调用 gpt-6.1-sol,企业必须预先通过审查最严苛的 Daybreak Red(红队攻击性测试)最高审批!

在安全工程师眼里,这就是一尊具备 Astra 级杀伤力的高风险模型。

04杀敌一千:被竞品逼出来的“恐慌式降价”

为什么 OpenAI 要干这种“一周打脸、自我降级”的尴尬事?

社交媒体上的科技评论员 leo(@synthwavedd)一针见血地发帖嘲讽:

“发布一周就不得不换掉模型,简直太尴尬了。”

▲ 社区意见领袖直言:这是一场为了应对 6.0 溃败的尴尬换壳

但资深科技观察者 Mark Kretschmann 揭示了更深层的商业推手:外部战局的剧变。

▲ 业内分析指出,竞品 Anthropic 的步步紧逼是打乱 OpenAI 发布节奏的关键

当时,Anthropic 的 Claude Opus 5.5 携雷霆之势席卷开发者市场,而在中端,Sonnet 5.5 同样杀气腾腾。

按照原定剧本,OpenAI 的如意算盘是:

  1. 推出平庸但廉价的 Sol,赚取日常调用量;
  2. 择机推出定位中高阶、售价昂贵的 Astra Minor,卡在两者之间收割利润;
  3. 旗舰 Astra 坐镇最高端。

然而,6.0 Sol 的拉胯表现和竞品施加的巨大压力,瞬间粉碎了这套温水煮青蛙的节奏。

如果中端防线失守,开发者生态就会出现雪崩。

被逼到墙角的 OpenAI 高层做出了一个近乎疯狂的战术决定:取消 Astra Minor 的独立发售,将原本打算卖高价的次旗舰模型,直接改名为 GPT-6.1 Sol,以白菜价砸向市场!

▲ API 文档定格了这场价格风暴:输入 $2,输出 $10,缓存输入更是低至 $0.10

看一看这组极具破坏力的价目表(每百万 Token):

  • GPT-6 Astra
    :输入约 $10 / 输出约 $50 / 缓存 $1
  • GPT-6.1 Sol
    :输入 $2 / 输出 $10 / 缓存 $0.10

开发者只需花旗舰五分之一的钱,甚至在命中上下文缓存时只需花 十分之一 的成本,就能调用一个具备 105 万超大上下文窗口、近乎 Astra 水准的顶级模型。

正如科技博主 David Heaney 反驳批评者时所言:

“它确实还没完全达到 Astra 或 Opus 5.5 的绝对高度,但它的价格只有 Astra 的五分之一、Opus 的一半!在这个价位上,还要什么自行车?”

▲ 业内人士指出:抛开价格谈智能毫无意义,6.1 的性价比重构了市场规则

05狂欢背后:军备竞赛的新现实

这是一场为了守住王座而发动的“自杀式降维打击”。

对于全球开发者和企业来说,这无疑是一场饕餮盛宴。原本昂贵、高不可攀的前沿代码生成与自动化推理能力,在一夜之间被拉进了普惠区间。

但狂欢之下,代价同样真实存在:

发布后的几天里,无数用户涌入,由于模型底层极其庞大且消耗算力,GPT-6.1 Sol 出现了严重的排队、响应变慢现象,官方不得不承诺紧急推出 Ultrafast 加速档位。

从更宏观的视角来看,这次“Astra Minor 换头惨案”标志着一个时代的转折:

AI 大模型的版本号逐渐脱离了严谨的技术血统,演变为战术防御的策略手段。

曾几何时,模型公司按照算力规模和研发周期,按部就班地发布 1.0、2.0、3.0;而现在,在竞品刺刀见红的贴身肉搏下,谁也无法按既定路线出牌。

当原定昂贵的次旗舰被一枪打掉利润空间、硬生生塞进中端序列,OpenAI 亲手终结了AI市场的暴利神话。

这场始于日文文档乌龙的改名风波告诉我们:

在这个技术狂飙的时代,没有什么不可逾越的护城河,只要枪声一响,巨头们也会在深夜掀翻自己的棋盘。

相关学习资料