就在今天,亚马逊AWS扔出一枚重磅炸弹——OpenAI的开源权重模型gpt-oss-120B和gpt-oss-20B,正式通过Amazon Bedrock和Amazon SageMaker AI面向全球客户开放。
这是OpenAI模型历史上第一次在微软Azure之外的云平台上架。
七年独家协议,说破就破。

一、七年铁幕,一朝瓦解
时间倒回2026年4月27日。微软和OpenAI联合发布了一份声明,终结了延续七年的独家云合作协议。核心变更只有一句话:Azure不再是OpenAI模型的唯一云服务商,改为非排他性的优先权模式。
这份独家协议曾让微软在AI军备竞赛中占尽先机。作为OpenAI的最大金主,微软砸下上百亿美元,换来的是OpenAI模型在Azure上的独家托管权。过去几年,任何想在云上使用OpenAI最先进模型的企业,几乎只有微软一条路可走。
但这份独家绑定也成了OpenAI的紧箍咒。OpenAI首席营收官Denise Dresser在内部备忘录中直言,与微软的长期合作虽然至关重要,但“限制了我们接触企业客户的能力——而他们中的大多数都在用Bedrock”。
企业对在AWS上直接使用OpenAI模型的需求,用她的话说——“ frankly staggering”(简直惊人)。
于是,协议终止的第二天,OpenAI就宣布与AWS达成深度战略合作。亚马逊CEO安迪·贾西在社交媒体上形容这一转变“非常有趣”。不到四个月,gpt-oss系列开源模型正式上架。
而今天,2026年8月12日,就是成果落地的日子。
二、gpt-oss到底是什么来头?
这不是OpenAI第一次做开源。但这一次,诚意十足。
gpt-oss系列包含两个型号:
gpt-oss-120B:总参数1170亿,每次推理仅激活51亿参数。专为生产级、高推理需求场景设计,可运行在单张80GB显存的GPU上(如NVIDIA H100或AMD MI300X)。
gpt-oss-20B:总参数210亿,每次激活36亿参数。面向低延迟和本地部署场景,仅需16GB显存即可运行。
两个模型都采用混合专家架构——每次推理只激活网络的一小部分,这是它们能在单GPU上流畅运行的核心秘密。
更狠的是授权协议。两款模型均基于Apache 2.0许可证发布。这意味着你可以自由修改、商业化部署,没有任何版权限制或专利风险。开发者可以在Hugging Face上直接下载模型权重,在本地笔记本上跑起来。
128K的上下文窗口,足以一次性处理整部中篇小说。完整的思维链输出,让推理过程透明可验证。可调节的推理强度(低/中/高三档),按需分配算力。原生支持函数调用、网页浏览、Python代码执行。
这不是一个阉割版的开源模型,这是OpenAI把看家本领亮出来了。
三、性能到底怎么样?

先说结论:gpt-oss-120B在核心推理基准测试中,与OpenAI自家的o4-mini几乎打成平手。
在编码、竞赛数学和工具使用等推理任务上,两者表现相当。而在吞吐量方面,gpt-oss-120B达到262 token/秒,高于o4-mini的161 token/秒。
更值得关注的是它在智能体任务上的表现。gpt-oss-120B在“自主规划执行”评测中拿下92分,在“多工具协同”测试中获得95分。模型原生支持函数调用、网页浏览和代码执行,这意味着它可以自主完成多步骤的复杂任务——从检索信息到分析数据再到生成报告,一气呵成。
AWS产品总监Atul Deo说得很直白:“开放权重模型将在生成式AI的未来发展中扮演重要作用,我们致力于将AWS打造为执行模型的最佳平台。”
四、价格才是真正的杀手锏
如果说性能和开源是开胃菜,那价格就是主菜。
根据公开数据,gpt-oss-120B在Amazon Bedrock上的定价为输入每百万token 0.15美元,输出每百万token 0.60美元。
AWS官方给出的对比更震撼:在Bedrock上运行gpt-oss-120B,性价比是同尺寸Gemini模型的3倍,是DeepSeek-R1的5倍,是OpenAI o4模型的2倍。
另外有数据显示,gpt-oss-120B的输入价格约为每百万token 0.04美元,比某些竞品便宜约156%。
成本是企业的命门。当一个大模型可以把推理成本压到竞品的五分之一甚至更低,商业决策的天平会向哪边倾斜,不言自明。

五、为什么说这是AI云战争的转折点?
OpenAI与微软的独家协议维系了七年。这七年里,微软凭借独家托管权,在AI云市场建立了几乎不可撼动的优势。企业想用最先进的OpenAI模型?来Azure。
但现在,这道护城河被填平了。
AWS拥有全球覆盖最广的云基础设施和数百万企业客户。Bedrock平台已经有超过10万家组织在使用。这些客户现在可以在不引入新的供应商、不改变计费路径、不增加治理流程的情况下,直接使用OpenAI的模型。
更重要的是,通过Bedrock路由的每一个API调用都继承了AWS的原生控制能力:IAM身份管理、VPC网络隔离、KMS数据加密、CloudTrail审计日志。OpenAI明确表示,客户数据不会用于模型训练,也不会对外共享。
对于金融、医疗、政府等强监管行业来说,这比直连OpenAI的API更有吸引力。
有业内从业者在Hacker News上直言:“Bedrock这套接入方案比模型本身更具价值。”
一位大型企业工程经理说得更透彻:“我在一家拥有严格数据治理体系的企业工作。选择既通过信息安全审核、又在客户合同中被列为数据处理方的服务商,是规避法律风险的关键。”
六、OpenAI的多云野心
这次上架gpt-oss只是开始。
事实上,OpenAI与AWS的深度合作早已埋下伏笔。2025年11月,OpenAI宣布与AWS达成总额380亿美元的合作承诺。三个月后,AWS进一步表示将投资500亿美元于OpenAI。双方还达成协议,OpenAI将使用AWS自研的Trainium芯片进行模型训练,总计达2吉瓦算力。
而在Bedrock上,除了gpt-oss系列,OpenAI的GPT-5.5、GPT-5.4、Codex编码智能体等前沿模型也已全面上线。Codex这个每周有超过500万开发者使用的编码助手,现在所有推理都通过Bedrock路由。
OpenAI正在从“微软的OpenAI”变成“大家的OpenAI”。
七、开发者迎来黄金时代
对于开发者来说,这是一个前所未有的好时代。
你可以在本地笔记本上跑一个210亿参数的开源模型。也可以用单张H100显卡部署一个1200亿参数级别的生产级模型。你可以自由修改、微调、商业化部署。你可以通过Bedrock的API无缝切换不同模型提供商,无需重写代码。
成本门槛也在急速下降。当推理成本可以低到每百万token几分钱,过去只有大公司才玩得起的AI应用开发,正在变成个人开发者也能参与的赛道。
OpenAI产品负责人Dmitry Pimenov说得很形象:“我们的开放权重模型广泛适用于从个人开发者到大型企业团队,正在帮助各类型用户在不同产业和应用场景中探索新的可能性。”
写在最后
七年的独家协议,在AI行业一日千里的进化速度面前,终究成了一段历史。
当OpenAI的开源模型跑在AWS的服务器上,当Apache 2.0许可证让每个人都能自由使用和修改,当推理成本被压到DeepSeek的五分之一——这不仅是商业格局的变化,更是AI民主化的又一个里程碑。
模型的壁垒正在坍塌,算力的门槛正在降低,创新的成本正在归零。
下一个改变世界的AI应用,可能就诞生在你我的笔记本电脑上。
而今天,就是新故事开始的第一天。
夜雨聆风