
OpenAI突然松口了:Codex可以接第三方模型了?我实测了一下,坑比想象的多
OpenAI啊,那个向来以封闭著称的OpenAI,居然把自定义模型供应商的门给打开了?
要知道,Codex可不是普通的聊天工具。它本质上是个完整的AI工作台——能读文件、写文件、调shell、抓网页、执行命令,还能根据工具返回的结果继续推理,最后直接给你交付成果。
说白了,在Codex里,模型不光要会说话,更重要的是得真能干活。
这么重要的一个产品,OpenAI居然放开了让第三方模型进来?这事儿怎么想都有点不真实。
然后我就去实测了一下。结果发现:确实放开了,但只放了一半。坑,比想象的多得多。

不是填个Key就能用,中间还得加一层翻译器
第一个坑:不是填个Key就能用
这次最容易被误读的,就是"Codex支持第三方模型"这句话。
很多人一看:哦,DeepSeek、Qwen、Kimi这些都有API,而且还号称兼容OpenAI格式,那我把接口地址和Key填进去不就直接能用了?
我一开始也是这么想的。结果呢?第一次接DeepSeek V4 Pro,直接失败。
为啥?因为协议不对。
Codex现在支持的自定义供应商,走的是Responses API这套协议。但DeepSeek这些国产模型,官方API主入口都是Chat Completions。
你可能会说:不都是"兼容OpenAI"吗,怎么还不一样?
还真不一样。同样叫"兼容OpenAI",里面分好多层。Chat Completions是一套接口,Responses API是另一套接口。普通聊天、工具调用、流式输出、推理块、函数调用回传,这些在不同协议里结构都不完全一样。
对普通用户来说这些差别看不见摸不着,但对Codex这种Agent工作台来说,它们直接决定了任务能不能跑起来。
那最后是怎么跑通的?说出来你可能不信——在本机加了一层轻量"翻译器"。Codex按自己的方式发请求,翻译器转成DeepSeek能懂的格式,DeepSeek返回后,再翻译回Codex能继续执行的形态。
说白了就是:目前DeepSeek、Qwen、Kimi、智谱这些,没有一个能直接拿API Key接进Codex的,都得靠转接桥。
唯一的例外是阿里百炼,人家直接提供了Responses接口,可以直接接。但价格嘛,200块钱一个月,有刚需的可以试试。

从网页抓取到整理资料再到生成文档,Agent工作流是多步的
实测体验:能用,但没那么丝滑
跑通配置之后,我拿DeepSeek + Codex做了两个实际任务,看看第三方模型跟Codex结合会不会水土不服。
第一个任务:全网搜雷科技的资料,结合官网、文章、展会报道,做一份商务招商文档,输出Markdown。
这个任务看起来像写稿,其实考了好几个Agent能力点:
• 找不到搜索工具的时候要会换策略
• 拿到网页后要能提取有用信息
• 信息不能堆在一起,要按结构重新组织
• 最后还要写成本地文件
DeepSeek一开始内置的网页搜索工具不可用,搜索能力也不顺畅。但有意思的是,它直接换了个方式——从本地终端直接抓雷科技官网的一手页面,首页、关于我们、联系我们、历史专题、MWC26专题、AWE2026专题,抓了一大堆。
最后生成了一份320行的Markdown文档,品牌定位、媒体矩阵、用户画像、内容栏目、核心数据、展会报道能力、视频化分发、商务合作模式、合作案例、联系方式,该有的都有了。
虽然页面糙了点,但能用。

从文档到PPT,AI直接生成可交付的HTML文件
第二个任务更进一步:读取上一步生成的招商文档,做一份雷科技2026年度招商报告PPT,输出HTML格式。
这一步考的是连续任务能力。第一步是从网页到Markdown,第二步就是从已有文档到结构化展示。模型得理解上一步文件里的9个章节,再改造成10页slide。
最后输出的是一个单文件HTML,约790行,接近40KB。里面有暗色科技风主题、蓝紫强调色、滚动触发动画、右侧圆点导航、键盘上下翻页、响应式布局,还支持打印导出PDF。
你说它是精修设计稿吧,肯定算不上。但它是一个可打开、可预览、可继续修改的交付物。作为初稿来说,完全够用。
总的来说,DeepSeek在这组轻量任务里是能用的。强项很明显:资料整理快,长文档组织能力不错,遇到工具不可用时会尝试绕路,生成Markdown和HTML这类文本型文件比较顺。
对于"写一份介绍""整理一份资料""根据文档生成展示页"这类任务,它已经可以承担初稿生产了。

两个任务才花7毛多,性价比是真的高
便宜是真便宜,慢也是真慢
但体验上,它还不像官方模型那么成熟。
Codex + GPT 5.5是什么感觉?所有能力都在同一个生态里,模型、工具调用、上下文、视觉能力,一路畅通。但DeepSeek在Codex里跑的链路很长,中间还经过一层转接桥,速度自然比不上"官配"组合。
简单说就是:简单文本和资料整理任务,慢归慢但还能用,但确实不如官方模型来得快。
尤其是进入Codex这种Agent工作流之后,它不是一次性回答完就完事了,要一边调用工具,一边等结果,一边继续推理。链路多了一层本地翻译,工具调用还要来回跑,速度体感上确实会慢一些。
但有一点是真的香——价格。
说出来你可能不信:我给DeepSeek账户充了10块钱,跑完这两个任务,中间还夹着几轮聊天和调试,最后余额还剩9.27元。
也就是说,这一整轮实测,实际只花了7毛多。
DeepSeek真不愧是性价比之王。如果全都是这类型的任务,那确实可以把ChatGPT Plus每月20美元的订阅费给省下来了。

对国产模型来说,这是一次进入成熟工作台的机会
真正赢麻的,可能是国产模型
体验下来我觉得,对于普通用户来说,Codex能不能搞第三方模型,意义其实没那么大。想要简单丝滑的体验,开个Plus会员性价比也不低,毕竟还跟ChatGPT打包在一起。
真正有利的,是那些开源模型,尤其是国产模型。
你想啊,过去国产模型想进入开发者的真实工作流,得自己做多少产品层的东西?发布API只是第一步,后面还有IDE插件、命令行工具、文件权限、工具调用、项目上下文、任务记忆、错误恢复、协作界面、审阅流程……这些都不是模型论文能解决的。
但Codex这类工具的价值是什么?它把工作台先搭好了。它负责和本地文件系统交互,负责执行命令,负责展示工具调用,负责把任务拆成多轮,负责让模型在上下文里持续工作。
第三方模型一旦能接进去,就相当于直接获得了一个成熟的Agent容器。
这对智谱、DeepSeek、Qwen、Kimi们都是机会。
比如智谱,最近上线的GLM-5.2,直接强调1M无损上下文、长程任务能力提升,Coding和长程任务评测达到开源SOTA,复杂系统工程、深度调试里表现更稳。这几天开发者圈对这个模型评价很高,很多人夸它在代码任务和长程Agent场景里性能强。
更有意思的是,智谱的GLM Coding Plan都开始变成稀缺资源了,太火爆抢不到。这其实已经说明,国产模型的竞争不再只是发布一个强模型,而是开始围绕Coding Plan、开发工具接入、Agent工作流额度和真实工程体验展开。
当然,智谱也不是没有自己的Agent工具,人家也在做类似Codex的图形化工作台。但自建工作台和接入Codex这类成熟工作台,并不冲突。自家工具适合展示完整能力和打磨闭环体验;接入Codex,则更像进入一个已经被大量开发者熟悉的工作环境。
用户原本就在Codex里写代码、跑命令、读项目、交付文件,如果国产模型能出现在同一个任务流里,被使用和被比较的机会都会变多。
消息出来之后,智谱的股价一路飙升,盘中一度大涨超22%,股价突破2000港元,市值也站上新高。这已经很能说明问题了。

OpenAI的算盘:模型可以换,但工作台标准还是我定
OpenAI的算盘:开放,但标准还是我定
不过话说回来,OpenAI也不是慈善家。Codex开放provider,不代表OpenAI放弃了控制权。
恰恰相反,工作台标准仍然由它定义。Responses API、模型配置、官方推荐模型、工具调用协议、权限机制,这些关键环节还是围绕OpenAI的体系展开。
OpenAI想要的局面,可能是让Codex成为更通用的AI工作台。官方模型负责最强能力和最佳体验,第三方模型负责扩展场景、降低成本、覆盖更多供应商需求。
用户可以有选择,但选择发生在OpenAI定义的工作台里。这肯定比单纯封闭更聪明。
说到底,这是个双赢的局面:
• 对OpenAI来说,能把Codex往平台方向推,将来有可能成为一家独大的AI工作台
• 对国产和开源模型来说,终于有机会进入一个成熟工作台,而不是只待在自己的Agent里

门开了一条缝,但要真正走进去,还得自己搭桥
最后说几句
但我还是得说一句:目前来说,OpenAI开放得还不够,远远不够。
现在的状态更像是:门开了一条缝,你能看到里面的光,但要真正走进去,还得自己搭个桥、翻个墙。
对于普通用户来说,现在还远远不到"扔掉Plus订阅"的时候。官方模型的体验优势还是很明显的。
但对于整个行业来说,这扇门一旦打开,就再也关不上了。
当Codex成为AI工作台的事实标准,当越来越多的模型能接入同一个工作流,当用户可以在同一个环境里自由切换不同模型……那时候,真正的竞争才刚刚开始。
比的就不再是谁的模型参数更大,而是谁的工作台更好用、谁的生态更开放、谁能让开发者更高效地干活。
从这个角度看,OpenAI今天打开的这扇门,可能比它想象的还要大。
关注公众号「凌域黑科技」
后台回复「6666」获取每日更新资源
帮忙点击右下角【点赞+在看】支持下小凌
夜雨聆风