乐于分享
好东西不私藏

OpenAI被曝在做“生物科研版Codex”下载页!药物发现杀入10年无人区,学术圈追问开放范围

OpenAI被曝在做“生物科研版Codex”下载页!药物发现杀入10年无人区,学术圈追问开放范围

一张黑底白字的截图,开始在生命科学圈子里流传。

页面上只有三行字:Download Rosalind Codex,副标题写着 Get the Codex app configured for GPT-Rosalind,底下一颗圆角按钮,Download for macOS这次没有配套新闻发布会或官方博客,Sam Altman的账号也未提及。看到这张图的人随即猜测:OpenAI正在把它最强的生命科学AI,从“候补名单”里放出来。

▲ AI信息账号TestingCatalog曝光的下载页界面,黑底、白字、macOS下载按钮,产品形态已经非常明确

四个月前的伏笔:一个以“被亏欠的女科学家”命名的模型

故事要从2026年4月16日讲起。

那天OpenAI做了一件前所未有的事:发布了一个只服务生命科学的前沿推理模型,命名为GPT-Rosalind名字致敬Rosalind Franklin,那位拍出DNA X射线衍射照片、却在诺贝尔奖颁发前英年早逝的结晶学家。她的贡献被遮蔽了几十年,如今被一家万亿估值公司拿来做商标。

Kevin Weil在个人账号写下长帖,语气罕见地像在写学术申请书,少了产品发布腔:

模型在化学、蛋白质工程、基因组学等方面有专门训练,并内置对研究者常用数据库与工具的知识。

▲ Kevin Weil的原帖:同时宣布Life Sciences插件当天对所有Codex用户开放

但关键信息藏在最后一句:trusted access deployment structure for qualified customers翻译成人话就是,你得过审才能用

“合格客户”名单上的名字,让人倒吸一口凉气

第一批拿到GPT-Rosalind的机构包括:Amgen(全球最大独立生物技术公司之一)、Moderna(mRNA疫苗巨头)、Allen Institute(保罗·艾伦遗产级脑科学研究所)、Thermo Fisher Scientific(实验室设备与试剂巨头)、SanofiLos Alamos国家实验室……

▲ 产品页底部的客户logo墙,汇集了全球制药工业的核心玩家

这份名单传递出清晰的目标:OpenAI瞄准了一颗新药从靶点发现到临床试验的整条链路,远远超出“帮博士生查文献的chatbot”范畴。官方博客里有一个数字被反复引用,美国一颗新药从靶点发现到获批,平均需要10到15年

GPT-Rosalind要切的,就是这10年里最前端、信息最碎片化、假设生成最依赖人脑直觉的那一段。

模型之外:50个技能包组成的科研工具箱

很多人忽略了4月16日同一天还发生了另一件事:OpenAI在GitHub上开源了Life Sciences Research Plugin,一口气塞进了超过50个技能模块

▲ GitHub上的插件目录结构:skills文件夹里装着从AlphaFold到PubMed的全套连接器

这些技能覆盖的范围令人咋舌:

  • 人类遗传学
    :Open Targets、GWAS Catalog、ClinVar、gnomAD
  • 蛋白质与结构
    :AlphaFold、RCSB PDB、UniProt、STRING
  • 化学与药理
    :ChEMBL、PubChem、BindingDB
  • 临床转化
    :ClinicalTrials.gov、cBioPortal
  • 文献挖掘
    :NCBI Entrez、PubMed、bioRxiv

而最精妙的设计在于:这套插件不绑定GPT-Rosalind普通Codex用户用主线模型也能调用。R&D World的记者当天就实测成功,没有Rosalind权限,照样在十几分钟内拉出了AlphaFold蛋白质3D结构图和PubMed证据时间线。

这是一个极其聪明的产品策略:模型是城堡,插件是护城河。你可以免费用护城河里的水浇花,但想进城堡?请排队、请审核、请证明用途符合安全要求。

正门开放,侧门关闭:一场静悄悄的“访问架构重组”

到了7月末,一件诡异的事情发生了

OpenAI开发者社区开始涌现抱怨帖:普通ChatGPT和Codex用户发现,连基本的生物信息学代码调试、论文搜索都开始被安全策略拦截了系统弹出的提示大意是:此内容涉及可能有安全风险的生物研究应用,合格研究者请申请Trusted Access。

这与一项产品设计相符

通用产品面上的生物能力被有意收紧,而专用的Rosalind通道被有意产品化侧门关了,正门亮了招牌对OpenAI来说,这是安全治理与商业化的一体两面:你想做计算生物学?请走正门,请接受审查,请在我们的治理框架里工作。

8月的下载页:从“审批制”到“可下载”的惊险一跃

于是我们回到文章开头的那张截图

TestingCatalog的解读是:This change marks a potential expansion beyond "qualified customers",这可能意味着突破“合格客户”的边界。评论区很快热闹起来有人说“药物发现需要成千上万双眼睛,候补名单远远不够”;另有人直接问:“这是否类似Claude Science?”

▲ 网友第一反应:拿它和Anthropic的Claude Science做类比

这个类比并非空穴来风就在6周前,Anthropic于6月30日正式推出了Claude Science,一个集成60+技能与连接器、面向分子与细胞生物学的AI工作台。两家公司的竞争,已经从“谁的聊天更会背论文”,升级为“谁的科研操作系统能跑通端到端流程”

学术界的愤怒:“我们付了钱,凭什么进不去?”

欢呼之外,也有研究者公开表达失望

学术用户Jason de Koning在OpenAI原帖下直接开怼:

This looks exciting, but it's really disappointing to see this as a closed research preview. Why not make this freely available to academic scientists already paying for pro/max subscriptions?

▲ 学术用户的典型反应:兴奋与失望并存

这代表了一个巨大的结构性矛盾:最需要前沿AI工具的独立研究者和学术实验室,恰恰是最难通过“企业级资格审查”的群体Moderna和Amgen有合规团队来填表,一个做博后的计算生物学家没有。

Rosalind Codex下载页如果真的面向更广用户开放,能否解决这个问题?未必 “可下载”不等于“无限能力”,安装器层面的产品化,和权限层面的开放,完全可以是两码事。你下载了App,登录时依然可能被要求出示受信访问凭证。

10年药物周期能被压缩多少?

Hacker News上最冷静的一条评论说得好:找靶点变快了,不等于临床试验会成功。

OpenAI 6月更新里展示了一个颇能说明产品定位的demo:让GPT-Rosalind模拟审视一份FDA Type B会议材料,从微抗肌萎缩蛋白基因治疗的证据包中挑出数据缺口与监管风险。由此浮现的用户画像,是会坐在FDA对面开会的工业科研团队,工作远远超出宿舍里的文献查询。

▲ 6月更新强调“grounded in real scientific workflows”,锚定真实科研工作流

在与Dyno Therapeutics的合作测试中,GPT-Rosalind在RNA序列功能预测任务上的best-of-ten表现,超过了57位AI-bio领域人类专家历史成绩的约第95百分位序列生成任务约第84百分位这些数字是厂商自述,社区对方法论有质疑,但即便打个折,信号依然强烈:领域专用模型在特定科研子任务上,正在逼近甚至超越人类专家的天花板。

谁能用AI做科学

回看整条时间线,Rosalind Codex延续了一次访问权力的重新分配

模型层锁在受信审查后面;插件层开放给所有人当甜头;桌面入口层正在悄悄搭建,但最终开放程度未知。三层叠在一起,构成了一个精心设计的漏斗,先让你尝到工具的甜头,再让你为模型的深度付费(或过审)。

OpenAI和Anthropic同时建设“科研工作台”,竞争由聊天模型的参数与问答能力延伸到了实验室工位。

那张黑底白字的下载页,让这个新入口第一次有了清晰轮廓。