ARTICLE · 1084489
号称单集群调度十亿任务的开源顶流,翻开源码核心功能只建了空目录
如果你在开源社区里看到一个项目,主页上用加粗大字写着「单集群调度十亿级任务」,背后站着全球顶级科技巨头,几天内引来上万人点亮小星星,你会觉得这是一个划时代的基础设施,还是一个匆忙搭出来的舞台布景?
很多技术人都在今年九月经历了这场过山车。当时,一款名为 AX 的系统在技术论坛上迅速登顶,四天内收获了超过九千颗星,短短五天内关注度近乎翻倍。官方博客给它冠上了极其诱人的光环,声称要成为自主智能体时代的全新底座,把长任务中断、工具调用混乱和云资源浪费一次性解决。然而,仅仅过了三天,就有较真的工程师把源码拉到本地逐行翻看。结果让人哭笑不得:宣传里那些天花板级别的核心能力,在代码库里要么是完全没被调用的空函数,要么直接停留在创建空文件夹的层面上。

开源项目主页上宏大的架构图与实测代码细节形成的强烈对比
一、为什么传统的容器技术装不下这群新员工?
要看懂这场戏剧性的反转,得先搞清楚工程师们为什么会对它如此饥渴。说白了,大家苦于旧架构太久了。
在过去很长一段时间里,我们在云端运行程序,要么是跑一个常年不关机的网站后台,要么是丢过去一个批处理任务,算完就关门走人。可如今的自主智能体完全是另一套物种:它更像是一个在工位上随时待命的数字员工。它执行一个任务可能要花上几个小时甚至几天,但大部分时间它并不是在埋头苦干,而是在原地干等。它在等远程大模型返回一句话,等外部软件吐出一条数据,或者干脆在等屏幕前的人类点一下「确认」。
问题就出在这儿。如果你给每个数字员工都分配一个独立的传统云计算容器,这就像为了让一个偶尔接电话的接线员待命,整天把办公室的空调、大灯和专用发电机全天候开着。这种做法不仅极其烧钱,而且系统底层的状态管理器也根本吃不消。传统集群里用来记录状态的核心账本,设计之初是为了管好几千个长期运行的稳定服务,它的物理存储上限只有个位数,每一笔变动都要全员同步确认。要是强行把成百上千万个频繁冒头、极度短命的智能体任务塞进账本,这个系统的心脏很快就会被彻底压垮。
许多开发者都尝过这个苦头。用现有的流行框架跑点小实验还行,一旦放到企业环境里跑上几个小时,常常会因为断线、状态丢失或者成本失控直接崩溃。AX 就在这个痛点上给出了极具吸引力的答案:它声称要把智能体当成可以随时冻结的有状态角色来对待。数字员工空闲时,系统就像把电脑休眠一样,把它的内存和本地文件直接打包存进云端存储,腾出宝贵的计算算力;等外部消息一来,系统能在半秒之内把它重新唤醒,原地复活接着干活。
官方给出的这套愿景几乎踩中了所有痛点。它给出了任务、工作区、网络出口安全网关以及模型配置这四大声明,甚至把命令行工具刻意做成了大家最熟悉的系统管理工具形状,不仅能随时暂停、恢复,还能直接登录进沙箱看看数字员工在搞什么名堂。这一切听起来就像是天降甘霖。
二、说好的人体工学,怎么门槛比天还高?
然而,当兴奋的开发者们涌入主页,准备按照指引把这套神器跑起来时,迎面撞上的却是一堵厚重的高墙。
宣传页面上满口承诺着贴合开发者的「人体工学工作流」,但点开上手指引的第一屏,大部分人都愣住了。这套系统根本不像普通工具那样点开即用。在跑通第一个任务之前,你必须先自己备好一套完备的集群调度系统、特定版本的底层镜像构建器、专门的容器镜像仓库,以及一个此前极少有人听说的底层算力底座服务。
这就好比一家餐厅在招牌上大写着「三分钟享用极致美味」,等你坐进店里,服务员却微笑着递给你一张清单:请先自己去后厨砌好灶台、接通工业级天然气管道,顺便把营业执照办下来。

开发者面对复杂的先决条件清单与极简宣传口号时的困惑场景
技术社区里瞬间炸开了锅。支持底层基建的工程师在极力辩护,认为面对未来千万级的超大工作量,就必须依赖深层的基础设施来进行内核级别的安全沙箱隔离;但更多的开发者则感到了一种被营销话术愚弄的荒谬。有人直接在论坛上留下一句辛辣的吐槽:想要让智能体基础设施变得简单易用,和必须重度依赖这套繁琐的集群架构,这两件事你只能二选一。
争议迅速演变成了怀疑。既然上手门槛如此古怪,那么那句宣称在单集群里调度「十亿级」任务的宏伟口号,背后到底撑起了一套怎样的精密机器?
三、敲开外壳,里面居然全是空箱子?
带着这种好奇,有资深工程师在本地搭建好了全部开发环境,拉取了全部源代码,准备来一场彻底的开箱验货。然而,当厚重的技术说明书被掀开后,露出的真相让所有人倒吸一口凉气。
首先,这套被吹上神坛的全新架构,生命周期其实只有几天。在正式公开引爆社区的前一天,项目的核心工程师刚刚提交了一次破坏性极大的重构,一次性改动了一百五十多个文件,删除了将近两万行代码,其中包括二十多个测试文件和四千六百多行测试用例。在这个所谓的全新版本里,核心的主控制程序测试覆盖率竟然是零,专门负责对接缓存存储和底座服务的关键模块测试覆盖率同样是零。整个项目完全处于极早期的实验阶段,甚至在代码仓库里一度挂出了暂停接受外部提交修改的警告牌。
更让人哭笑不得的是对外部工具服务器协议的支持。在官方的宏伟蓝图中,系统最大的卖点之一就是能在沙箱启动前预先装配好各种工具组件,随时挂接外部技能包。在示例配置清单里,这部分被写得煞有介事。但翻开代码一看,真正负责环境装配的核心逻辑里,除了去网上拉取代码仓库之外,处理外部技能包的代码其实只有极其简单的三行指令:仅仅是在本地硬盘上根据路径建立了一个空目录。
也就是说,在整个代码库里,除了测试用例以外,根本没有任何一行实际代码去读取并消费这些工具配置。系统启动之后,留在隔离沙箱里的不过是一个空荡荡的文件夹。至于官方文档里大肆宣传的、利用先进大模型自动分析环境并生成装配计划的高级规划模块,在整个系统里压根就没有任何一处地方去调用它。它就像是一个摆在展厅中央精美绝伦的机械手臂,插头却根本没插在插座上。
安全防线上的发现则更令人心惊。作为一个面向不可信代码运行的调度底座,官方一直把网络出口白名单当做核心卖点,承诺会严格限制智能体能访问的外部域名。但在实际实现中,这层安全围栏只在角色刚建立的一瞬间被应用一次。不仅没有持续校准机制,系统在更新策略时甚至根本不会向控制器发出通知。如果在运行过程中想要收紧策略,新规则根本不会生效,除非你把整个任务彻底销毁并丢失所有进度。更离谱的是,一旦用户没有显式去定义网关,系统默认的行为是对外完全放行,放任沙箱随意连接任何端口。
而那套承载着「十亿级任务」野心的控制核心,在部署脚本里赫然配置着一个单点运行、没有挂载任何外部持久化硬盘、内存上限仅有一吉字节的内存数据库。只要这个单一服务发生重启,此前记录的所有智能体持久状态都会在一瞬间化为乌有。

被拆解的软件核心部件,空置的代码逻辑与未接通的控制线
这场轩然大波最终把行业里的一层窗户纸捅破了。所谓的全新编排器,在当下不过是一层套着流行命令行外壳的概念试验品,它把真正沉重、未完工的脏活累活,全甩给了还在极早期测试阶段的底层系统。
巨头们急于在自主智能体这块尚未定型的荒原上插上自己的旗帜,抢先定义下一代运行时的行业标准。然而,技术的演进从来不吃概念包装这一套。当上万名开发者被宏大叙事吸引而来,最终在源码里撞见那个建完空文件夹就收工的函数时,这种急于求成的焦灼,反而成了整个行业浮躁期最清晰的一记注脚。