Prime Intellect开源的Prime Agent,让AI编程助手能自我改进、自主编排多智能体,代码能力大幅提升

AI编程助手又要进化了!
最近,Prime Intellect 团队放出一个重磅开源项目——Prime Agent,它不是那种"你问一句它答一句"的传统AI助手,而是一个会自己学习、自己改进的智能编程体。用他们的话说:"现在的AI工具栏该升级了。"
传统AI助手的问题在哪?
用过 ChatGPT、Claude 写代码的人都知道,这些工具虽然强,但有个通病:每次对话都是全新的开始。它记不住你上次的项目结构,理解不了你的编码习惯,更不会因为之前的失败而"长记性"。
Prime Agent 的设计团队一针见血地指出:现有的AI工具框架,是为上一代模型能力设计的。固定的工具调用格式、手写的提示词、一成不变的子代理——这些"脚手架"反而限制了AI发挥真正的潜力。
两大杀手锏
Prime Agent 的核心可以用两个词概括:
1. RLM:递归语言模型
想象AI有一个永远不关机的Python控制台。在这个控制台上,AI可以把整个对话历史当成变量来操作,可以随时"召唤"子代理去并行处理任务,还能把结果汇总回来继续干主活儿。
更妙的是,RLM 支持持久化状态。即使对话窗口满了被压缩,AI依然能通过代码访问完整的历史记录——就像人类程序员会把重要信息记在笔记本上一样。
2. Continual Harness:持续进化框架
这是 Prime Agent 最酷的地方:它能改自己。
具体来说,Prime Agent 把自己的"大脑"分成四块——提示词、子代理、技能、记忆。运行过程中,它会分析自己哪些地方做得好、哪些地方搞砸了,然后自动更新这四块内容。
比如,它发现某个测试总是跑不过,就会给自己写一条新记忆:"遇到这种flaky test,先重试3次再报错"。甚至还能把这个经验升级成一个可复用的技能,下次遇到类似情况直接调用。
这套自改进机制有个专门的名字叫 /refine,完全自动化,不需要人插手。
多智能体协同作战
Prime Agent 不仅能自己干活,还能召唤队友。
比如你在审查一个大型代码库,它可以同时派出两个子代理:一个专门分析认证模块,一个专门检查API层。两个子代理各自为战,完成后把结果汇报给主代理汇总。更夸张的是,这些子代理是持久化的——即使主代理关掉了,下次还能找到它们继续聊。
不同 Prime Agent 实例之间也能直接通信,组成一个分布式智能网络。
自主模式:无人值守也能干活
Prime Agent 还有一个"肝帝模式"——给它设定一个目标(比如"把这个bug修了并跑通测试"),它就能自动连续工作,遇到困难自己想办法,直到完成任务或者达到预设的资源上限(token数、回合数、时间)。
这对于自动化测试、持续集成等场景简直是神器。
性能怎么样?
在 ARC-AGI 3 这个著名的AI推理基准测试中,Prime Agent 表现亮眼。更关键的是,目前没有任何模型是专门针对 Prime Agent 的架构训练出来的——换句话说,这还只是"通用选手"的成绩,等模型专门为它优化后,表现还会更强。
开源!免费!立即可用
Prime Agent 已经完全开源,安装只需要一行命令:
curl -fsSL https://app.primeintellect.ai/prime-agent/install.sh | sh
它支持接入主流的大模型(OpenAI、Claude、开源模型等),你可以把它当成日常编程助手,也可以拿它做自动化评估、科研实验。
总结一下
Prime Agent 给AI编程助手带来了三个重要升级:
持久化上下文:不再"金鱼记忆",能长期保持工作状态 自我进化:能从自己的错误中学习,越用越聪明 多智能体协作:能像团队一样分工合作处理复杂任务
如果说传统AI助手是"一把螺丝刀",那 Prime Agent 就是"一个能自己升级工具箱的机器人"。对于程序员来说,这无疑是效率提升的利器。
项目地址:https://github.com/PrimeIntellect-ai/prime-agent[1]
你对这种"会进化的AI助手"怎么看?欢迎在评论区聊聊!
引用链接
[1]https://github.com/PrimeIntellect-ai/prime-agent
夜雨聆风