乐于分享
好东西不私藏

Prime Agent:会自己进化的AI编程助手来了

Prime Agent:会自己进化的AI编程助手来了

Prime Intellect开源的Prime Agent,让AI编程助手能自我改进、自主编排多智能体,代码能力大幅提升

AI编程助手又要进化了!

最近,Prime Intellect 团队放出一个重磅开源项目——Prime Agent,它不是那种"你问一句它答一句"的传统AI助手,而是一个会自己学习、自己改进的智能编程体。用他们的话说:"现在的AI工具栏该升级了。"

传统AI助手的问题在哪?

用过 ChatGPT、Claude 写代码的人都知道,这些工具虽然强,但有个通病:每次对话都是全新的开始。它记不住你上次的项目结构,理解不了你的编码习惯,更不会因为之前的失败而"长记性"。

Prime Agent 的设计团队一针见血地指出:现有的AI工具框架,是为上一代模型能力设计的。固定的工具调用格式、手写的提示词、一成不变的子代理——这些"脚手架"反而限制了AI发挥真正的潜力。

两大杀手锏

Prime Agent 的核心可以用两个词概括:

1. RLM:递归语言模型

想象AI有一个永远不关机的Python控制台。在这个控制台上,AI可以把整个对话历史当成变量来操作,可以随时"召唤"子代理去并行处理任务,还能把结果汇总回来继续干主活儿。

更妙的是,RLM 支持持久化状态。即使对话窗口满了被压缩,AI依然能通过代码访问完整的历史记录——就像人类程序员会把重要信息记在笔记本上一样。

2. Continual Harness:持续进化框架

这是 Prime Agent 最酷的地方:它能改自己

具体来说,Prime Agent 把自己的"大脑"分成四块——提示词、子代理、技能、记忆。运行过程中,它会分析自己哪些地方做得好、哪些地方搞砸了,然后自动更新这四块内容。

比如,它发现某个测试总是跑不过,就会给自己写一条新记忆:"遇到这种flaky test,先重试3次再报错"。甚至还能把这个经验升级成一个可复用的技能,下次遇到类似情况直接调用。

这套自改进机制有个专门的名字叫 /refine,完全自动化,不需要人插手。

多智能体协同作战

Prime Agent 不仅能自己干活,还能召唤队友

比如你在审查一个大型代码库,它可以同时派出两个子代理:一个专门分析认证模块,一个专门检查API层。两个子代理各自为战,完成后把结果汇报给主代理汇总。更夸张的是,这些子代理是持久化的——即使主代理关掉了,下次还能找到它们继续聊。

不同 Prime Agent 实例之间也能直接通信,组成一个分布式智能网络。

自主模式:无人值守也能干活

Prime Agent 还有一个"肝帝模式"——给它设定一个目标(比如"把这个bug修了并跑通测试"),它就能自动连续工作,遇到困难自己想办法,直到完成任务或者达到预设的资源上限(token数、回合数、时间)。

这对于自动化测试、持续集成等场景简直是神器。

性能怎么样?

在 ARC-AGI 3 这个著名的AI推理基准测试中,Prime Agent 表现亮眼。更关键的是,目前没有任何模型是专门针对 Prime Agent 的架构训练出来的——换句话说,这还只是"通用选手"的成绩,等模型专门为它优化后,表现还会更强。

开源!免费!立即可用

Prime Agent 已经完全开源,安装只需要一行命令:

curl -fsSL https://app.primeintellect.ai/prime-agent/install.sh | sh

它支持接入主流的大模型(OpenAI、Claude、开源模型等),你可以把它当成日常编程助手,也可以拿它做自动化评估、科研实验。

总结一下

Prime Agent 给AI编程助手带来了三个重要升级:

  • 持久化上下文:不再"金鱼记忆",能长期保持工作状态
  • 自我进化:能从自己的错误中学习,越用越聪明
  • 多智能体协作:能像团队一样分工合作处理复杂任务

如果说传统AI助手是"一把螺丝刀",那 Prime Agent 就是"一个能自己升级工具箱的机器人"。对于程序员来说,这无疑是效率提升的利器。

项目地址:https://github.com/PrimeIntellect-ai/prime-agent[1]


你对这种"会进化的AI助手"怎么看?欢迎在评论区聊聊!

引用链接

[1]https://github.com/PrimeIntellect-ai/prime-agent