夜雨聆风学习资料网

ARTICLE · 1153954

几百份文档交给 AI,分工之后还得查漏项

几百份文档交给 AI,分工之后还得查漏项

现·PRISM

后台任务显示完成时,最该问的一句是:交进去的材料,究竟覆盖了多少。

批量任务有了新的托管入口

Claude Platform 的 10 月 9 日更新,把动态工作流带进 Managed Agents 的 beta 功能。代理可以编写程序,分阶段运行多个代理,再把结果合起来,由服务器在后台执行。这里的新增点,是这项托管能力的开放,不是多代理分工第一次出现。

对有大量材料要处理的团队,机会很具体:彼此独立的初筛可以同时推进,汇总者接着处理结果。但并行把等待压短的同时,也把一份任务变成了许多份需要核对的交付。

先数清哪些材料没有被读完

官方工作流文档有个容易忽略的限定:completed 表示运行结束,子任务仍可能失败,甚至没有成功创建。各代理消耗的 token 也照常计费,达到会话预算时,运行可能暂停。

设想让系统检查一百份产品说明书,找出保修期限写法不同的地方。最后返回十个问题,至少有两种解释:其余材料都没有问题,或者有些材料根本没有读完。只看汇总页上的十条结论,无法把两种情况分开。

因此,交付时应附上一份覆盖清单:每份材料有没有读取成功,依据在哪一页,结果是有问题、未发现问题,还是无法判断。无法判断的材料要留在清单里。数量少、排版整齐的最终答案,不能成为隐藏缺项的理由。

解释图|建议的验收流程。completed 不保证子任务全部成功;功能仍为 beta,使用会产生相应成本。

让复核跟着风险走

分工前还应约定同一套口径。“没有写保修期”和“保修期互相矛盾”应分别记录,否则不同代理各自理解,汇总时可能把不同的问题装进同一个标签。可以先拿几份材料试跑,核对分类,再扩大范围。

复核也需要覆盖“未发现问题”的部分。如果只重看已经被标红的文件,第一轮漏掉的内容就很难重新进入视野。抽查比例可以随风险调整,涉及重要承诺的原文仍应由负责的人确认。多一轮复核也需要检验效果,不能默认第二个模型更可靠。

预算则适合按一批合格结果来算:初筛花了多少,失败重试花了多少,最后留下多少人工工作。多开代理未必等比例省时间。对这项 beta 能力,值得先试的是一批可检查、可重跑的材料,把漏项与成本测清,再决定让它接多大的任务。

资料来源

[PRISM-WORKFLOW-S01] Claude Platform|Release notes,October 9, 2026|2026-10-09

[PRISM-WORKFLOW-S02] Claude Platform|Workflow runs|动态技术文档,2026-10-10核验

相关学习资料