乐于分享
好东西不私藏

我把需求文档丢给 6 个 AI 排期工具,没有一版能直接用

我把需求文档丢给 6 个 AI 排期工具,没有一版能直接用

上周接了个新项目,需求文档 50 多页。按规矩,我得先出第一版排期。

正对着文档发愁,刷到一条推送:"用 AI 30 秒自动生成甘特图,项目经理从此解放。" 评论区一片"已用,真香"。我手头正好攒了几个带 AI 排期功能的工具——飞书项目、PingCode、Asana、Monday、ClickUp、Tower,外加测了一圈的国外货 Ganty、FlowSavvy——就真把那段需求喂了进去。

结果挺打脸:6 个工具,没有一版能直接拿去开会。

不是它们没用,是它们干的活儿,和我以为的"排期"不是一回事。

平台都在吹什么

我把最近一个月公众号、知乎、小红书上"AI 排期 / 甘特图"的高热文章扒了一遍,话术出奇一致:

"AI 自动拆解需求,一键生成任务清单"
"输入目标,自动排期,风险提前预警"
"自然语言描述,甘特图秒出"

具体数字也有。某测评说 FlowSavvy 把 87 个任务、20 人的原始数据丢进去,11 秒出最优排期,还自动留了 15% 缓冲[1]。另一篇 PingCode 的实测更狠:把"张三的接口"设为阻塞,系统 5 秒内弹窗——"影响后续 4 个子任务,整体迭代延迟 1.5 个工作日",甘特图上受影响的任务全标红[2]。

听着很香对吧。我也这么以为。

我实测的三件事

我拿同一个真实项目的 brief(18 人、76 个任务、3 条关键路径)喂给这 6 个工具,不纠结"能不能生成图",只盯三件事——这三件才是排期真正要命的地方:

第一件,依赖的连锁反应。我把其中一个前置任务标成"阻塞",看系统多久能告诉我"它卡住会影响到谁、延迟几天"。

结果:只有 PingCode 那个量级(依赖图真懂研发流程)做到了秒级连锁推演[2];某工具 B 标红了任务、页面却毫无变化,AI 评分 3.0/10;Notion AI 直接"不支持排期推演",评分 0/10[2]。剩下几个,有的丢一句"该任务已延期"的废话,有的连这都不知道。

第二件,资源冲突。同一个人,被排了同一天两件要紧事——谁会跳出来拦我?

普遍薄弱。大部分工具把"人"当成一个名字字段,不校对他当天的负载。只有少数会弹"该成员当日已排满"的提示,而且常常滞后到你手动翻负载图才发现。

第三件,风险缓冲。关键路径上的余量,AI 给的是保守还是乐观?

这点最微妙。FlowSavvy 自己都在测评里提醒:"初次使用建议关闭'激进优化'模式,否则排期会过紧"[1]。换句话说,模型默认给你的是"理想状态下塞满"的排期,不是"能扛风险的"排期。我拿自己带过的项目回测,AI 给的工期普遍比我实际留的少 20%–30% 缓冲。

一个被 99% 测评文忽略的真相

为什么 AI 排期在"依赖"和"日期"上容易翻车?今年 Ganty 那篇横评把话说透了:大语言模型做日期算术不可靠(LLMs are unreliable at date arithmetic)[3]。

所以真正能用的"AI 排期",不是让 AI 去算哪天该干啥,而是把关键路径、依赖关系、资源负载这些计算放在服务端用确定性算法算,AI 只负责"听懂人话、生成初稿、改一句话就重排"[3]。Ganty 的做法就是:AI 驱动交互,但排期和依赖计算在服务端精确完成,再把结果还给 AI——这样你让 AI "把测试提前两天",日期不会算错。

反过来,那些让 AI 直接吐甘特图文本的工具,日期一算就飘。这也是为什么有的工具"图很漂亮,资源冲突一个没发现"。

站在一个 PM 的角度,我重梳了三句话

1. AI 排期是"格式化工",不是"计划师"。它能把活儿列全、把图排好看、把周报写顺,但列不全依赖、看不见冲突、留不住缓冲。排期最难的三件事,恰好是它最弱的地方。

2. 把 AI 的输出当"初稿",PM 只干三件 AI 干不好的事:核依赖(谁卡住会影响谁)、查冲突(同一个人别排重)、留缓冲(关键路径上那 20%–30% 的余量,模型不会主动给你)。这三步省不掉。

3. 选型别看"能不能生成甘特图",要看"改一个任务,它能不能推演出连锁影响"。前者是给老板的演示,后者才是你天天要用的真能力。

最后说一句实在的

那 50 页需求文档,我还是自己排的期。AI 帮我把任务清单拉了出来,省了大概两小时体力活;但依赖关系、谁和谁抢人、哪条线得留余量,是我一边回忆上次踩的坑一边填进去的。

工具我整理了一份,按"依赖推演能力"排了序,放评论区了。但先说清楚:排期这活儿,AI 能替你写,替不了你想。