ARTICLE · 1030646
故事评分提高了,创意却彼此靠近:一项AI写作实验把团队的选择空间摆上桌

创作机制 · 方案差异
核心判断:创意管理需要同时照顾单份质量与整组选项的差异。
独立构思选项差异受众判断创意评审
评审桌上摆着几份完成度很高的方案,措辞流畅,结构完整,连转折都很自然。讨论一圈却发现,它们回答的是同一个问题,也默认了同一种顾客。这是一个常见的创作管理难题:单份方案都不错,整组却未必提供了足够多的选择。
2024年,埃克塞特大学与伦敦大学学院研究者发表一项短篇故事实验。获得人工智能创意提示的作者,作品评价有所改善,同时故事之间也更相似。[1]这一发现不能代表所有创意行业,却提醒团队留意作品组合这个经常被忽略的评估对象。

两面
一、作品更容易被喜欢,与作品更彼此接近并不矛盾
大学对研究的介绍显示,参与者需要写八句话的短故事,被分到不用人工智能、可获得一个创意提示、最多获得五个提示等条件中,再由另一组人评价作品。实验观察的是限定任务里的创意起点,不是整个出版或广告项目的商业表现。
研究所说的质量改善和相似性增加,描述的是两个层次。一个故事可以更有吸引力,同时与其他故事共享更多元素。个体分数上升,不会自动带来集体探索范围扩大。如果只逐篇打分,就容易把这两种变化混为一谈。以下是由研究引出的编辑分析。
企业通常需要一组方向供取舍,例如服务不同人群、回应不同障碍或试探不同场景。方案数量只有在代表不同可能性时才有意义。十份沿着同一条路走得更远的提案,仍可能遗漏另一条更合适的路。负责人必须看见方案之间的关系。

起点
二、第一份流畅答案,容易提前规定后面的讨论范围
当团队没有形成自己的初步想法,先看到一份完整建议时,讨论很容易围绕修改它展开。大家会补例子、换标题、调整语气,却不再追问最初的问题是否设对。这种起点依赖是理解选项收窄的一条可能路径,不应被说成每次使用工具的必然结果。
设想一家家居服务团队为新业务构思传播方案,这是本文的说明场景。若所有人都从便利开始写,评审桌上就会出现多种省事表述,而住户对信任、空间限制或售后照顾的担心可能仍然缺席。表述差异不能替代问题差异。此时再让工具继续生成更多版本,未必能改变前提。
团队需要明确允许谁提出另一种问题,哪些观察足以支持它,以及新的方向准备验证什么。重新打开选择空间,需要改变输入的观察和限制。数量扩张只能在这个基础上发挥作用。一线人员观察到的意外和抱怨,可以成为重新定义题目的重要材料。

独立
三、给成员一段不共享答案的构思时间
一种可试行的办法,是在展示模型建议之前,让成员分别留下自己的顾客观察和初步方向。时间不必很长,材料也不用精致;关键在于留下未经同一份答案校准的独立起点。这是一项流程建议,效果需要团队自己验证。
随后再让工具帮助补充反例、寻找遗漏、推演不同使用情境。每位成员带着自己的素材进入互动,就更容易看清哪些是新发现,哪些只是原句的扩写。保留原始草稿,有助于识别思路究竟增加了什么。不必要求工具承担整个创意来源。
如果资源有限,可给不同成员分配不同观察任务:有人看首次购买,有人看长期使用,有人看主动放弃。不同证据入口比更换几种文风更能支撑真实差异。分工仍应允许交叉质疑,避免把每个人锁在预设的顾客想象里。在分享阶段还可逐条说明哪些判断来自观察,哪些只是尚待检验的猜想。

比较
四、评审桌上增加一张差异表
评审时可以先隐去作者和工具使用情况,逐份判断是否清楚、是否有依据、是否适合受众,再把方案放到一起比较。第二轮的对象是选择空间:这组提案覆盖了哪些需要,又在哪些地方重复投入。两轮评分服务不同决策。
一张简单表格就够用,每个方向写明目标人群、待解决障碍、主张和验证办法。若几行只有形容词不同,就需要合并;若某行提出不同问题却证据薄弱,则应补充观察。差异必须有业务意义,不能只靠奇特取名。也要防止为了新颖而保留明显不合适的方案。
研究中的故事相似性指标不能直接变成商业团队的淘汰规则。读起来不像,不等于值得投入。可执行性与需求依据仍是基本门槛,差异分析是在合格方案之间帮助团队理解选择。尤其应保留顾客语言与内部解释的区别,防止精致表达掩盖证据薄弱。
删掉相似选项,还剩几条路?

验证
五、让被保留的方向面对不同的真实问题
沿用家居服务的说明场景,团队可以选择两个有不同顾客依据的方向,用小规模访谈或服务试演检查。一个方向关注预约便利,另一个关注陌生人员入户的顾虑。验证问题应随方向变化,不能只比较两版宣传语谁更顺口。
记录时保留顾客为什么接受、为什么犹豫,以及提案里的哪些假设被改变。有用的反馈应当能推动方向取舍。如果两套方案最终解决的是同一类问题,就合并资源;若确实对应不同人群,再讨论是否需要不同服务入口。若没有得到支持,也可以结束这个方向,并保存当初为什么值得尝试的理由。
复盘也可查看在限定时间内形成了多少有依据的方向、淘汰了哪些重复、发现了哪些此前没有注意的顾虑。创作效率可以按有效探索来衡量。纯粹统计生成了多少页,会奖励文字产量,却未必帮助企业更快找到值得执行的选择。
余地
六、给不够漂亮的新方向一点生长时间
成熟表达往往在第一轮更容易得分,尚未整理好的现场观察则显得零散。负责人可以在基本可行的前提下,为少数不同方向保留有限的探索额度,让它们获得补证据的机会,再决定是否继续。额度要明确,也要有停止条件。
没有获得资源的方向也不必立即删除,可以注明暂缓原因,供条件变化时重新查看。这并不要求每次都追求颠覆。常规通知和标准说明可能更重视一致性,而新品定位与业务探索可能更需要分歧。
不同创作任务,应有不同的多样性要求。管理者需要说明此刻是在统一表达,还是在寻找新的可能性。让目标在动笔前清楚可见,成员才知道该在哪些地方保持一致,在哪些地方尝试不同。
人工智能能帮助很多人越过空白页,但团队仍要决定从哪些地方开始、保留哪些差别。把独立观察带回创作过程,再用清楚的标准筛选,才能让更快成形的作品,真正变成更丰富、也更经得起讨论的经营选择。
资料来源与口径
埃克塞特大学:AI改善个人创作,同时降低作品多样性(2024-07-15):研究任务为八句话的短故事;本文的团队构思和评审方法为编辑建议,不是该实验已经验证的干预。

编辑:丁帆
审核:董晓龙
本文章由烁域科技原创出品,版权归属烁域科技所有。部分图片为原创配图资产,如有版权问题,请联系公众号客服。
