乐于分享
好东西不私藏

AI 写得不像你?别再喂旧文,先提炼 7 项风格规则

AI 写得不像你?别再喂旧文,先提炼 7 项风格规则

把旧文章交给 AI,再说一句“写得像我”,模型只能猜哪些表达值得模仿。本文用一个门店培训专员的合成案例,拆解如何清理样本、提取七项风格指纹、建立禁用边界,再用盲测与回写做出可验收的《个人风格训练表》。

“请学习这六篇文章,根据新材料写一篇,写得像我。”

很多作者都用过这条指令。六篇旧文摆在面前,自己看,每一篇都有熟悉的语气;AI 看见的,却是六组混在一起的文本。

有些短句只为强调,有些反问偶尔才用,有些表达只适合某类任务,还有些句子可能经过别人改写。

新稿因此可能出现一种很别扭的“像”:开头先谈行业变化,每段切成短句,隔几段来一次反问,结尾再升华价值。熟悉的动作都有,但组合起来不像本人。

旧文是证据,还不能直接充当规则。

你得把“这段不像我”说得更具体:违反了哪条表达习惯,证据在哪里,应该怎样改。这样,下一次生成才可能避开同类偏差。

一句话概括:喂给 AI 十篇旧文,不等于给了十条规则,很可能只是给了十种猜法。

“写得像我”,到底缺了什么

这句话没有验收条件。

AI 不知道哪些写法在多篇文章中稳定出现,哪些只用过一次;不知道短句用于收束判断,还是全篇都该短;也不知道一句口号出自作者,还是后来被编辑加上去的。

它同样不知道,你明确不会怎么写。

只有正向样本,新稿仍可能出现常见写法:宏大开场、整齐排比、绝对承诺、强行升华。要减少这类偏差,需要把个人风格整理成一份规格:有原文证据,有适用条件,有慎用和禁用项,也允许在新稿里继续修订。

先清理样本,再谈风格

下面是一个合成案例,人物与任务只用于演示方法,不代表真实采访或实际业绩。

小林是连锁生活服务企业的门店培训专员。她平时把门店问题、带教经验和操作提醒写成内部文章,供店长与新员工阅读。

这次,她要根据一页已经确认的带教记录,写《新人第一次独立接待前,店长要确认的 3 件事》。材料只支持三个动作:新人能否复述接待步骤、能否找到求助人、能否完成一次模拟接待。实际接待仍以企业现行制度为准。

她手里有八篇候选旧文:六篇是本人原创的常规文章,一篇被宣传部门大幅改写,另一篇来自外部供应商,她只做过校对。

如果八篇全部交给 AI,它学到的就不全是小林。第一步要确认文字归属,排除代笔、强编辑稿和不具代表性的特殊稿。涉及企业、员工、顾客和内部制度的信息,也要先脱敏。

小林从六篇原创稿里选五篇作为训练样本,留一篇内部复核;另外封存一篇本人原创旧文,等规则冻结后再检查。只有三篇代表作也能开始,但相应规则要标为“低证据”或“待观察”。

先确认归属、脱敏和代表性,再把原创稿分为训练样本、内部复核与盲测留出样本。

从旧文里提取七项风格指纹

AI 可以先做标注和跨文对比,作者要回到原文核对。每一项都回答五个问题:证据在哪,出现频率如何,什么情况下使用,正向规则怎么写,哪些表达要慎用或禁用。

  1. 开场方式

小林常从具体动作或一句直接判断切入。对操作提醒类文章,她确认不使用宏大背景,也不靠连续设问暖场。

  1. 句子节奏

解释时先把因果说完整,需要强调时再用一句短判断收束。短句是一种强调手段,不能铺满全文。

  1. 结构推进

常见顺序是具体问题、原因、动作、检查。确实有并列项时才编号,不为整齐硬凑“三点”。

  1. 判断语气

给结论时同步写清适用对象和材料边界。证据不足时使用“通常”“先”“在本场景下”等限定,不写“一定能”“所有人”“彻底解决”。

  1. 案例颗粒度

只保留能证明判断的角色、动作、材料和可观察结果。旧材料没有的对白、心理、损失和结果数字,一律不补。

  1. 解释习惯

抽象概念后紧跟现场动作,也会用错误做法和正确动作做对照。只换一组近义词,不算解释。

  1. 收束与行动

结尾回扣前文判断,再给读者一个当次可做的检查。不拔高到组织成长、长期主义或服务温度,也不换一种说法复述全文。

“克制、自然、专业、有温度”不能直接入表。第三方看不见这些形容词,也无法据此改句子。继续往下追问:它具体出现在哪个位置,表现为什么动作?

禁用项也不能靠猜。旧文里没出现某个词,只能说明暂时没有证据,不能推断作者永远不用。禁用规则要么来自旧文与 AI 初稿的明确对照,要么经过作者亲自确认。

检查禁用边界时,至少要覆盖五类:词语、句式、结构、语气,以及无来源的情节补写或效果承诺。每一类都要标明对照证据或人工确认来源;没有依据的,先放进“慎用”或“待观察”。

把观察写进一张训练表

指纹项
旧文证据(编号+位置)
稳定观察
正向规则
适用条件
慎用/禁用规则
反例
人工确认
盲测结果
待修订
开场方式
句子节奏
结构推进
判断语气
案例颗粒度
解释习惯
收束与行动

一条规则至少要有一处可定位证据。只出现一次的写法,标为“偶尔使用”或“待确认”,不要直接升级为稳定习惯。

规则还要写成动作。比如,把“开场自然”改成“前两段出现一个可复述的工作动作,并尽快点明要解决的问题”;把“语气克制”改成“经验判断要带适用范围,没有证据不写绝对承诺”。

配套的回写单可以保持很简单:

`日期|稿件|原句|修改后|修改理由|对应规则 ID|处理结果|确认人|表版本`

保留初稿、改稿和批注。否则过一段时间,只剩一篇看起来还不错的成稿,你依然不知道哪些规则起了作用。

风格要写成可定位、可执行、可验收的规则;没有证据的禁用项先放入慎用或待观察。

冻结一版,再做盲测

小林先让 AI 按训练表生成,再由作者核对原文和规则。样本是否属于本人、偶尔写法是否保留、什么明确禁用、稿件能否发布,都由作者决定。

训练表 v1 冻结后,先用那篇未参与提取的旧文检查:一位没参与整理的人,只看训练表,能否说明哪些表达符合规则,哪些地方无法解释?这是一次小范围检查,不代表统计学证明。

接着,把新的带教材料交给 AI。验稿时,“太 AI”“没味道”“有点生硬”只能作为起点,不能当最终修改理由。每处修改都记录原句、改后句、理由和对应规则。

能回指旧规则,就记录一次命中,必要时增加反例。无法回指的偏差先放进“待修订”;找到旧文证据或得到作者确认后,再写成新规则。

如果规则要求每篇都用同一种开头,它就写窄了。可以把“固定从工作现场开头”改成“具体动作或直接判断二选一”,再补适用条件。

第二轮仍出现已经明确禁用的偏差,就检查规则有没有放在输入里的显眼位置、写法是否可执行,并记录为传达或执行失败。不要急着宣布“AI 学会了”,也不必归结为“AI 永远学不会”。

冻结版本后再测试,能回指的记命中,无法回指的先进待修订,有证据后再升级规则。

发布前,风格要给事实让路

训练表只能检查表达,不能替代事实审查。

发布前仍要核对材料事实、现行制度、隐私、授权和读者理解。风格规则与这些边界冲突时,后者优先,同时在训练表里记录例外。

版本也要留好。v1 用于盲测,修改后发布 v1.1。不能测到一半偷偷改规则,再用改后的版本证明自己“通过”。

最容易踩的五个坑

候选文章全部投喂。 强编辑稿、代笔稿和特殊商业稿会混淆文字归属。先记录来源,再决定用途。

用形容词概括风格。 “真诚、专业”无法执行,要改成句子位置、结构动作或判断边界。

放大最显眼的特征。 偶尔一句短判断,不代表全篇都要切碎。规则里要写频率和场景。

旧文没出现,就自动列入禁用。 缺席不等于拒绝。没有明确对照或作者确认,先放到慎用或待观察。

为了统一,把所有文章写成同一模板。 风格规则负责划边界,不负责抹掉题材差异。规则过窄,就增加合法选项和例外条件。

今天用 30 分钟,只训练“开场方式”

0—5 分钟:选三篇最能代表自己的原创旧文,排除代笔、强编辑稿与特殊稿。

5—15 分钟:只看每篇前两段,让 AI 标注具体动作、直接判断、设问和背景铺垫,并保留原文位置。

15—22 分钟:填写“使用、慎用、禁用”三栏。写一条正向规则、一条适用条件、一条经过你确认的禁用规则。

22—27 分钟:拿一段 AI 没见过的新材料,生成两个开场,只按表标偏差。

27—30 分钟:把“原句—修改后—理由”写回 v0.1,留下下一次要观察的内容。

先让一条规则经得起一段新材料,再补其余六项。你要得到的,是一套能解释、能检查、也能修订的表达边界。

也可以先在评论里写下:AI 最爱写、但你本人不会写的一句话。再判断它属于词语、句式、结构、语气,还是无来源补写。

回复口令 “风格表”,领取空白资料《个人风格训练表》。

第 05 篇,下一篇我们继续讲:怎样让工作流遇到异常时不崩掉。