今天收到一位同学的反馈。
他用我的模板写了26英一大作文,放进了软件去批改。系统给了18分,满分20分,判定为第五档。
这个结果让他很满意。他说,接下来准备“无脑跟”我的模板。

18分当然值得高兴。
可我还是提醒他,AI给出的分数只能拿来参考,先别把它当成考场结论。一次18分也不能证明文章已经没有进步空间,更不能跳过后面的练习。
我最关心的是另一件事,少掉的2分去哪了?
这份批改几乎把文章夸了一遍
它认为文章词汇丰富,专门点出了“illustrates”“reveal”和“dilemma”。它还表扬了长句和复杂语法,又提到“joint efforts are needed”以及“shift from a source of anxiety into a trusted helper”等表达。
最后给出的判断也很明确,语言运用流畅自然,能够清晰表达观点。
结构方面同样是肯定评价。
批改认为开头清楚介绍了图表,第二段分析了接受度和担忧之间的关系,最后一段提出解决方案。“Therefore”也被当作恰当的过渡,整篇文章结构清晰,逻辑连贯。
截图里还能看到内容维度的开头,评价依然是“表现出色”。
这些评价能说明,这篇成稿在词汇、句式和段落安排上得到了系统认可。模板里的表达也确实发挥了作用,这个结果没有必要回避。
问题也很具体。
系统给了18分,能够看到的评价却几乎都是表扬。它却没有清楚告诉学生,距离20分还差在哪里,也没有指出哪一句需要继续改。
对于想提高作文的人,这两分比18分更有用。
18分评的是眼前这篇文字
如果这次提交的内容高度沿用了模板成稿,那么18分首先评价的是这篇已经写出来的文章。
它可以证明这套结构和表达具有可用性。学生能不能在考场上拿到同样的分数,还要经过另一种检验。
题目换掉以后,他能否判断该用哪套思路?没有现成成稿放在旁边,他能不能把具体内容填进去,并在规定时间内写完?
这些能力不会出现在评分结果里。
模板可以帮你减少临场组织语言的压力,也可以让段落任务更明确。材料怎样判断,空里应该填什么,仍然需要大家自己处理。
“无脑跟”最容易省掉的,恰好是这部分判断。
研招网公开的英语作文五档评分说明中,英语一大作文17至20分属于第五档。进入这一档,作文要完成规定任务并覆盖内容要点,语言还要自然连贯,格式和语域也要合适。
一个总分会把这些要求压在一起。得到18分以后,学生仍然需要知道内容是否充分,复杂句有没有使用风险,段落之间的因果能否成立。
近年的自动作文评分研究也提醒过这一点。一项2026年的研究发现,大语言模型和人工评分能够形成一定程度的对应,关注重点却有差异。模型更看重语法准确、词汇难度和句法复杂度,人工评分者对内容完整度更敏感。
另一项2026年的研究比较了三套AI评分系统和人工评分。研究中的AI整体给分更高,分数波动更小,但它们和人工在各项写作特征上的一致程度多数只有中等,不同AI也有各自的评分习惯。
这些研究没有直接测试某个批改APP。它们至少说明,单次AI分数适合辅助练习,无法提前替代真实考场的人工阅卷。
这位同学下一步该做的事很简单。
先根据评分要求检查这篇作文,找出AI没有明确说明的扣分可能。随后换一道题,在没有成稿提示的情况下重新写一次。第二次仍能完成审题和内容填充,这套模板才逐渐被他用熟。
我为什么不顺着18分继续夸?
我是卖作文模板的,这张18分截图对产品当然是正面反馈。
我也完全可以把它截出来,然后告诉大家“某批改app认证分数最高档”“跟着模板背就行”。这样写很痛快,我的模板卖的更快。
但AI批改承担不了这样的承诺。
它证明了一篇成稿获得了较高评价,无法替任何人预定考场分数。学生自身的语法问题、审题习惯和临场书写,也不会因为模板里有几个高级句子自动消失。
我更希望大家知道每段模板为什么放在这里,遇到什么材料可以使用,换一种材料时该怎样处理。这样的“跟”需要动脑,进考场以后也更可靠。
对已经在学模板的同学,我的建议一样。如果AI改出高分,当然值得开心。
然后关掉分数,换一道题,再写一篇。
“无脑跟”就算了,
有脑地用,才能把模板变成自己的东西。
夜雨聆风