这次横评不搞虚的,直接上真实场景。我给5款工具喂了同一个prompt,让它们各写一篇"智能水杯产品介绍文案",目标读者是25-35岁上班族。
prompt长这样:
评判标准三条,每条10分:
AI味浓度(分数越低越好)——有没有"值得注意的是""综上所述""不仅……而且"这类典型的AI套话?读起来像人说的还是机器生成的?
逻辑性——结构是否清晰?卖点呈现有没有主次之分?有没有逻辑断裂的地方?
可读性——读起来顺不顺?有没有画面感?能不能让人想买?
ChatGPT的输出确实稳。开篇直接切入场景:"早上泡的咖啡,到工位已经凉了"——这个画面上班族秒懂。卖点呈现有主次,先讲恒温(用户最痛的点),再讲提醒功能,最后带出APP。结尾收得干脆,没有画蛇添足的总结段。
亮点:场景代入感强,语气自然,不端着。
槽点:中间有一句"让每一天的饮水都成为享受"——稍微有点鸡汤,但整体可控。
文心一言写出来……怎么说呢,像是体制内写材料写习惯了。虽然prompt里说了"轻松口语化",但出来的文案还是带着一股"尊敬的用户您好"的气质。卖点罗列比较全,但读起来像产品说明书,缺少场景感。
亮点:信息完整度高,产品参数写得清楚。
槽点:"不仅能够……还能够……"出现了两次。"让您的生活更加美好"这种结尾,典型AI味。口语化指令执行得不够彻底。
通义千问这次表现有点出乎意料。开头用了第二人称"你",代入感不错:"你是不是也经常忙到忘记喝水?"——这句比ChatGPT的开头更直接。卖点串联比较自然,没有生硬地1、2、3列出来。但结尾来了一句"科技让生活更简单",扣分。
亮点:人称运用好,互动感强,卖点串联自然。
槽点:个别金句太"品牌slogan"了,像广告公司写的,不像人说的。
Kimi这次是最大的惊喜。文案结构最清晰:痛点场景→产品登场→卖点拆解→使用画面→收尾引导,一气呵成。最关键的是,它几乎没用任何AI套话。有个细节很抓人:"开会开到一半,杯子亮了一下,你才知道该喝水了"——这个画面感,比其他四款都强。
亮点:AI味最低,结构最清晰,场景描写最生动。
槽点:篇幅稍微超了一点,到480字。但内容密度高,不算注水。
豆包的输出风格比较活泼,语气确实做到了"轻松口语化",但有点用力过猛。比如"这个杯子真的绝了""打工人必备神器"——太像小红书种草文了,反而显得刻意。卖点呈现中规中矩,逻辑上没有什么硬伤,但也没有特别出彩的地方。
亮点:语气确实口语化,符合年轻用户阅读习惯。
槽点:用力过猛,"绝了""神器"这类词太频繁,像营销号体。需要二次调教。
光看总分不够,还得看你拿来干什么。不同工具适合不同场景:
AI味最低,场景描写能力最强。如果你需要文案读起来像人写的,Kimi是这5款里最靠谱的。配合好的prompt,出来的东西稍加修改就能用。
逻辑结构稳,不会跑偏,格式规范。GPT-4o在处理结构化内容时确实有一套。缺点是需要梯子,而且中文表达的"人味"不如Kimi。
虽然有点用力过猛,但豆包对"网感"的把握确实最好。写小红书、抖音文案,豆包的输出风格天然契合。用的时候记得让它"收敛一点,别用'绝了''神器'这类词"。
通义千问在长文本生成上比较稳,逻辑不容易断。适合写分析报告、行业解读这类需要深度思考的内容。
虽然AI味重了点,但文心一言出速度快,信息完整度高。适合"先出个草稿,再人工改"的工作流。别指望直接用,但作为起点够了。
说实话,这次横评最让我意外的不是ChatGPT——它的表现基本符合预期。真正让我眼前一亮的是Kimi。
要知道,写文案这件事,最难的不是把信息说全,而是让读者读着读着忘了这是AI写的。Kimi在这一点上做得最好:它懂得用细节去搭建画面,而不是用形容词去堆砌感觉。"杯子亮了一下"——就这么五个字,比你写十句"智能提醒功能让您不再忘记饮水"都管用。
但我也得说句公道话:工具好不好,七分看prompt。这次测试用的是同一个prompt,如果你会用、会调,这5款工具都能写出好东西。如果你不会,用GPT-5也一样写出AI味。
所以别纠结选哪个工具了。先把prompt写好——这才是真正的功夫。我们之前整理的那份"100+去除AI味指令大全",就是帮你干这事的。关注公众号回复"指令"就能拿到。
关注「柳哥AI说」公众号,回复"横评"获取5款工具完整输出原文 + 测试用prompt
AI不难,柳哥说完你就懂了
柳哥AI说 · 让AI从"听说过"变成"用得上"
夜雨聆风