这让我想起另一件事。2025年北京恭王府海棠雅集,DeepSeek与诗人同题同韵各写一首《西府海棠》:
贪生万物古今同,岁岁春妆树树红。
色质香形姿貌绝,枝头一样死随风。
芳魂不与众花同,独向东风绽浅红。
纵使香消春去后,犹留清影月明中。
现场专家竞猜人机作者。一位指着第二首说”这首更有诗人味道”,另一位抓住第一首的”死随风”断定”AI不可能写出这种字眼”。答案揭晓:第一首是人类手笔,第二首是DeepSeek写的——认为”更有诗人味道”的那位专家,恰恰把AI错认成了人。
问题来了:AI算不算诗人?
中文系老教授周先生与AI算法工程师小林当场对线,五层逻辑掰扯下来,全程没人能说服对方。
第一层:只看表面操作,俩人暂时看不出矛盾
小林先甩出后台记录:“你看AI完整流程,先出初稿、反复删改、调换意象、调整平仄,一遍一遍优化文字,和古代诗人推敲炼字、反复修改的行为一模一样,都是「生成—评估—修改」的循环,单看操作动作,完全就是创作流程。”
周教授点头认可:“表面动作看着确实像,但外表相似不代表内核一样,这只是最浅层的表象,不能当定论。”
这一步分歧还没显露。
第二层:深挖内在过程,第一次出现认知对称僵局
周教授往前一步抛出核心质疑:“人类写诗,心里有孤独、漂泊、望月的真实情绪,是有内心感受支撑;AI内部只有矩阵运算、概率采样,没有一丝一毫的主观体验,内里完全不一样。”
小林立刻反驳:“你怎么确定人类写诗是‘内心愁绪’?别人的情绪、内心感受你永远看不见,只能靠外在文字、行为推测;AI内部的参数运算你也看不见。 你把人类不可观测的内在叫‘灵感共情’,把AI不可观测的内在叫‘数字计算’,这只是你提前自带的主观定义,不是客观事实。单看内部无法观测这件事,人和AI完全对称,你不能双标。”
到这里,两人都无法拿出能直接观测对方内部状态的证据,分歧开始生根。
“这才到第二层,两人已经谁都说服不了谁了。后面还有三层,越吵越凶——但别急,最后有一个让你站队的投票。”
第三层:核心分歧——能不能自主改写审美标准
周教授抓住关键:“真正的诗人有创造性反身性。我写寒江月色,写着写着会改变自己对‘好诗’的标准。一开始我觉得辞藻华丽才是好,写几句突然明白清冷留白更贴合孤寂,我自己改写评判文字的尺度。但这个AI训练权重是固定死的,它只会顺着预设好的审美框架筛选文字,只会在固定标准里微调词句,永远没法自己重新定义什么是‘江上望月的好诗’,它没有自我重构评判标准的能力。”
小林立刻拆解逻辑漏洞:“你所谓‘AI不能改标准’,本身就是站在你的预设下得出的结论。你默认‘实时改写审美尺度才是创作’,可我只看最终产出好不好。就算它不能当场重构标准,产出成品和人类无差别,功能上就满足创作要求,这个区分对你重要,对我不算判定依据。”
第四层:评判尺度的时间标准,又一层对立
周教授坚持微观视角:“创作是当下一瞬间的心灵活动,就看单次写诗的即时状态,这一轮会话里AI参数不变,没法自主调整审美,天然不具备创作内核。”
小林拉长时间维度反驳:“不能只看单次写诗!平台持续用人类反馈微调模型,一代又一代迭代更新审美偏好,拉长数月、数年周期,模型整体评判标准一直在持续变化,长周期视角下,它拥有和人类相似的迭代反馈循环。你只盯着单次创作瞬间,我看长期整体演化,我们选择的时间标尺不一样,得出的结论自然完全相反——这不是事实对错,是哲学选择不同。”
第五层:终极本质拷问——能不能反思"什么样的审美才算合理"
周教授抬出更高一层标准:“真正的创作者不仅能改一首诗的好坏标准,还能反思‘什么样的审美才算合理’。诗人会推翻整个时代的文风,质疑主流评判体系,这是规范性反身性。AI所有审美调整,全部来自人类外部输入的反馈、人工设定的目标,它永远不会自发思考‘当代诗词审美是不是错了’,没有自主反思规范的能力,本质上不具备创作主体资格。”
小林再次用认识论对称回击:“这套标准依旧是你的专属预设。拉长模型迭代周期,整套审美体系持续更新,我完全可以解读成它在完成规范反思。你拿‘自发内在反思’当门槛,本质是先站在人文内在主义立场,再回头筛选证据,逻辑闭环但无法说服我。”
聊到这,五层逻辑全部捋完,两人手里所有实证、观察、推演全部摆尽,却依旧各说各话,矛盾根源浮出水面——两套无法互相推翻的底层基石。
两大底层基石,造就无解争吵
基石 A:周教授——能自主改写审美标准,才算创作
底层预设:创作的核心是自主反思能力——必须能自主改写审美标准、反思文艺规范,这是创作者的硬性必要条件。 只要AI缺失这套内在特质,哪怕成品再完美、流程再相似,也永远不算真正创作。工程师所有盲测、迭代数据,都没法推翻教授这套“内在优先”的底层前提。
基石 B:小林工程师——产出和人类无差别,就是创作
底层预设:评判创作只看可观测的外在功能、最终成品,看不见、无法验证的内心感受、内在精神不作评判依据。 只要AI产出作品、迭代流程和人类创作无差别,功能等价,就足以认定它是创作者。教授所有关于心灵、主观体验的论述,也撼动不了工程师这套”功能主义”底层前提。
不过,”功能等价”其实有三档强度,混为一谈正是争论中最大的概念混淆:
①盲测分不出人机(产品不可区分,最弱)——目前AI已能做到;
②内部因果过程也与人类同构(过程等价,较强)——仍是争议焦点,大语言模型的注意力机制是否等价于人类的”推敲炼字”,双方各执一词;
③特定任务维度上超越人类(局部定量)——GPT-4在心智理论等任务上已超过人类平均水平。
小林说的”等价”主要落在①和③,周教授反驳的靶子却是②——两人用同一个词,指的根本不是同一件事。厘清这三档,才算真正看懂了这场争论。
这就是核心的条件不可判定性:两人共享全部事实证据,却因为各自无法被对方逻辑推翻的原生预设,永远无法达成统一结论。哪怕未来造出能当场自主改写审美、反思文艺规范的超强AI,僵局依然存在:
周教授会继续抬高门槛:就算能改标准,它没有肉身、真实人生与生命体验,依旧缺少人独有的存在性内核;
小林工程师会继续反驳:功能流程完全对齐,额外增设“生命体验”门槛,只是人为制造双重标准。
跳出本质争论:创作者是"认"出来的
既然没法从形而上层面判定AI算不算创作者,文学、美术、音乐行业和监管,都不再纠结“AI本质能不能创作”,转而看社群实践是否愿意授予它创作者身份。
三道规范性障碍,分别对应辩论中第二、三、五层的核心矛盾:
意图归属模糊——无法客观区分作品的表达源头是人还是算法(第二层);
评估不透明——AI的创作推理藏在海量参数中,不能像人类一样被追问创作思路(第三层);
责任无法自主承担——作品出现价值观争议时,AI无法背负伦理后果,追责只能落在平台和用户身上(第五层)。
(第一层表象相似仅作辩论起点,第四层时间尺度属哲学视角差异,两者均无法转化为制度规范。)
国内《生成式人工智能服务管理暂行办法》也顺着这套实践逻辑落地:强制标注AI生成内容、平台承担内容责任,用社群规则回应三重障碍,而不去敲定”AI是不是创作者”的终极哲学答案。
文末提问
这场吵穿五层逻辑的辩论,没有绝对标准答案,你的立场,本质是你更认同哪一套底层判断逻辑。
如果一首AI古诗盲测完全分不出人机,你站周教授的基石A,还是工程师的基石B?评论区说说你的看法!
“这场争论背后,其实隐藏着海德格尔与功能主义哲学几十年的终极对决。科普版只聊了表象,关注我,接下来我放出两位哲学教授硬核对线的‘哲学版’,那里有关于‘反身性’和‘黑箱对称’的终极拷问。”
夜雨聆风