
导语:和AI吐槽心事,总收到“我理解你”万能套话?如今一套基于心理学共情循环理论的全新奖励建模框架PERM,彻底解决大模型“假共情”痛点,实测用户7成更偏爱它的回复,情商指标提升超10%。
一、痛点:为什么现在的AI安慰永远不走心?
当你和AI说:“宝宝终于睡着了,家里安安静静,难得歇一会”,大概率会收到两种敷衍回复:
1. 只站AI自身视角(模型单视角优化)
“太幸福啦,好好享受独处时光!”
话术温暖但空洞,完全没读懂宝妈背后藏着的疲惫,像客服标准话术,用户看完只会觉得敷衍。2. 只站用户需求视角(用户反馈单视角优化)
“你辛苦了,需要我给你带娃小建议吗?”
一味急着给解决方案,忽略你当下只想被理解、被安抚的情绪需求,冷冰冰没有温度。
现有提升大模型共情的方案分两类,全都存在硬伤:
1. 监督微调SFT:靠人工优质对话训练,但极易死记模板,面对陌生情绪场景泛化能力极差; 2. 传统强化学习奖励模型:评价共情只单看模型输出、或只模拟用户反馈,割裂了共情是双向互动这个核心事实。
心理学里经典的**共情循环理论(Empathy Cycle)**早已点明:共情不是AI单方面输出暖心话,而是完整闭环——AI共情理解→AI表达安抚→用户感受到被理解,三步缺一不可。过去所有AI对齐方案,都只盯着其中一环打分,自然只能产出“表面共情”。
针对这一行业瓶颈,中科大、新加坡国立、华为联合团队推出PERM(心理学驱动共情奖励建模),把心理学理论直接嵌入大模型强化学习奖励函数,用三方视角全方位评判AI共情能力,从底层根治AI假温柔、模板化回复问题。

二、PERM核心逻辑:三方评委,完整复刻人类共情闭环
PERM打破单一打分维度,搭建支持者(AI)、寻求者(用户)、旁观者三重评价体系,把共情拆解成可量化的奖励分数,再通过调和平均融合总分,驱动模型学会真正共情。
1. 支持者视角(AI自身,两大核心得分项)
对应共情循环里AI“读懂情绪+好好表达”两步:
• 共鸣分Resonation:考核AI能不能看透表层情绪,挖掘用户隐藏心理。
打分标准:能否识别显性情绪、情绪成因、未说出口的深层需求(比如宝妈平静下的身心疲惫)。低分只会复述字面意思,高分能捕捉复合、矛盾情绪。• 表达分Expression:考核话术质感,拒绝机械套话。
低分:“我懂你的感受”这类万能模板;高分:语气贴合用户状态、自然像真人好友,有细腻情绪表达,不生硬说教。
2. 寻求者视角(模拟用户感受:接收分Reception)
站在用户角度打分:看完AI回复后,会不会觉得被治愈、愿意继续倾诉?
• 低分:回复空洞、强行说教,看完不想继续聊; • 高分:精准击中内心隐秘需求,看完心里温暖,愿意倾诉更多心事。
3. 旁观者视角(全局质量惩罚项)
专门解决一个致命缺陷:模型为了刷共情分,疯狂堆砌温柔话术,变得啰嗦、无逻辑、全是空话。
旁观者独立评判对话流畅度、简洁度、逻辑连贯性,不掺杂情绪加分,生成负向惩罚分数,平衡“共情”和“对话质量”,避免AI为了讨好用户丧失理性表达能力。
简单看懂PERM打分公式
1. 先算出共鸣、表达、接收三项分数的调和平均值作为核心共情奖励(只要任意一项低分,整体共情分直接暴跌,倒逼模型三项能力同步提升); 2. 叠加旁观者惩罚系数,平衡共情和对话通顺度; 3. 使用GRPO强化学习算法微调大模型,全程以这套综合奖励为优化目标。
三、实测碾压全基线,三大实验证明效果拉满
团队选用Qwen2.5、Llama3.1、Qwen3多款主流开源基座,在专业情商基准EQ-Bench3、工业真实日常对话数据集、真人盲测三层验证PERM效果,数据全面领先传统方案。
1. 专业情商基准EQ-Bench3:整体情商提升10.8%
对比SFT、传统RL奖励模型、RLVER、Partner等主流基线,PERM在深层洞察、情绪推理、温暖度、真实人类感、社交应变7项细分维度全部第一:
• 温暖度(WRM)相对提升22.1%,真人感提升19.6%; • 单纯微调、单视角强化学习只能小幅提升表层话术,PERM直接拉高模型深层情绪理解能力,真正实现“懂情绪”而非“会说温柔话”。
消融实验更直观证明各模块价值:
• 去掉共鸣打分:整体情商直接从66.6跌到62.3,看懂情绪是共情根基; • 去掉旁观者打分:话术变过度讨好,但逻辑、社交处理能力大幅下滑,证明第三方视角不可或缺。
2. 工业真实日常对话:全维度全面优化
基于企业415条真实情感对话样本测试,六大评价指标(共情、话题引导、价值引导、意图理解、流畅度、口语化)PERM全部优于基线模型,不仅共情更强,对话自然度、沟通逻辑同步提升,适配日常聊天、情感陪伴、心理疏导等落地场景。
3. 真人盲测:7成用户主动选择PERM模型
68名不同年龄、性别的志愿者盲测对比:
• 在复杂高难度社交场景EQ-Bench3中,超72%用户更喜欢PERM回复; • 相比通用奖励模型RM,PERM在共情、整体情商两项偏好率均突破60%;
用户反馈核心差异:传统AI只是“客套安慰”,PERM能精准捕捉藏在文字背后的委屈、疲惫与期待,回复更有共鸣。
案例直观对比(宝妈场景)
普通大模型:“太美好啦,好好享受独处时光!”(表层模板化共情)
PERM优化后模型:
“这段安静时光对你来说一定格外珍贵。宝宝睡着终于能喘口气,这份平静里又藏着带娃的疲惫,短暂放松真的很难得。你值得好好享受这一刻,做点让自己舒服的小事吧。”
用户反馈:完全说到心坎里,被看见、被体谅。
四、现有局限与未来落地方向
论文客观指出当前PERM两大短板,也是后续迭代重点:
1. 仅支持单轮对话:现实情绪疏导是多轮递进沟通,当前框架无法记忆多轮上下文情绪变化,未来将拓展多轮强化学习方案; 2. 缺少个性化用户记忆:仅简单存储年龄、职业等基础人设,无法长期记忆用户过往情绪、偏好,后续计划加入记忆模块、用户偏好建模,实现千人千面的个性化共情。
伦理层面团队特别强调:
1. 该模型仅作情绪陪伴辅助工具,不能替代专业心理咨询师,上线必须标注能力边界; 2. 训练数据全部为合成虚拟人设,无真实用户隐私,落地需配套严格数据匿名、隐私保护机制; 3. 奖励建模可能放大数据集自带文化、性别偏见,部署前需持续偏见监测与校正。
五、行业价值:重新定义AI“情商对齐”标准
过去行业提升AI共情,思路停留在“教模型说暖心句子”,本质是表层文本模仿;而PERM第一次把成熟心理学理论融入奖励建模,构建双向、多维度共情评价体系,带来三点行业变革:
1. 对齐逻辑升级:从单一输出打分→人机双向互动闭环评价,解决AI“假性共情”行业通病; 2. 落地场景拓宽:智能陪伴、心理疏导客服、亲子对话、职场情绪疏导等需要深度情感支持的产品,可直接基于PERM微调,大幅提升用户留存; 3. 通用适配性强:兼容Qwen、Llama等主流开源基座,小参数量模型也能获得显著情商提升,轻量化部署成本低,训练仅需少量GPU、极低API开销。
结语
当AI不再只会复制“我理解你”的万能安慰,而是能读懂你文字背后没说出口的疲惫、委屈与小确幸,人机交互才算真正走进情感时代。PERM证明:想要AI拥有真正共情,不能只靠话术堆砌,要从心理学底层重塑奖励优化逻辑。目前项目开源代码已上线,后续多轮对话、个性化记忆两大迭代方向,值得情感AI从业者持续关注。
https://arxiv.org/pdf/2601.10532
夜雨聆风