
我们在用大模型的时候,大模型选择 深度思考,可以输出它的思考过程

这个思考的过程,其实就是大模型的推理过程
那为什么大模型可以做逻辑推理??
难道大模型有思考能力??
其实在了解这个问题之前,我们首先要了解 大模型是如何输出的
这个需要具体了解,先看 → 大模型是如何输出的
简单说,大模型的训练,是在海量数据的基础上,做的一场 统计实验
模型在生成内容时,其实就是在反复问自己
—— 根据目前为止的这些问题,基于在海量数据中统计,下一个词最应该是什么??
举一个最简单的例子
比如你输入 “床前”,大模型根据数据统计规律,预测后面应该是 —— “明月光”,而不会是 “上青天”
如果想了解其中的训练过程,可以看 → AI 是怎么训练的
那么从这点来看,大模型应该只是把各种文字资料 背得很熟
比如可以熟练地背出各种诗句,文章等等
那它又是为何又拥有人类一般的逻辑推理能力呢?
首先,什么是逻辑推理能力?
最经典的应该就是 探案找凶手
你不可能在案发现场看一眼就得到答案,你肯定要一步步收集证据,一步步往下推导,最终确定凶手
通过法医确定死者死亡时间
再通过死亡时间倒推,排查该时间内周围地点的监控
通过监控,锁定嫌疑人
通过死者和嫌疑人的利益关系,得到他们的作案动机
就是通过这种环环相扣的逻辑关系,一步步串联,最终才能找到凶手

这就是 逻辑推理能力,其实就是一系列的因果关系
—— 因为 xxx,进而 xxx,所以 xxx
而如果没有逻辑是怎么样的?
再回到我们的问题
大模型为何拥有人类一般的逻辑推理能力?
其实这有一点哲学的味道

总的来说
—— 大模型训练时用到的数据本身,就蕴含了逻辑
—— 大模型学习到了数据,也就学习到了逻辑
也许这两句话会看得很懵,那我们就分两个问题来看
为什么数据本身蕴含逻辑?
为什么学习数据,就学习到了逻辑?
为什么数据本身蕴含逻辑?
哲学家-维特根斯坦说过,“逻辑必须流淌在语言之上”
也就是说,有了语言,才有了逻辑
人类在进行逻辑思考的时候,大脑中使用的工具就是语言,比如说你平时推导复杂问题的时候,即使没有说出声音,脑子里其实也在自言自语
所以 人类的逻辑推理和思考,无法脱离语言独立存在
人类之所以成为高等智能生物,和其他动物最大的区别,就是拥有 虚构能力的 自然语言
什么意思?
有了语言,人类就可以把复杂信息抽象成概念,比如 虚构出了 【货币】【国家】【宗教】【品牌】等概念,而这些概念并不存在于自然界中
把这些概念串联起来,形成了逻辑规则
比如货币 —— 你给我钞票,我给你东西
比如法律 —— 犯法的人要坐牢
这些概念的传播沉淀,让所有人可以通过概念建立联系,形成共识,互相合作,从而发展出文明
相反的
动物的语言就只能建立在 面对面真实接触 和 客观存在的实体上
比如说黑猩猩的社群,数量通常是20~60只,为什么这么少?因为他们必须要花费多年时间去了解对方,建立真实的感情,才能合作
所以说这么多,就可以体会到,没有语言,就没有逻辑
逻辑必须流淌在语言之上
那这和大模型训练的数据又有什么关系?
文本文字 就是 语言的客观载体,文本文字 就是数据
所以可以回答我们的问题
—— 数据本身就蕴含逻辑
那就来到我们的第二个问题
↓
为什么模型学习数据,就学习到了逻辑?
又要跑偏一下子了
在哲学和科学史上,有两个不同的思维流派
—— 归纳法 和 演绎法
归纳法,就是统计,目标是从海量数据中总结统计出规律,比如你看到两个同事老是走在一起,根据经验就能得到他们应该是在谈恋爱
演绎法,就是推理,通过严密的因果关系和逻辑推演得出结论,比如数学证明
而 我们从开头就说过
模型就是基于在海量数据中统计,来预测出下一个词最应该是什么??
所以大模型的底层机制,其实用的是 归纳法
—— 当出现词汇A和B时,下一个词汇是C的概率最高
那既然 大模型 底层用 归纳法,又是如何能 完成 演绎法 的逻辑推理?
搬出第二个哲学家-休谟的观点
—— “所谓的因果关系和演绎逻辑,无非是一种极其可靠的 归纳法 “
怎么说?
比如我们在过往的经验中,反复看到事件A发生后,总会发生 事件B,且不论环境如何改变,A 总是伴随着 B
那么我们的大脑就会基于这些经验总结出规律
—— A是因,B是果
比如说这个问题, ”太阳是不是只会从东方升起?“
你问普通人,都必定得到相同的答案,但要是问为什么
—— ”因为太阳从来都是从东方升起的“,这便是纯粹的根据经验的统计答案
你要是问物理学家,可能会用严谨的逻辑来给你证明
—— ”因为地球自西向东旋转,并且根据 角动量守恒定律 ,不受外力矩干扰的系统角动量不随时间改变“
—— ”所以地球会一直自西向东,太阳一定会从东边升起“
而如果再问
“为什么角动量一定会守恒?”
只能回答因为在人类以往的所有经验中,从未发现过能量不守恒 的反例
所以!
我们人类认为的定理,因果关系,其实只是我们认知和解释世界的一种主观想法,并不是 宇宙中 客观存在的绝对真理
你想想,我们有多少后来被推翻的定理和物理规律,查了一下,比如说
弱相互作用宇称守恒定理 被 李政道杨振宁宇称不守恒实验 推翻
热质说 被 能量守恒定律 推翻
足以说明,我们当前所谓的客观定理,仅仅只是因为还没有发现反例,所以被视为真理
所以我们平时依赖的严谨的逻辑,其实 在本质上还是一种通过海量经验总结出来的 归纳法
所以!
大模型,通过把海量人类资料学习到极致,就模仿到了人类所谓的 逻辑,从而就有了逻辑推理能力
简单说就是
模型通过 归纳 数据,就可以掌握了人类的 逻辑
okOKok
所以这便是本篇的两个问题
为什么数据本身蕴含逻辑?
为什么学习数据,就学习到了逻辑?
总结一下
因为有了语言,才有了逻辑,而 语言的客观载体是 数据,所以 数据本身就蕴含逻辑
而人类的逻辑,本质就是一种统计的表现,而 大模型的底层 就是通过 海量数据完成统计规律
所以 大模型通过训练数据,就可以掌握了人类的逻辑,有了逻辑推理能力
其实这些概念确实是比较抽象的,很绕非常绕,我真的理解了很久

(完)
夜雨聆风