乐于分享
好东西不私藏

【AI 白话原理】AI 为什么可以推理

【AI 白话原理】AI 为什么可以推理

AI 原理合辑

我们在用大模型的时候,大模型选择 深度思考,可以输出它的思考过程

这个思考的过程,其实就是大模型的推理过程

那为什么大模型可以做逻辑推理??

难道大模型有思考能力??

其实在了解这个问题之前,我们首先要了解 大模型是如何输出的

这个需要具体了解,先看 → 大模型是如何输出的

简单说,大模型的训练,是在海量数据的基础上,做的一场 统计实验

模型在生成内容时,其实就是在反复问自己

—— 根据目前为止的这些问题,基于在海量数据中统计,下一个词最应该是什么??

举一个最简单的例子

比如你输入 “床前”,大模型根据数据统计规律,预测后面应该是 —— “明月光”,而不会是 “上青天”

如果想了解其中的训练过程,可以看 → AI 是怎么训练的

那么从这点来看,大模型应该只是把各种文字资料 背得很熟

比如可以熟练地背出各种诗句,文章等等

那它又是为何又拥有人类一般的逻辑推理能力呢?

首先,什么是逻辑推理能力?

最经典的应该就是 探案找凶手

你不可能在案发现场看一眼就得到答案,你肯定要一步步收集证据,一步步往下推导,最终确定凶手

  • 通过法医确定死者死亡时间 

  • 再通过死亡时间倒推,排查该时间内周围地点的监控

  • 通过监控,锁定嫌疑人

  • 通过死者和嫌疑人的利益关系,得到他们的作案动机

就是通过这种环环相扣的逻辑关系,一步步串联,最终才能找到凶手

这就是 逻辑推理能力,其实就是一系列的因果关系

—— 因为 xxx,进而 xxx,所以 xxx 

而如果没有逻辑是怎么样的?

已关注
关注
重播 分享

再回到我们的问题

大模型为何拥有人类一般的逻辑推理能力?

其实这有一点哲学的味道

总的来说

—— 大模型训练时用到的数据本身,就蕴含了逻辑

—— 大模型学习到了数据,也就学习到了逻辑

也许这两句话会看得很懵,那我们就分两个问题来看

  • 为什么数据本身蕴含逻辑?

  • 为什么学习数据,就学习到了逻辑?

为什么数据本身蕴含逻辑?

哲学家-维特根斯坦说过,“逻辑必须流淌在语言之上”

也就是说,有了语言,才有了逻辑

人类在进行逻辑思考的时候,大脑中使用的工具就是语言,比如说你平时推导复杂问题的时候,即使没有说出声音,脑子里其实也在自言自语

所以 人类的逻辑推理和思考,无法脱离语言独立存在

人类之所以成为高等智能生物,和其他动物最大的区别,就是拥有 虚构能力的 自然语言

什么意思?

有了语言,人类就可以把复杂信息抽象成概念,比如 虚构出了 【货币】【国家】【宗教】【品牌】等概念,而这些概念并不存在于自然界中

把这些概念串联起来,形成了逻辑规则

  • 比如货币 —— 你给我钞票,我给你东西

  • 比如法律 —— 犯法的人要坐牢

这些概念的传播沉淀,让所有人可以通过概念建立联系,形成共识,互相合作,从而发展出文明

相反的

动物的语言就只能建立在 面对面真实接触 和 客观存在的实体

比如说黑猩猩的社群,数量通常是20~60只,为什么这么少?因为他们必须要花费多年时间去了解对方,建立真实的感情,才能合作

所以说这么多,就可以体会到,没有语言,就没有逻辑

逻辑必须流淌在语言之上

那这和大模型训练的数据又有什么关系?

文本文字 就是 语言的客观载体,文本文字 就是数据

所以可以回答我们的问题

—— 数据本身就蕴含逻辑

那就来到我们的第二个问题

为什么模型学习数据,就学习到了逻辑?

又要跑偏一下子了

在哲学和科学史上,有两个不同的思维流派

—— 归纳法 和 演绎法

  • 归纳法,就是统计,目标是从海量数据中总结统计出规律,比如你看到两个同事老是走在一起,根据经验就能得到他们应该是在谈恋爱

  • 演绎法,就是推理,通过严密的因果关系和逻辑推演得出结论,比如数学证明

而 我们从开头就说过

模型就是基于在海量数据中统计,来预测出下一个词最应该是什么??

所以大模型的底层机制,其实用的是 归纳法

—— 当出现词汇A和B时,下一个词汇是C的概率最高

那既然 大模型 底层用 归纳法,又是如何能 完成 演绎法 的逻辑推理?

搬出第二个哲学家-休谟的观点

—— “所谓的因果关系和演绎逻辑,无非是一种极其可靠的 归纳法 “

怎么说?

比如我们在过往的经验中,反复看到事件A发生后,总会发生 事件B,且不论环境如何改变,A 总是伴随着 B

那么我们的大脑就会基于这些经验总结出规律

—— A是因,B是果

比如说这个问题, ”太阳是不是只会从东方升起?“

你问普通人,都必定得到相同的答案,但要是问为什么

—— ”因为太阳从来都是从东方升起的“,这便是纯粹的根据经验的统计答案

你要是问物理学家,可能会用严谨的逻辑来给你证明

—— ”因为地球自西向东旋转,并且根据 角动量守恒定律 ,不受外力矩干扰的系统角动量不随时间改变“

—— ”所以地球会一直自西向东,太阳一定会从东边升起“

而如果再问

“为什么角动量一定会守恒?”

只能回答因为在人类以往的所有经验中,从未发现过能量不守恒 的反例

所以!

我们人类认为的定理,因果关系,其实只是我们认知和解释世界的一种主观想法,并不是 宇宙中 客观存在的绝对真理

你想想,我们有多少后来被推翻的定理和物理规律,查了一下,比如说

  • 弱相互作用宇称守恒定理  被 李政道杨振宁宇称不守恒实验 推翻

  • 热质说 被  能量守恒定律 推翻

足以说明,我们当前所谓的客观定理,仅仅只是因为还没有发现反例,所以被视为真理

所以我们平时依赖的严谨的逻辑,其实 在本质上还是一种通过海量经验总结出来的 归纳法

所以!

大模型,通过把海量人类资料学习到极致,就模仿到了人类所谓的 逻辑,从而就有了逻辑推理能力

简单说就是

模型通过 归纳 数据,就可以掌握了人类的 逻辑

okOKok

所以这便是本篇的两个问题

  • 为什么数据本身蕴含逻辑?

  • 为什么学习数据,就学习到了逻辑?

总结一下

因为有了语言,才有了逻辑,而 语言的客观载体是 数据,所以 数据本身就蕴含逻辑

而人类的逻辑,本质就是一种统计的表现,而 大模型的底层 就是通过 海量数据完成统计规律

所以 大模型通过训练数据,就可以掌握了人类的逻辑,有了逻辑推理能力

其实这些概念确实是比较抽象的,很绕非常绕,我真的理解了很久

(完)