乐于分享
好东西不私藏

AI通 | Day 2:大语言模型到底在"想"什么——一个接话游戏

AI通 | Day 2:大语言模型到底在"想"什么——一个接话游戏

✨ 本期金句:“AI 不是在思考,它只是在玩一个玩了十亿次的接话游戏”


开场白

昨天咱们正式开启了 AI 入门之旅,认识了 AI 到底是啥。今天要聊一个更有意思的话题——你有没有好奇过,当你跟 AI 聊天的时候,它那个大脑壳里到底在想什么?

是像你我一样在思考?还是在憋什么大招?

真相可能会让你大跌眼镜——它其实是在玩一个超级简单的游戏。

别急,慢慢往下看 👇


本课目标

  • 🎯 理解大语言模型(LLM)的本质——它不是在"思考",而是在"接话"
  • 🎯 掌握"预测下一个词"这个核心概念
  • 🎯 弄明白 AI 为什么有时候会"一本正经胡说八道"

正文

1. 核心概念

🎮 大语言模型的本质:一个接话游戏

昨天我们说了 AI 是"用数据和算法来模拟智能"。今天咱们往里再挖一层,看看大语言模型(LLM)到底是怎么工作的。

说个你可能不信的事实——AI 根本不会"思考"

没错,你在跟它聊天的时候,它不是在"想"答案,而是在玩一个叫**“猜下一个字”**的游戏。

举个例子 🌰:

假设我跟你玩接话,我说:“今天天气真——”

你脑子里立刻会蹦出一个字:“好”

为什么?因为你听过无数次"今天天气真好"、“今天天气真不错”,你的大脑自动预测下一个字大概率是"好"或者"不错"。

AI 做的事情一模一样,只不过它玩这个游戏的水平比任何人都高——它读过了互联网上几乎所有的文字,然后一遍又一遍地练习"下一个字是什么"。

💡 打个比方: 想象你面前有一本无限厚的成语词典,有人念上半句,你要接下半句。你接了十亿次之后,就算遇到没听过的句子,你也知道该怎么往下接了。AI 就是这样训练出来的"接话大师"。

🔢 什么是 Token?

你可能会问:AI 是按"字"来接的吗?

不完全是。AI 用的是一种叫 Token(词元) 的东西。

简单来说,Token 就是 AI 眼里的"文字颗粒"。一个 Token 可以是一个字,也可以是一个词,甚至是一小段文字。

比如:

  • “你好” → 可能是 1 个 Token(AI 把它当整体识别)
  • “人工智能” → 可能是 2 个 Token:“人工” + “智能”
  • “hamburger” → 可能是 1 个 Token
  • “Serendipity” → 可能被拆成 3 个 Token

💡 打个比方: Token 就像乐高积木。AI 不会一个个像素去画画,而是用预先切好的积木块来拼。积木块大小不一——常见的词是一块大积木,生僻字可能就只有一个小积木。

这个概念现在不用深究,后面咱们会经常用到。

🧠 为什么 AI 不懂却能说会道?

这就到了最精彩的部分了。

AI 虽然看起来什么都懂,能聊哲学、写代码、讲段子,但它其实什么都不理解

听起来有点矛盾对吧?

关键在于:模式匹配 ≠ 真正理解

打个比方,你可能熟背了一首诗的每一个字,甚至能倒背如流,但你未必理解每一句诗的深层含义。

AI 就是这样——它记住了海量文字之间的"搭配模式",知道"因为"后面大概率跟"所以",知道"程序"后面大概率跟"代码",但它并不知道这些东西在真实世界里的含义。

💡 打个比方: 就像一个外国朋友,中文发音特别标准,成语信手拈来,但其实他对"时间就是金钱"的理解可能真的是字面意思——时间 = 钱 😂

🎭 "思考"的假象

那为什么 AI 的回答看起来那么有条理、有逻辑?

因为它读过太多有条理有逻辑的文章了!当它一个词一个词地接下去的时候,自然就会"接"出看起来像思考的结果。

但这也解释了一个现象——AI 会一本正经胡说八道

这在专业里叫"幻觉"(Hallucination)。当 AI 遇到一个它训练数据里没见过的东西,它不会说"我不知道",而是会继续"接话游戏",用它学到的模式编一个看起来很合理的答案出来。

💡 打个比方: 就像一个考生蒙题——他不是在作弊,他就是根据经验猜一个最像正确答案的选项。猜对了是天才,猜错了就是"幻觉"。


2. 动手环节

好了,理论够多了。现在咱们打开任意一个 AI 工具,亲自验证一下"接话游戏"。

Step 1:打开你的 AI 工具 ✅

打开豆包、腾讯元宝、DeepSeek 或者任何你手机上已经有的 AI 工具。

[截图:打开任意AI工具的对话界面]

🤫 小贴士: 没有安装也没关系,Day 3 到 Day 6 咱们会一个一个详细介绍。今天先用你手边有的就行。

Step 2:问一个"需要推理"的问题 ✅

在对话框里输入一个需要逻辑推理的问题,比如:

  • “一个房间里有3只猫,每只猫抓了3只老鼠,一共有多少条腿?”
  • “如果我今天开始每天存10块钱,一个月后我有多少钱?”
  • “5个苹果分给3个人,怎么分最公平?”

[截图:输入推理问题的对话框]

🤫 小贴士: 别问太简单的问题(比如"1+1等于几"),这种问题训练数据里太多了,AI 就像背答案一样,看不出"接话游戏"的特点。问那种需要几步推理的问题效果最好。

Step 3:观察 AI 的回答方式 ✅

仔细看 AI 是怎么回答的。注意观察以下几点:

  1. 它是先直接给答案,还是一步步推导?
  2. 它的回答过程是不是像一个"接话高手"在说话?
  3. 有没有哪个地方你觉得它在"编"?

[截图:AI的完整回答内容]

🤫 小贴士: 如果 AI 的回答里有错误,别急着纠正——这正是"幻觉"在作怪,我们就是要观察这种现象。

Step 4:追问"你怎么知道" ✅

AI 回答完之后,追问它一句:"你是怎么算出来的?“或者"你怎么知道这个答案?”

观察它怎么解释自己的"思考过程"。你会发现它多半会给出一个看起来合理的解释——但你现在已经知道了,那个"思考过程"也是"接"出来的 😏

[截图:追问后AI的解释]

🤫 小贴士: 这一步特别关键。很多人以为 AI 真的在"解释自己的思路",但其实它只是在继续玩接话游戏,接出了一段"看起来像思考过程"的文字。


3. 进阶技巧

掌握了上面这些,你已经理解了大语言模型的核心原理。下面给你几个进阶玩法:

🌟 技巧1:用"填空"来测试 AI

试着给 AI 一个句子让它填空,比如:“中国的首都是___”

你会发现它填得又快又准。这就证明了——它确实是在"猜下一个词"。

🌟 技巧2:故意打断 AI

在 AI 回答到一半的时候,点"停止生成"。你会看到一句话可能断在一个奇怪的地方——因为 AI 在那个点上"预测"出的下一个词被你截断了。

🌟 技巧3:换个顺序问同一个问题

先问"3只猫每只3只老鼠多少条腿?",再问"每个笼子3只鸟,4个笼子几只鸟?“你会发现 AI 用的是完全不同的"接话策略”——因为它在不同话题上训练的模式不同。


4. 常见翻车

❌ 翻车场景
✅ 解决办法
AI 说了一个完全不存在的地点/人名
别全信!这就是"幻觉",重要信息一定要自己核实
AI 的数学算错了
AI 的数学能力依赖训练数据,不是真的在算。复杂计算建议用计算器
AI 前后回答不一致
这很正常,每次对话都是独立的"接话游戏",不会有上下文记忆(除非是同一轮对话)
AI 的回答看起来很专业但其实有硬伤
记住:AI 是在"接话"不是在"思考"。涉及专业领域,务必找专业人士确认

今日任务

  1. 🔥 动手玩接话游戏:打开任意 AI 工具,问至少3个需要推理的问题,观察它的回答模式
  2. 🔥 触发一次幻觉:试着问 AI 一个很冷门的问题,看看它能不能"编"出一个看起来合理的答案
  3. 🔥 跟朋友科普:用你自己的话,跟身边一个不了解 AI 的朋友解释"AI 其实是在玩接话游戏"这个概念

📅 明天 Day 3:豆包——你的第一个 AI 朋友,30 秒上手 ——微信搜一下,连密码都不用记,你的 AI 社交圈从今天开始!

关注「拼AI」,84天从AI小白到AI达人 🚀