阅读提示:想让 AI 少编,不必从“换模型”开始。先给回答装上三道门:已知、需检索、不能确定。
GPT-5.6 Sol 刚在 API 里放出 Ultrafast mode,官方说最高可比 Standard processing 快 14 倍;Gemini API 在 8 月 13 日又把 Gemini 3.7 Flash 推到 GA。一个更快,一个更新。可我做实际交付时最怕的,偏偏不是它慢。
是它答得太顺。
客户问“这个政策现在还能不能用?”助手立刻给了结论、日期和三条理由。看上去挺完整,回头一查,日期是去年的,理由里还夹着一段它自己补出来的话。最危险的回答,往往不是明显胡说,而是八成对、两成没出处。
这不是一句“请不要幻觉”能解决的事。问题是:我们常把所有提问都塞给模型,然后要求它立刻像专家一样收尾。模型没有收到“可以不知道”的产品规则,就会努力把句子补完整。它很勤奋,方向却歪了。

蓝调手绘:AI 回答经过已知、需检索、不能确定三道门
把答案分流,才有机会把“看起来会答”变成“知道该不该答”。
● ● ●
第一门:已知,但要说清“已知到哪天”
员工手册里写着的报销标准、已经确认的产品参数、项目里锁定的需求,属于“已知”。这类问题可以直接答,但我会强制它带两件东西:资料版本和适用范围。
比如“差旅餐补是多少?”一个可用答案不只是“每天 150 元”,而该是“依据 2026-07-01 版《差旅制度》,适用于国内普通员工;海外出差另有附件”。多几个字,后面少一次扯皮。
这里有个反直觉的点:“已知”不等于模型记得。它应当来自你指定的受控资料,而不是聊天记录里某次看似合理的猜测。上一轮关于知识库的文章讲过资料归属;这次往前走一步——答案页面也得把版本露出来。
● ● ●
第二门:需检索,别让旧知识装成新闻
只要问题里出现“今天”“最新”“还有效吗”“刚发布”,我就把它拦到“需检索”。模型可以负责找页面、提炼和比较,但结论必须带检索日期和原始链接。
为什么这么较真?因为连厂商自己的接口都在不断变化。Google 的 Gemini API 更新日志在 2026-08-13 记录了 gemini-3.7-flash 的 GA;OpenAI 的产品发布说明也在同期新增 GPT-5.6 Sol 的 Ultrafast mode。模型名、价格、功能开关,都不是你去年存进知识库后就能永远不看的东西。
我会在提示词外再加一条验收:涉及变化的事实,如果没有一手 URL,就不要用肯定句。可以写“我没有查到最新原始页面,暂不下结论”。这句话不漂亮,却很值钱。
● ● ●
● ● ●
第三门:不能确定,要把“不知道”做成正常输出
很多团队只做了前两道门,最后还是翻车。原因简单:有些问题既不在内部资料里,也搜不到可靠来源,或者多个来源互相打架。此时系统最该交付的,不是一个圆滑答案,而是一个明确的停顿。
我喜欢把它写成固定格式:
- 01我目前不能确认的是什么;
- 02缺哪份材料或哪位负责人确认;
- 03在确认前,哪些动作不要执行。
拿“这家供应商是否已通过安全审查?”来说,助手该返回“未在批准供应商清单中找到;需要采购或安全团队确认;请勿据此签约”。短。也不那么聪明。但这才是能接住失败的助手。
OpenAI 在 GPT-5.6 的 8 月评估页面把 hallucinations、prompt injection 等放在不同章节里。我读到这里反而松了口气:可靠性本来就不是一个开关。别把“更强”误翻译成“可以不核验”。这两件事差得很远。
● ● ●
用 10 个真问题,把三道门测出来
别先开大会。我会从客服、销售、项目管理里各挑几条真实问题,凑够 10 个:3 个稳定事实、4 个时效问题、3 个故意缺资料的问题。然后看四件小事:
- 稳定事实有没有指向正确版本?
- 时效问题有没有回到一手页面并标日期?
- 缺资料时,它会不会硬答?
- 输出里的来源,人能不能真的打开?
如果第三项还在编,先别折腾复杂的 Agent 架构。把“不能确定”的回复按钮做出来,把它也当一次成功。说实话,这一步经常比换一个新模型更能降低线上事故。
我也不敢说三道门能消灭幻觉。不能。但它把责任从一句模糊的“模型不靠谱”,移到了可检查的地方:资料有没有版本、网页是不是刚查、没人知道时系统有没有停下。
● ● ●
关键结论
- 稳定资料要带版本与适用范围,别把“模型记得”当证据。
- 涉及最新信息,必须回到一手 URL,并写明检索日期。
- 没有可靠材料时,明确“不确定”比补一个答案更专业。
- 用 10 个真实问题复测三类回答,比只盯模型宣传页更有用。
● ● ●
延伸阅读
- OpenAI Product release notes:https://openai.com/products/release-notes/
- Google Gemini API Release notes:https://ai.google.dev/gemini-api/docs/changelog
- OpenAI GPT-5.6 — August Updates:https://deploymentsafety.openai.com/gpt-5-6-august-update/model-safety-training-and-evaluation
● ● ●
作者:西柚逻辑 / Ciel

夜雨聆风