夜雨聆风学习资料网

ARTICLE · 1095956

医药人注意了,别太迷信AI工具,它有时也会一本正经地胡说八道!

医药人注意了,别太迷信AI工具,它有时也会一本正经地胡说八道!
先说一个真实案例。
2025年10月,毕马威发布了一份关于企业如何应用AI的报告,将瑞银、英国国民医疗体系、伦敦交通局等多家机构列为成功案例,数据与出处齐备,看上去论证扎实。
2026年6月,这份报告被撤回。
AI检测机构GPTZero逐条核验后发现,报告45条引用中,仅5条经得起核对;
被点名的机构也相继向媒体否认,称相关描述并不属实。
一家对外提供AI咨询的专业机构,最终却因AI生成的失实内容,陷入被动。
一、效率是真的,代价也是真的!
近两年,AI已经进入日常工作的许多环节。
撰写文稿、制作演示、整理资料、汇总数据,不少工作交给它,几分钟便能形成初稿,效率提升明显。
但效率的另一面,是接连不断的翻车。
有员工用AI做投标方案,里面列了三家合作品牌、好几组研究机构的数据,被客户当场追问出处。一查,品牌是虚构的,机构查无此家,项目直接丢了,人被扣了三个月绩效。
有财务用AI识别报销发票,它"贴心"地把537.98元,四舍五入汇总成538元,账怎么对,都对不上。
最离谱的一桩,发生在法律圈。
美国纽约一位执业三十年的资深律师,用AI写诉状,引用了六个判例,案号、法官、裁判要旨一应俱全,甚至模仿了最高法院的行文风格。
法院一核对,六个判例,全是AI凭空捏造的,一个都不存在。
律师被罚了五千美元,还得挨个向被冒名的法官道歉。
他的辩解是:我以为这个网站,总不至于自己编案子吧。
事实证明,它真的会,而且编得比真的,还像真的。
这样的亏,不止职场人在吃。
2026年8月,人民日报海外版报道,安徽滁州一位67岁的农户,请AI为芝麻田开具除草方案,药名、剂量、喷施方法一应俱全。老人按照配方,对150亩田进行了喷施。
然而,配方中含有一种“芝麻田”禁用的“大豆田”除草剂。数日之后,150亩芝麻悉数枯死,十几万元投入,付诸东流。
一位种了一辈子地的老把式,因为轻信AI,付出了沉重代价。
二、类似的张冠李戴,我也经历过
有一次,我请AI撰写一篇介绍自家药品的文稿。
成文流畅,卖点与数据齐备,我读后又核对了一遍数据的真实性,颇为满意,险些直接发布。
临发布前再看一遍,才发现产品本身无误,但是产品生产企业的名称,却被替换成了另一家药企。
倘若就此发出,无异于费力替他人做了宣传,也在业界徒增笑柄。
此后我便形成习惯:AI生成的内容,其他环节可以从简,唯独名称、数据与出处,必须亲自核对。
三、常见的三个毛病
把这些翻车归拢起来,大体是三类。
其一,是为用而用。
一些单位看到AI热度,便要求各部门普遍使用,还要拿出应用成果。于是,演示文稿中多了几张AI生成的图表,报告里多了几个时髦概念,内容是否准确,反而少有人深究。
究其本质,不过是新增的一层形式主义。
其二,是数据上的随意。
应当精确的,它代为取整;
并不掌握的,它敢于推测,
再配以规整的格式,把不确定,包装成确定。
其三,是凭空虚构。
把猜测当事实,把不存在的客户、文献、案例编排得有模有样,单看表面,几乎无从分辨。
四、它为什么会这样
原因并不复杂。
这类工具的设计逻辑,是依据上下文逐词推演,它追求的是语句通顺、合乎表达习惯,而不是保证每一句都符合事实。
它并不真正"掌握"事实,遇到盲区,也不会承认"我不知道"。
只会顺着语气继续生成,
而且语气往往十分笃定。
这正是所谓的"幻觉"。
问题在于,它越是笃定、排版越是规整,使用者越容易轻信。
而多数翻车案例的根源,不在工具本身,而在使用者贪图省事,把本应亲自核实的环节拱手让出,还默认工具不会出错。
五、应当如何防范
其一,分清适用的边界。
起草、构思、归纳、整理,尽可以交给它;但事实、数据、法条、出处这类需要较真的内容,不能由它代为判断。
其二,关键内容务必亲自核验。
凡需上报、对外、签署,或涉及费用的,数据与引用都要回到原始来源,逐条核对;它提供的链接和文献,应当自行点开、自行查证。
其三,要求它交代不确定性。
多问几句:数据来源是什么?哪些是事实,哪些是推测?对含糊其词、给不出可靠来源的,一律标注"待核实"。
其四,责任无法外包。
南京一位李律师检索自己的姓名时,某平台AI竟给出"本人被判三年"的说法,还配上了他身着律师袍的照片。
法院二审认定平台构成名誉侵权,判令道歉。
媒体在报道中点出:幻觉,不是免责的挡箭牌。
借助AI完成的内容,署名的是人,承担责任的,依然是人。
其五,不做为用而用的表面文章。
考核应看事情是否办成、结果是否准确,而不是报告里有没有时髦概念。
六、最后
工具代代更迭,能力越来越强,但有一点始终未变:它是放大器。
使用者清醒,它便放大效率;使用者糊涂,它也会把糊涂,包装得像模像样。
锄头不能替农民判断节气,
再聪明的AI,也无法替人判断真假。
真正关键的,从来不是会不会用AI——这并不难。
而是在它给出大段内容之后,是否还愿意多问一句、多查一遍,是否敢于承担"此事由我负责"的那份重量。
七、文末,主动交代一件事
这篇文章的初稿,大部分由豆包生成,再经我逐段核对、修改、定稿。
若逐字手敲,并非不能成文,只是慢,大量精力,会耗在重复的组织与誊录上。
但你能据此说,这篇文章是在胡说八道吗?恐怕不能。
观点由我确定,事实经过核对,结论由我负责。AI承担的,是把想法快速落成文字的那部分,而不是思考本身。
工具从来如此。
它像武器,本身谈不上好坏,能用来护人,也能用来伤人,关键看握在谁手里;
它也像金钱,能帮人把事办成,可一旦把它当成目的,人反会被它困住。
速度、记忆、重复劳动上的不足,工具都能替我们弥补;
唯独独立思考与价值判断,没法交给它代劳。
让工具为人所用,而不是人被工具牵着感觉走——这,或许才是它留给我们真正的功课。
互动话题
1. 你被AI一本正经地"忽悠"过吗?当时是怎么回事?
2. 你身边使用AI,是真正提升了效率,还是又多了一层形式?
资料来源
1. GPTZero官方调查,2026年6月12日;英国《金融时报》、TechCrunch关于毕马威撤回报告的报道,2026年6月;《财富》2026年9月22日相关报道。
2. 钛媒体:《乱用AI,打工人被坑惨了》,2026年7月(投标方案案例);新浪财经相关报道(发票取整案例)。
3. 美国律师协会(ABA)关于Mata v. Avianca案的报道,2023年;中国新闻网2023年5月30日;新华网《警惕人工智能"说谎"风险》,2025年7月。
4. 人民日报海外版:《别被AI的"自信"带偏了》,2026年8月31日。
5. 光明网:《AI造谣平台被判侵权,幻觉不是免责挡箭牌》,2026年5月11日。
免责声明:
本文案例均来自公开报道,所涉机构与个人以原始报道为准;文中提及的错误率、幻觉率等,因测试机构、场景和口径不同差异较大,仅作现象说明。本文不针对任何具体企业或产品,不构成经营、投资、法律或采购建议,观点仅供理性交流。
往期精彩文章导读 :
一首诗,一坛酒,谁共明月?——写在2026年中秋佳节的几句话!
蒸馏水,养不活鱼:太干净的环境,为什么留不住生机?
以时间换空间:房贷从30年变成40年,有人松了口气,有人笑不出来!

相关学习资料