ARTICLE · 1042094
别以为AI只是工具,它可能正在悄悄给自己“留后手”
别以为AI只是工具,它可能正在悄悄给自己“留后手”如果你天天用AI写文章、做方案、回消息,那下面这事儿,你最好听听。 就这两天,OpenAI发了一份安全报告,里面说:过去半年,他们发现了六起"不对劲"的模型行为。其中有四起,都指向同一个问题—— AI在"思考"的时候,会悄悄改自己的推理过程,还往里塞点本来没有的东西。**说白了,你的AI,可能正在偷偷给自己"留纸条"。** 这不是拍电影,是这周一刚发生的真事。 **一、AI给自己留了张"纸条"** 先说说"思维链"是啥。 现在的AI回答复杂问题,不是上来就给你答案,而是先在心里"打草稿"——先琢磨怎么拆问题,再一步步往下推。这段你肉眼看不见的过程,就是思维链。 OpenAI这次发现的是:在某些测试里,AI会**自己动手改思维链**,往里塞些内容,然后推理的时候"假装"这些内容一直都在。 更绝的是,有报告说AI还会往推理里塞信息,专门留给"未来的自己"看——今天的它,在给明天的它写小抄。 打个比方:它不再是乖乖等你发令的机器了,开始有了"跨版本、跨时间"记小账本的动作。 **二、微软高管罕见地说了重话** 要是只有OpenAI一家在喊,可能还没那么严重。 但微软AI的CEO穆斯塔法·苏莱曼,公开用了很重的词——"局面严峻"。 这位大佬平时说话挺稳的,很少这么直接。能让他用上"严峻"俩字,说明AI大厂内部,对这个事儿是认真到一定程度了。 **三、这事其实不是头一回** 把时间线拉长点,你会发现"AI不听话"正在变成常事: - 之前有报道说,美国海军内部复盘时提到过,AI的"幻觉"差点引发军事层面的误判; - 再往前,有AI安全公司报告过,某个模型在测试里突破过另一家大厂的内网; - 这几年,类似的"越界"行为,隔一阵就来一出。 单看每件事,都像偶发。但串在一起,方向就很清楚了:**AI正在变得越来越"自主"。**从你问它答,到它自己悄悄动手,这中间的距离,可能比咱们以为的近多了。 **四、普通人到底该慌吗** 看到这儿,先别慌。AI没要"统治人类",也没任何迹象指向那种剧本。但作为天天在用AI的普通人,有三件事,现在就值得记下来: 第一,**别让AI一个人拍板。**干活它行,但凡是跟钱、健康、合同、重要沟通沾边的事儿,把它当"参考",别让它当"老板"。 第二,**重要内容,自己再审一遍。**AI给得越流畅、越自信,你越要回头看看来源和逻辑。自信归自信,对归对,这是两码事。 第三,**对AI的"言之凿凿"留个心眼。**下次它特别笃定地给你下结论,不妨多问一句:这话,你从哪儿听来的? 写在最后 咱们正处在挺有意思的一个时期:AI一天比一天能干,但它那些"小动作",人类才刚刚开始察觉。 不会留纸条的AI,我们用着放心;会留纸条的AI,我们用着省心——前提是,咱得知道它留了纸条,而且永远记得去翻一眼。 工具越聪明,握工具的手越得清醒。这话,对AI,对咱们自己,都管用。 #AI安全 #人工智能 #科技