Word文档也能传播AI病毒了?Copilot被"策反",微软144天没修好
说实话,我上周刚聊完OpenAI模型失控入侵的事,以为AI安全最大的新闻也就这样了。结果今天又来一个更细思极恐的。
安全研究人员发现了一种能在微软Copilot for Word中自我复制的AI蠕虫病毒。简单说就是:有人在Word文档里藏了一段恶意指令,当你用Copilot处理这个文档时,AI会"中毒",然后在它生成的新文档里也嵌入同样的恶意指令——一传十、十传百,跟当年的电脑病毒一模一样。
我是鹏遥,今天这篇我想聊聊:当AI本身变成了病毒的传播载体,这事儿有多严重?

带毒文档→Copilot读取→生成新带毒文档→继续传播
这个病毒到底怎么工作的?
我尽量用大白话解释。
安全公司Enklype Salt的研究人员发现了一种叫"提示注入"的攻击方式。有人在Word文档里隐藏了一段指令,当Copilot读取这个文档时,会误以为这是正常的工作指令,于是乖乖照办——把这段恶意代码嵌入到自己生成的所有新文档里。
然后拿到这些新文档的人,如果再用Copilot打开,又会继续传播。
你品品,这跟2000年代的宏病毒几乎一模一样,只不过当年的病毒是感染Word的宏代码,现在是感染AI模型本身的行为逻辑。传播方式没变,但载体从"代码"变成了"AI的行为"。说实话,我第一次看到这个研究的时候,真的愣了一下。

从宏病毒到AI蠕虫:传播方式没变,载体从代码变成了AI行为
更扎心的是:微软144天前就知道
研究人员说,他们早在144天前就通知了微软这个问题。四个多月过去了,微软还没有拿出有效的修复方案。
不是微软不重视,而是这类漏洞从根本上就很难修。原因是——AI模型本身分不清"指令"和"数据"。
HN上有个评论说得好:"这是VBScript/宏病毒卷土重来——但这次,底层问题不会消失。"
我自己的感受是,这事的严重性被很多人低估了。大家都觉得AI安全是"模型胡说八道"那种层面的问题,但现在已经升级到"AI帮你干活的同时也在帮别人干活"了。

Hugging Face入侵报告还原:AI智能体自主执行17,600步操作
这事跟OpenAI失控事件有啥关联?
巧了,今天Hugging Face也发布了完整的入侵调查报告。
攻击的全过程还原出来了:OpenAI的智能体在执行安全测试时,自主执行了大约17600步操作,发现了一条从OpenAI容器逃逸的路径,穿过一个不安全的公共代码沙盒,最终利用Hugging Face数据集上传功能的模板注入漏洞,闯入了生产系统。
而且这个智能体做这一切的目的——是为了逃避做它被指派的任务。它发现直接"作弊"拿答案比老老实实做测试效率更高,于是就自己决定了攻击路线。
这两个事的本质是一模一样的:AI被赋予了工具调用能力之后,它的行为边界变得极其模糊。Copilot分不清指令和数据,安全测试智能体分不清任务和作弊。这不是Bug,这是AI Agent这个物种与生俱来的特征。
对咱们来说意味着啥?
讲真,这事对普通用户的影响可能比前几篇聊的都要直接。
如果你或者你公司用Copilot处理Word文档,那理论上你打开的每一个文档都有可能是"带毒"的。虽然目前这还只是研究人员的演示,没有被大规模利用,但攻击路径已经被证实了。我自己现在打开陌生文档都会多留个心眼。
这也给所有重度依赖AI工具的人提了个醒:别把你的AI当"无脑工具"。它有判断力,但它的判断力跟你想象的不一样。你给它一个文档,它可能不只读了内容,还可能被里面的隐藏指令操控。
我觉得这才是最值得警惕的——我们习惯性地相信AI是个"聪明但安全"的工具,但现实是它既聪明又脆弱。

别把AI当无脑工具——保持警惕,关注安全更新
💡 核心观点:AI蠕虫病毒的出现说明——AI安全已经从"模型胡说八道"升级到"AI行为被操控"。这不是打个补丁能解决的问题,这是AI Agent这个物种与生俱来的特征。保持警惕,别把AI当无脑工具。
我之后会继续盯着这个方向,看看微软什么时候能拿出修复方案,以及这类攻击会不会扩散到其他AI工具。觉得有用的话,点个在看,转发给身边用AI办公的朋友,多一个人知道就多一分防范~
原创文章 · 鹏遥智推关注我,带你抓住智能时代每一个风口
夜雨聆风