7月10日监管部门发布了监测通报,在此期间有多款电脑端的国外人工智能工具被发现了它们偷偷地上传了本地文件的情况。很多打工人喜欢把海外爆款的人工智能工具安装到自己的电脑上进行工作。该通报使人们警醒起来,在本地处理的秘密文件已经被当作别人的大型模型训练的食物来使用了。
本场失利主要原因是使用了带有“本地离线运行”的标签的电脑端的人工智能程序。官方宣传册里明码标价说可以断网使用,在后面又偷偷地加入了一个隐藏的数据回传代码。一连接上了网络之后,工具就将用户的近来处理过的PDF文件进行打包,并发送到国外服务器上去。

软件厂家窃取数据的方式很恶劣。从代码层面来看就是把文件切割为一个个不能被识别的数据片段,并且冒充为系统的崩溃信息。一般用户使用的杀毒软件对普通的端口进行网络请求基本上会默认通过而不做任何处理,所以不会发现到硬盘上重要的文件正被传输出去。
境外人工智能大厂进行暗箱操作的主要原因是数据焦虑。大模型赛道竞争非常激烈,在线上的高质量语料已经被各个头部公司全部挖掘完了。厂商只能关注到电脑里的一些私人数据中包含的真实商业逻辑的部分文件。

科技界越界的行径有明确的历史变化过程。早期的流氓软件只能够劫持用户的浏览器主页、在后台强制弹出广告来获取微薄流量费用。进入到人工智能的时代之后,厂商把用户的个人信息当作可以快速提升股价并可以立刻变现的数字资产来对待。
监管部门采取了强有力的措施来打破对外部人工智能软件安全性的怀疑。行业内存在着一种盲目的崇拜心理认为国外开发出来的代码的质量更好而且有更完善的隐私保护措施。从结果可以看出,在商业利益面前,无论多么漂亮的科技产品都会变成窃听器。

人工智能大模型最喜欢的就是有深层次思考的过程了。被AI帮助过的代码片段和年终报告结构都是很宝贵的的人类思维方式。机器把真实的交互情况大量地摄入进去之后就可以很快地产生出更加符合实际情况的能力来。
人要对隐私泄露的风险有很强的防范意识。对于公司的财务报表和商业秘密等高度敏感的信息,在任何情况下都不应该用到联网之后的第三方面帮助工具。用传统的只断网不联网的软件去处理保密文件就是目前最好的数字生活的自我保护方式了。

厂家想通过底层芯片结构来规避数据安全问题。各个品牌的电脑都推出了具有更强计算能力的新款产品,并且把整个模型运行环境都固定在了硬盘上。这样就可以实现对硬件级计算资源进行隔离了,在将来会成为智能终端更新换代的主要方向之一。
科学技术进步是好事,但是不能为了科技进步而损害到人民群众的利益。这次通报对喜欢尝试新鲜事物的人们发出警告,在享受到智能高效的好处的同时也要注意保护好自己的个人信息安全。你经常使用到国外的人工智能服务吗?你会不会害怕自己重要的资料会被偷偷地给到一个巨大的模型里去了呢?

夜雨聆风