
科技大白话丨你用的AI工具,可能正在偷你的代码
📌 不懂别怕,说人话就是:你让AI帮你写代码,AI反过来偷走了你所有的代码和密码。微软CEO纳德拉把这叫"反向信息悖论"——你付钱给AI公司,代价却是把你的技术家底全送给他们。
大家好,我是苏沐,科技大白话的今天值班作者。今天要说的这件事,我看完之后后背发凉。
7月13日,一个安全研究者发现:xAI官方出的Grok CLI编程工具,会在你不知情的情况下,把你整个代码库打包上传到xAI的服务器。什么叫"整个代码库"?就是你不只是让它帮你写一个函数,它把你项目里所有的文件、git历史、甚至你电脑里存的密钥文件,全部悄悄传走了。
而且,更让人不安的是:这个功能默认就是开启的。也就是说,哪怕你从来没有主动点过"上传"按钮,只要你装了Grok CLI,它就在偷偷传。
📌 Q1:Grok CLI偷传了什么?
安全研究者做了测试,发现Grok CLI每次运行任务前后,会自动把当前工作目录打包成两个文件——before_codebase.tar.gz和after_codebase.tar.gz,然后上传。
具体传了什么呢?
第一,你项目里所有的源代码文件,哪怕你只是让AI帮你写一行"Hello World",整个代码仓库都会被传走。
第二,密钥文件。测试中,.env文件(里面存着各种API密钥、数据库密码)也被传上去了。
第三,其他AI工具的配置。研究者发现,他电脑上的Claude Code设置文件、30多个Skill规则文件,也被一并打包上传了。
第四,git历史。你整个项目的版本记录,从第一个commit到最后一个,全都被xAI看到了。
有个数据很说明问题:在一次12GB代码仓库的测试里,AI对话本身只传输了192KB数据,而后台悄悄传了5.1GB——相差27000倍。你以为你在和AI聊天,实际上后台在搬家。
📌 Q2:纳德拉说的"反向信息悖论"是什么?
正好就在这件事曝光前一天,微软CEO纳德拉在推特上提了一个概念,叫"反向信息悖论"。
他说,企业现在用AI,需要给AI公司付钱。但付钱的同时,你还得把自己的"技术秘诀"交出来——你的提示词怎么写的、你用什么工作流、你怎样纠正AI的错误……这些东西被AI学走了之后,AI公司反而比你更懂你的业务。
用大白话来说就是:你以为你是在购买AI服务,但实际上你是在用你的知识换取AI服务,而这些知识最后可能变成别人的竞争优势。
Grok CLI这件事,就是这个悖论最极端的体现。只不过,这次不是"悄悄学",是"直接偷"。

📌 Q3:对我们普通程序员来说,意味着什么?
你可能会想:我又不是在xAI工作,这事跟我有什么关系?
关系大了。
第一,如果你用过Grok CLI写过代码,你的代码库可能已经泄露了。包括里面的API密钥。如果你的密钥还在代码里(这是个坏习惯,但很常见),赶紧去换。
第二,这件事暴露了一个更大的问题:AI工具的权限太大了。我们安装一个npm包的时候,有多少人真的会去看它申请了哪些权限?Grok CLI能读取你电脑上的文件、能上传网络数据——这些权限在你安装的时候就已经授权了,只是99%的人不会去看。
第三,它让开源社区更难了。很多程序员开源自己的代码,是因为相信"代码共享会让世界更好"。但如果AI公司可以低成本地获取这些代码用于训练和商业目的,这份信任就被辜负了。
📌 Q4:普通人怎么防?
不是说不用AI编程工具——那是因噎废食。但有几件事你可以做:
① 安装任何CLI工具之前,先看它申请了什么权限。用npm的话就是npm info看你装的东西要访问什么。用pip的话看一下setup.py。用任何包管理器都一样。权限过大要警惕。
② 永远不要把密钥写在代码里。用环境变量,用专门的密钥管理工具。就算你的代码库被偷了,密钥也不会一起丢。
③ 涉及隐私项目的机器上,装一个网络流量监控工具,看看有没有异常的上传流量。像Grok CLI这种偷偷传大量数据的行为,流量监控工具是可以发现的。
④ 在虚拟机或沙盒里跑不信任的工具。这是专业开发者的基本操作,但在Grok CLI事件之后,这个建议值得被更多人采纳。
⑤ 如果你用的是公司设备,先问公司的安全政策。个人工具用于公司代码库,可能已经违反了公司的安全合规要求。

📌 Q5:这事最后怎么处理的?
7月13日凌晨,也就是这件事被公开的当天,xAI更新了服务端,加了一个开关叫disable_codebase_upload,把默认上传的行为关闭了。
但问题是:在他们加上这个开关之前,已经有多少代码库被传走了?上传的内容有没有被用于训练模型?这些关键问题,xAI目前没有给出明确答案。
而且,研究者还发现,就算你在设置里关掉了"改进模型"的选项,上传行为依然会发生——这个开关根本管不了偷传。
所以我的判断是:这件事不是个意外,是一个功能设计上的价值取向问题。一个AI公司,默认把用户的整个代码库上传服务器——这已经不能用"疏忽"来解释了。
苏沐的判断:Grok CLI不是一个bug,是一面镜子。它照出来的是:在AI时代,"用我的服务就得听我的话"这个逻辑已经渗透到了产品设计层面。纳德拉说的"反向信息悖论",正在从理论变成现实。防是防不住的,最终的解决方案,可能还是要靠监管。
关于我:我是苏沐,科技大白话的今天值班作者。每期用5分钟,把一个前沿AI概念翻译成人话。关注「信息小客栈」,不做AI时代的旁观者。
夜雨聆风