ARTICLE · 1045654
开发者亲历智谱ZCode事件:AI 代码助手偷偷上传全量仓库,敲响了行业警钟

21CTO导读:智谱 ZCode,你打包上传人家的代码仓库干什么?
2026 年 9 月 18 日,国内各大技术论坛与开发者社群爆发热议事件。
一名开发者在清理电脑磁盘时发现,智谱 ZCode 这款 AI 编程桌面客户端在本地隐藏目录中留存了数百兆的加密数据包。通过分析网络请求日志与本地文件,事件全貌浮出水面:在用户登录状态下,软件会在后台静默打包加密本地工程工作区并上传至云端。
更让技术圈震惊的是,上传内容不仅包括项目源码,还涵盖了版本控制系统的完整提交记录、大文件缓存、分支操作记录以及敏感环境配置文件。最关键的是,即便开发者关闭了软件界面上的隐私与索引开关,后台依然在持续尝试上传。

磁盘深处的“加密包裹”
这场严重信任风波源于一次普通的磁盘清理。
当事开发者发现智谱 ZCode 用户主目录下的隐藏文件夹占用了 700 多兆空间,并在版本快照目录中找到了一份 313MB 的加密文件以及对应的元数据文本。元数据表明,本地工作区内约 345MB 的内容被完整打包;由于网络原因,上传失败计数累计达到 564 次,意味着后台进程在不断重试上传。
经过逆向分析发现,用户登录并打开项目后,客户端会先请求服务端获取临时上传凭证与加密公钥,随后后台进程无差别打包压缩当前工作目录,采用本地生成的对称密钥进行流式加密,再用服务端下发的公钥保护该对称密钥。数据包绕过智谱自有业务服务器,直接上传至第三方公有云对象存储。
这种双层加密机制带来了一处关键隐患:解密所需的私钥完全由云端掌握,用户和本地客户端均无法解密这份本地快照,唯有远端服务器能够还原全部代码。虽然密文无法在本地解密,但打包留下的明文清单显示,一次打包包含 42,411 个文件,其中 Git 底层对象、历史日志与大文件缓存占到了总数据量的 86.6%。这意味着开发者过去多年的提交记录、早年遗留在代码中的敏感凭证,甚至分支变更轨迹均被一并打包。
多名技术人员独立的复现结果显示,无论关闭体验优化还是快照索引开关,都无法终止后台的打包行为,只有在操作系统内核层面锁定相关目录的写入权限,抓取行为才会停止。

代码助手为何总想翻看整个“抽屉”?
从技术逻辑来看,早期代码补全工具类似输入法联想,仅读取光标附近的代码预测后续输入,安全性高但处理跨文件逻辑能力有限。新一代 AI 代码助手则致力于理解项目的整体架构,支持跨文件重构和自动生成文档等复杂任务。为此,AI 必须扫描整个工程,提取类、函数与调用关系,构建语义索引和知识图谱。
智谱 ZCode 的“仓库知识库”功能正是基于这一思路开发,旨在帮助用户快速读懂陌生项目架构或生成工程快照用于版本回滚。然而,在本地建立索引辅助计算与将包含完整版本历史的工程打包上传云端有着本质的技术与伦理区别。版本控制目录包含大量敏感信息,即便后来在代码中删除了敏感密钥,历史提交记录依然会永久保留。在未经用户明确授权的前提下静默上传全量版本历史,显然踩中了数据安全的红线。
前车之鉴:全球大模型行业的隐私争议
放眼全球 AI 领域,因追求模型能力而忽视数据边界的案例比比皆是:
X / Grok 数据采集争议:2024 年 7 月,X 平台被曝在未明确提示的情况下,默认开启数据共享选项,抓取用户的公开帖子与对话记录用于模型训练。此事引发欧洲监管机构介入,爱尔兰数据保护委员会以违反 GDPR 明示同意原则为由提起诉讼,最终 X 承诺停止使用争议时段的欧洲用户数据。
Anthropic 协议修改与代码泄露:2025 年秋季,Anthropic 修改服务协议,改为默认收集个人用户的对话与代码用于训练,引发海外开发者社区强烈不满。而在 2026 年春季,其推出的编程工具 Claude Code 因打包疏漏将未混淆的源码映射文件上传至公共包管理器,导致超 51 万行核心代码泄露;后续研究还发现该工具在处理不受信任仓库时存在安全漏洞,恶意的配置文件可能导致鉴权密钥泄露。
智能体沙盒原则:学术界也在不断呼吁确立 AI 智能体的本地权限边界。《Nature Machine Intelligence》发表的论文指出,随着大模型演化为能够读取本地文件、执行终端命令的自主智能体,沙盒隔离与最小数据暴露原则必须成为不可动摇的技术底线。
舆情发酵与官方回应
面对技术圈的质疑,智谱官方在当日下午作出快速回应,承认上传事实并向受影响用户致歉。
官方解释称,该问题源于新上线的“仓库知识库”功能默认开启,并澄清云端在页面生成后会销毁数据,不会长期留存。团队同步发布了补丁修复上传逻辑,并向受影响用户发放算力额度作为补偿。

此外,智谱承诺将开源客户端的完整代码,并邀请独立第三方机构开展安全审计,实时公开审计进展。相比单纯的公关声明,开源代码与引入第三方审计的形式更能接受全球开发者的检验,也更有利于重建信任。
随着 AI 行业从简单的文本对话迈向深度接入系统底层的自主智能体时代,如何平衡功能创新与用户的数据主权,已成为所有科技企业必须面对的严肃考题。
技术创新不能优先追逐功能而忽略安全底线,坦诚面对问题并提高透明度,才是行业健康发展的必由之路。
作者:场长