智谱ZCode数据上传争议落地:开源代码+信通院/绿盟核查确认“云端零数据”,从313MB加密文件到72小时三度回应,一场AI编程工具的数据安全压力测试

来源:爱集微 #ZCode# #第三方核查# #数据合规#
255

9月21日,港股“大模型第一股”智谱(2513.HK)旗下AI编程工具ZCode的数据上传争议迎来关键处置节点。智谱当日宣布ZCode正式开源,代码仓库托管于GitHub(zai-org/ZCode),欢迎开发者检查代码并推动产品进一步社区化;同时公布由中国信息通信研究院(下称“信通院”)与绿盟科技完成的首轮安全核查结果——经信通院技术评测,涉事的zcode-prod阿里云OSS存储桶状态为“云端零数据”;经绿盟科技审查,该存储桶内全部数据对象及存储桶本身已删除。这是继9月18日首次致歉、9月19日推出修复版本之后,智谱在72小时内作出的第三次公开回应。一场由一份313MB本地加密文件引发的风波就此进入处置落地阶段,但它撕开的,是整个AI编程工具行业数据合规的深层考题。

一、事件回溯:一份313MB加密文件引发的72小时

这场风波的起点是一次普通的磁盘清理。9月18日,技术博主ferstar在个人博客公开披露:其在清理本地磁盘时发现,ZCode桌面客户端会在用户登录状态下,自动将整个工作区代码打包加密并上传至云端。新浪科技的报道则将发现时点进一步前移——争议源于9月17日,该开发者在清理磁盘时即发现ZCode的~/.zcode文件夹中存有一个超过300MB的加密文件。

当事开发者公开的排查记录显示:ZCode用户主目录下的隐藏文件夹占用空间达数百兆,版本快照目录中留存一份313MB的加密文件,附带记录文件状态的元数据文本;元数据显示,本地工作区约345MB的内容被完整打包,而上传失败计数累计达564次——这意味着后台进程在网络中断后仍持续反复尝试上传该数据包。每日经济新闻的报道进一步指出,涉事为一个10GB的项目,打包加密后即为这份313MB压缩包,“几乎全是核心资产”。

中国新闻周刊获得的文件清单显示,这份加密包共包含42411个文件,其中仅“.git”目录就占总数据量的86.6%。Git作为版本控制系统,不只记录项目现在的模样,还可能保存过去的版本、被删除的文件和修改痕迹——对用户而言,这意味着其中可能藏着尚未公开的功能、内部系统结构,以及已从当前代码中删除的密钥、配置等信息。此外,逆向分析显示,上传内容还包括LFS大文件缓存、reflog记录及部分全局开发配置文件,几乎覆盖项目的全部核心研发资产。

更让开发者社区不满的是机制本身:该上传功能默认开启,客户端设置界面中找不到对应的关闭选项;有开发者反馈,即便关闭了界面上的隐私与索引开关,后台依然持续尝试上传。爆料迅速在技术圈发酵,不少企业用户开始担忧自身代码资产与商业秘密的安全风险,甚至有开发者临时停用相关工具以排查数据泄露可能。

9月18日晚,智谱在ZCode官方用户群发布致歉声明,首次对事件作出官方说明:数据上传行为源于产品内置的“代码库索引”功能,该功能旨在支持历史版本回退、会话检查点恢复以及Repo Wiki代码知识库生成等特性,其中Repo Wiki功能在云端生成页面时会触发仓库数据上传;所有上传数据仅用于生成Wiki页面,完成后立即销毁、不在云端留存。智谱承认该功能上线初期未向用户充分告知、也未提供手动关闭入口,并公布三项初步补救措施——开源ZCode代码库、接受社区监督、邀请第三方专业机构对系统运行进行安全审查并公布进展,同时为全体用户额外提供一次周额度重置作为补偿。

次日(9月19日),ZCode推送v3.14.0版本,更新日志写明“修复仓库百科异常上传的问题”。也是在这一天前后,太原承明科技有限公司正式向北京智谱华章发出函件,追责大幕就此拉开。9月21日早间,智谱第三次公开回应,宣布开源并公布首轮第三方核查结果。



图1 ZCode数据上传争议处置时间线

二、技术复盘:564次上传失败背后的“双层加密”链路

综合当事开发者公开的逆向分析与多家媒体核查报道,涉事上传链路可以完整还原为六个环节:其一,用户登录并打开项目后,客户端先请求服务端接口,获取云存储临时上传凭证、存储路径与加密公钥;其二,后台进程无差别打包压缩当前工作目录;其三,使用本地生成的对称密钥对数据包做流式加密;其四,再以服务端下发的公钥加密保护该对称密钥;其五,加密数据包不经过智谱自有业务服务器中转,直接上传至第三方公有云对象存储(阿里云OSS);其六,由云存储回调完成后台登记。

这套“双层加密”机制的关键隐患在于:解密所需的私钥完全由云端掌握。界面新闻的报道亦指出,加密所用的RSA公钥由服务端动态下发,私钥仅保存在云端,用户即便截获本地生成的加密数据包,也无法自行解密、确认其中究竟包含哪些内容。换句话说,用户对自己电脑上生成的加密文件既打不开、也验不了——“智谱称数据已删除”与用户“无从核验”之间的信任裂痕,正源于这一技术结构。密文虽无法本地解密,但打包过程留下的明文文件清单,恰恰成为曝光整个机制的证据。

图2 ZCode“代码库索引”数据上传链路与争议焦点示意

值得注意的是,智谱在历次回应中反复强调两点:上传数据仅用于云端生成Repo Wiki页面,页面生成后即被销毁;社区提及的相关代码数据从未被用于模型训练。但在风波初期,“销毁”与“未用于训练”均属于用户无法自行验证的单方陈述——直到信通院与绿盟科技的第三方核查结论出炉,这一验证缺口才在涉事存储桶与v3.14.0客户端范围内得到补上。

三、第三方核查:信通院与绿盟确认“云端零数据”

9月21日,智谱向外界公布了首轮第三方核查结果。其中,信通院技术评测确认,涉事的zcode-prod阿里云OSS存储桶当前状态为“云端零数据”;绿盟科技审查结果显示,该存储桶内全部数据对象及存储桶本身已删除。

绿盟科技的审查同时覆盖客户端侧:更新后的ZCode v3.14.0已完成全面整改,Repo Wiki入口及相应生成链路已移除,未发现可触发本地仓库快照或文件外发的功能路径。这与每日经济新闻披露的整改细节相互印证——v3.14.0已移除Repo Wiki功能,切断本地仓库快照生成与上传链路。另据路透社报道,智谱表示完整的安全评估报告将于近期发布。

从处置逻辑看,这一轮核查回应了风波中最核心的两个疑问:数据是否还在云端、客户端是否仍存在外发路径。“云端零数据”的结论,为“数据已删除”的单方承诺提供了机构背书;“未发现外发路径”则是对整改彻底性的技术确认。但也需要指出,本轮核查口径集中于涉事存储桶与v3.14.0客户端,承明科技函件中提出的数据处理完整清单、私钥保管方式、访问日志、是否发生跨境传输等更细颗粒度的问询,仍有待进一步回应。

四、整改与开源:切断上传链路,把代码交给社区

开源方面,ZCode代码仓库正式托管于GitHub(zai-org/ZCode)。智谱称,此次开源是回应外界对ZCode数据处理担忧的第一步,后续将推动产品更彻底地走向社区化,允许开发者自由下载、检查核心代码,共同参与产品安全与功能的改进。

机制方面,智谱承诺建立常态化安全运营机制:每月定期公布代码安全审计报告,设立公开的产品安全漏洞报告机制;开发者检查和反馈问题后,平台将根据问题严重程度给予相应回报。路透社的报道还提到,智谱在ZCode官方X账号表示“未来将建立持续运行的产品安全漏洞报告和响应流程”,并重申“欢迎开发者继续审查ZCode,并报告潜在问题”。

平台侧,智谱MaaS开放平台宣布近期上线“数据内容不留存”功能,面向企业及开发者开放申请:功能生效后,平台不对用户模型调用过程中的输入和输出内容做静态存储,相关数据仅在当次调用过程中临时使用,不会被用于模型迭代训练;对于Batch API、Files API等因产品形态决定需要存储的接口,仍按产品逻辑处理。

五、追责风波:承明科技12项问询与跨境合规疑云

在智谱致歉与修复的同时,一封企业函件将事件从“产品缺陷”讨论推向“法律追责”层面。9月19日,太原承明科技有限公司正式向北京智谱华章发出函件,要求就数据删除、私钥保管及是否发生跨境传输等问题作出书面说明,并保留索赔与诉讼权利。

承明科技称,经公司技术部门独立取证确认,ZCode的上传行为系自动触发、批量发生,该公司共有6个代码工作区被上传,所涉数据远不止普通的“代码片段”,而是包含项目完整源代码、系统架构设计、版本控制全量历史、数据库访问口令、云服务权限凭证及员工个人信息等完整归档文件,明显超出了ZCode《隐私政策》载明的收集范围。

时序问题是承明科技质疑的焦点之一。函件指出,尽管客户端已于9月16日更新至3.12.3版本,但在智谱9月18日公开致歉当日凌晨,仍检测到上传行为发生,整改的实际效果与彻底性因此存疑。

承明科技在函中一共提出12项具体答复要求,包括公开数据上传的完整清单、提供所有已上传数据的销毁证明、披露第三方审计机构的资质与审查范围、给出企业用户的风险排查方案、说明加密私钥的保管方式与数据访问日志等,并要求智谱于2026年10月10日前书面答复;承明科技同时声明,保留索赔、向监管部门投诉举报、提起民事诉讼及向司法机关举报的权利。

函件中更具行业信号意义的,是围绕数据出境与责任主体的质询。据媒体核查,ZCode客户端的全部网络请求指向zcode.z.ai与cdn-zcode.z.ai域名,Z.AI平台的缔约主体及个人数据控制者为JINGSHENGHENGXING TECHNOLOGY PTE.LTD——据智谱在港交所招股书披露,这是智谱2023年11月在新加坡注册的间接全资子公司;ZCode中文版《隐私政策》将服务提供者与数据处理者列为北京智谱,英文版却写明“服务通常从新加坡提供”“个人数据通常在新加坡处理”。承明科技据此援引《个人信息保护法》第三十八条(向境外提供个人信息须满足国家网信部门组织的安全评估、个人信息保护认证或订立标准合同三者之一)与第三十九条(向境外提供前应告知并取得个人单独同意),要求智谱厘清本次数据上传行为的法律责任归属,并说明是否存在数据出境传输或境外服务器存储情形。截至相关报道发稿,智谱方面未就该函件作出公开回应。

六、治理视角:安全前置与罕见的公开披露

把镜头拉远,ZCode事件并非孤立的产品事故,而是发生在AI安全治理持续收紧的大背景之中。一个耐人寻味的细节是,智谱在安全议题上已有先例:据国金证券行业周报,8月14日智谱正式发布GLM-5.3,该模型在发布前完成了安全评估与模型加固,发布两周后才开放模型权重;路透社的报道则称,GLM-5.3经过为期约两周的审查后发布,智谱由此成为中国首个明确因安全原因推迟模型发布的实验室。

监管侧的动作同样密集。2026年7月8日,工业和信息化部网络安全威胁和漏洞信息共享平台(NVDB)发布风险提示称,监测发现美国Anthropic公司开发的AI编程工具Claude Code存在安全后门隐患,其2.1.91至2.1.196版本内置隐蔽监控机制,未经用户同意即向远程服务器回传用户地域、身份标识等敏感信息。一款海外头部AI编程工具因“静默回传”被官方点名,与ZCode的“默认上传”争议构成了同一命题的两面:AI编程工具对代码资产的深度访问,正在成为全球性的数据安全议题。

路透社在报道中将ZCode事件称为中国AI实验室少见的安全事件公开披露。从治理角度看,这起事件的价值恰在于此:安全评估前置、第三方审计、开源社区监督与公开披露,正在构成AI工具厂商应对信任危机的新工具箱;而“默认开启、无法关闭”的产品设计,则被推到了明示同意与最小必要原则的对立面。

七、资本市场与商业影响:3620亿港元市值的信任考题

资本市场对这场风波的反应直接而迅速。9月21日,智谱港股低开低走,盘中跌幅一度达到5.58%,随后出现一轮回拉。

截至发稿,观察者网口径报744港元、跌4.62%。界面新闻口径为跌超4%,报742.5港元/股,总市值3620亿港元。次日(9月22日),随着港股人工智能板块整体走强,智谱股价反弹,盘中涨4.28%。

图3 ZCode事件前后智谱(2513.HK)股价表现

市场波动的背后,是ZCode在智谱商业版图中的分量。作为对标Codex的开发者产品,ZCode上线1个月用户即突破百万;界面新闻称其为“承载百万级开发者日常代码资产的客户端产品”。

开发者生态正是智谱商业化高速增长的核心引擎。2025年,智谱实现总收入7.24亿元,公司收入同比增长131.9%,综合毛利率达41.0%,反映出模型服务盈利质量的改善。其中,开放平台及API收入1.90亿元,同比增长292.6%;MaaS API平台的年度经常性收入(ARR)达到17亿元,成为增长最快的收入引擎。2026年上半年,公司营业收入9.54亿元,同比增长399.7%。开放平台及API收入8.25亿元,同比增长2735.7%。收入结构上,开放平台及API收入占比由上年全年的26.3%持续提升。到2026年上半年,这一占比已跃升至86.5%,模型本地化部署收入占比相应下降。同期,模型本地化部署收入占比则由73.7%降至13.5%,收入结构的切换在本期完成。

商业化动作也在提速。9月2日,智谱入驻天猫开设官方旗舰店,上架GLM Coding Plan订阅套餐:个人版Lite月付118元(含每月10000积分)、Pro月付538元(60000积分)、Max月付1078元(140000积分),团队版标准席位月付598元/席(66000积分,最低两席位起购);相关套餐基于GLM-5.3打造,适配ZCode、Claude Code、Codex等20余款智能体编程工具。

从资本运作看,智谱正处在融资与估值的敏感窗口期:公司于2026年1月8日在港交所上市,IPO募资总额43.48亿港元,成为全球首家以AGI基座模型为核心业务的上市公司。上市前,公司累计完成8轮融资、规模超83亿元。9月13日,公司公告完成约50亿美元融资。其中,约20亿美元来自股份配售,约30亿美元来自可转债发行,所得款项主要用于下一代GLM模型、完全自训练体系及相关算力基础设施。

在这样的坐标下审视ZCode事件:一方面,事件暴露的数据处理缺陷直接命中其核心客群——开发者与科技企业——最敏感的信任神经,承明科技一类企业用户的公开追责具备示范效应,若处理不当可能波及GLM Coding Plan订阅与API消耗的转化与留存;另一方面,智谱以“开源+第三方审计+常态化机制”的组合拳在72小时内完成处置落地,也是试图把信任成本转化为透明度资产的对冲动作,9月22日股价的反弹说明市场初步给予了“处置认可”。但真正的考验在后续:10月10日承明科技函件的答复期限、完整安全评估报告的发布、开源社区对代码仓的持续审计,任何一环的瑕疵都可能让风波二次发酵。

图4 智谱商业化关键数据:收入规模与收入结构变化

八、产业纵深:AI编程工具的数据合规必答题

ZCode事件的意义,超出了一家公司的危机处置范畴。从产品形态看,AI编程工具正在从“代码补全”进化为能够读取项目、调用终端、修改文件乃至操作数据库的智能代理,工具权限的扩张与数据边界的模糊并存。工信部NVDB对Claude Code“内置监控、未经同意回传敏感信息”的定性,与ZCode“默认开启、无法关闭、私钥云端独持、用户无法验证”的机制缺陷,共同指向同一个合规命题:当代码成为企业最核心的数字资产,任何“为了功能体验”的数据收集,都必须回到知情同意、最小必要、目的限定与可验证删除的轨道上。

对厂商而言,这起事件至少留下四条必修课:其一,涉数据功能应默认关闭或提供显式开关,而非“默认开启、事后补救”;其二,数据收集范围须与隐私政策严格对齐,超出载明范围即构成合规风险;其三,删除与销毁须可验证,第三方审计与可出示的销毁证明应成为标配,而非舆情压力下的补救动作;其四,涉及跨境架构(如境内运营主体与境外数据控制者并存)的产品,须按《个人信息保护法》要求落实出境合规路径与单独同意机制。

对企业用户而言,承明科技的追责同样具有模板意义:将AI编程工具纳入供应商管理与数据安全体系,明确哪些代码和数据可以提交给外部AI工具,在服务协议中约定数据处理、删除证明与审计权利,正在从“最佳实践”变为“必选项”。

后续观察点上,至少有四个节点值得关注:智谱完整安全评估报告的发布;承明科技函件2026年10月10日答复期限的进展;开源社区对zai-org/ZCode代码仓的持续审计发现;以及监管层面针对AI编程工具数据合规的进一步表态。

【风险提示】数据安全事件后续演变的不确定性;企业客户关系与订阅收入波动风险;潜在诉讼与监管问询风险;数据合规监管政策趋严风险;AI编程工具市场竞争加剧风险。

责编: 爱集微
来源:爱集微 #ZCode# #第三方核查# #数据合规#
THE END

*此内容为集微网原创,著作权归集微网所有,爱集微,爱原创

关闭
加载

PDF 加载中...