2026-09-21 22:17:18
每经记者|可杨 每经编辑|毕陆名
一场围绕代码上传的数据安全争议,将智谱旗下AI编程产品ZCode推至舆论中心。
近日,有开发者发文称,ZCode会将工作区快照打包,其中包含完整的Git历史,并将加密后的数据上传至阿里云对象存储服务(OSS)。
围绕ZCode代码及Git历史数据上传争议,智谱近日回应称,社区提及的相关代码数据不会留存,公司也从未将其用于模型训练。
智谱方面表示,ZCode已于今日(9月21日)正式开源,接受开发者检查与社区共建。此外,智谱MaaS平台宣布近期上线“数据内容不留存”功能,企业和开发者开通该功能后,可在模型调用完成后减少平台侧数据持久化保存。
此次风波最早由开发者社区对ZCode代码库数据处理行为的质疑引发。
9月18日,ZCode发布情况说明,承认相关问题源于产品的代码库索引功能。
根据情况说明,代码库索引旨在帮助用户在本地生成仓库索引,以支持包括历史版本在内的会话检查点恢复、历史版本回退及RepoWiki等功能。其中,Repo Wiki用于生成代码仓库的说明文档和知识页面,在生成Wiki页面时,可能会触发仓库数据上传。
ZCode表示,Wiki页面在云端生成后,相关上传数据会立即销毁,不会保存。由于该功能在上线初期默认开启,导致部分用户受到影响。目前,相关问题已经修复。
21日,智谱进一步说明整改和数据处理情况称,目前,ZCode已正式开源,交由社区监督,公司还将建立常态化的产品安全漏洞响应机制,欢迎开发者持续检查、反馈问题,并根据问题严重程度给予相应回报。
针对开发者关注的数据去向,智谱承诺,社区提及的代码数据没有留存,也从未被用于模型训练。
智谱方面表示,完成整改后,已邀请中国信息通信研究院和绿盟科技开展安全审计。其中,中国信息通信研究院技术评测确认,zcode-prod阿里云OSS存储桶状态为云端零数据;ZCode v3.14.0客户端已移除Repo Wiki功能,切断本地仓库快照生成与上传链路。绿盟科技审查则确认,相关存储桶及全部数据对象均已删除。ZCode v3.14.0已移除Repo Wiki入口及生成链路,未发现可触发本地仓库快照或文件外发的功能。
ZCode争议发生的另一面,是以API调用、Coding Plan订阅、ZCode等产品形态构成的Coding业务,正成为智谱商业化的重要入口;ZCode则是这一业务布局中的AI编程产品,通过Harness(模型运行与编排框架)承担上下文管理、工具调用、任务调度、缓存及结果校验等功能,以改善模型在真实工程中的表现。
在2026年半年度业绩会上,智谱AI创始人兼首席科学家唐杰将智谱的业务发展划分为三个阶段。
2025年以前,智谱主要耕耘本地化部署业务;2025年年初以后,智谱逐步进入以Coding为代表的第二阶段。
唐杰表示,这一阶段,模型从知识驱动走向任务驱动,编程能力提升推动公司API和订阅制Coding Plan快速增长。智谱也在这一阶段主动收缩本地化部署模型软件授权业务,转向持续提供可调用、可扩展、可量化的智能服务。
智谱在其2026年半年报中提到,从Coding走向Co-work Coding是当前消耗最大、验证最充分的应用场景。依托代码生成、工程理解、工具调用与长程任务能力,智谱正由代码辅助向软件开发全流程延伸。
在这套业务体系中,ZCode承担着连接底层模型与实际开发任务的角色。半年报介绍,ZCode通过Harness,即模型与工具之间的运行和编排框架,承担上下文管理、工具调用、任务调度、缓存及结果校验等功能,以改善模型在真实工程中的表现。
用户规模方面,ZCode已进入百万用户阶段。8月11日,ZCode官方公众号发布产品升级消息时称,ZCode是一款针对GLM深度优化的国产Coding Harness,已经成为百万开发者使用GLM编写代码的入口。
根据东吴证券研报,ZCode上线一个月后,即8月中旬,用户数突破100万;至9月中旬,用户数又增长一倍。
在智谱的业务规划中,Coding也并非最终目的地。
唐杰在半年业绩会上表示,智谱今年将进入第三阶段,即Agent与Co-work同时到来。随着GLM模型在智能体规划、工具调用及持续执行长程任务方面的能力提升,业务正由Coding单点应用向软件工程、网络安全、数据分析及复杂自动化等高价值场景延伸。
对于Co-work方向,智谱正尝试将模型连接企业数据、工具和系统,嵌入采购、财务、客服、研发及IT运维等环节。
此外,智谱在半年报中曾披露,伴随GLM-5.3发布,公司同步启动“开源的盾”计划,包括对重点开源项目开展持续安全审计、向开源社区免费提供模型额度与防御入口,以及在ZCode中提供代码审计功能。
此次ZCode事件涉及的争议,也是AI编程工具能力不断扩大后需要面对的数据合规问题。
上海交通大学数据法律研究中心执行主任何渊对每经记者表示,AI编程工具为了完成代码解释、补全、调试和重构,读取一定范围代码本身并不当然违法,争议的核心在于,平台实际读取和上传的数据范围,是否超出了用户的明确授权和合理预期。
何渊指出,用户要求工具分析某个文件,并不意味着同意客户端扫描、打包并上传整个代码仓库,更不等于授权处理完整Git历史。如果用户主动启用生成整个代码库Wiki等功能,平台可以基于功能需要读取较大范围文件,但仍应事先明确告知处理范围,尤其应说明是否涉及“.git”目录、历史版本、隐藏文件、配置信息和密钥。若用户仅针对单个文件提问,客户端却在后台打包整个工作区,则可能涉及超出最小必要范围的问题。
这一问题之所以受到开发者关注,与代码仓库的数据构成直接相关。
何渊强调,代码库并不是单一性质的数据。源代码本身未必属于个人信息,但完整Git仓库中可能包含开发人员姓名、邮箱、账号信息、客户测试数据、内部服务器地址、API密钥、访问令牌以及已被删除但仍留存在历史版本中的文件,还可能涉及企业未公开的源代码、算法、系统架构等商业秘密。
因此,对代码库的法律判断需要根据具体数据内容,分别适用个人信息保护、数据安全、网络安全、商业秘密及合同规则。
对于“加密上传”问题,他认为,加密属于数据安全措施,并不等同于匿名化,也不能替代合法处理依据、充分告知和最小必要原则。如果服务提供者仍掌握解密能力,加密后的数据依然可能被恢复和处理;同样,“使用后立即删除”只能降低长期留存风险,并不能回答最初的数据收集是否合法、是否必要。
从更广泛的行业应用来看,何渊认为,此次事件反映出AI编程工具的共同合规风险。随着相关工具从代码补全升级为可以读取项目、调用终端、修改文件和操作数据库的智能代理,服务商需要建立更细化的文件级和功能级授权机制。对企业用户而言,也应将AI编程工具纳入供应商管理和数据安全体系,明确哪些代码和数据可以提交给外部AI工具。
在ZCode争议发生后,智谱还公布了另一项与数据安全有关的产品安排,智谱MaaS平台9月20日晚宣布,近期将上线“数据内容不留存”功能。功能生效后,平台不再对用户输入、输出进行静态存储,相关数据仅用于完成当次模型调用。
企业和开发者可以通过MaaS控制台提交申请,具体生效时间和适用范围以平台确认结果为准。
根据智谱说明,Batch API(批处理接口)、File API(文件管理接口)等需要在平台侧持久化保存任务或文件的功能,不在该机制的覆盖范围内。对于法律法规要求留存,以及核查涉嫌违规或滥用行为的情况,平台可能按照有关要求留存相关数据30天及以上。
零数据留存在海外已经是头部平台面向企业客户的标配能力:OpenAI、Anthropic都提供,同样需要申请,同样保留合规例外。
封面图片来源:每经媒资库
如需转载请与《每日经济新闻》报社联系。
未经《每日经济新闻》报社授权,严禁转载或镜像,违者必究。
读者热线:4008890008
特别提醒:如果我们使用了您的图片,请作者与本站联系索取稿酬。如您不希望作品出现在本站,可联系我们要求撤下您的作品。
欢迎关注每日经济新闻APP