加密之后的安全幻觉
数据从未像今天这样多,也从未像今天这样令人不安。当十亿级用户在手机上留下每一次点击的位置、每一次刷脸的表情、每一份通话与就诊记录时,监管者最本能的反应,便是给这些数据再加一把锁。2025年11月22日,国家互联网信息办公室与公安部联合发布《大型网络平台个人信息保护规定(征求意见稿)》,延续的正是这条"加锁"路线:注册用户超过5000万或月活超过1000万、提供重要网络服务或覆盖多类业务的平台,将被要求指定由管理层成员担任的"个人信息保护负责人",建立专门工作机构,采取加密、去标识化、访问控制、匿名化等措施,应用国家网络身份认证公共服务,每年发布个人信息保护社会责任报告。
这是中国数据治理体系自2021年《个人信息保护法》实施以来又一次标志性的细化。但当我们以"加密+去标识化"为关键词重新审视这份草案,会发现它正走在一条代价昂贵、且被欧美十年实证反复警告过的脚印之上。
加密的合规表演
在大型平台的信息王国里,加密与去标识化更像是两套被精心排列的合规道具。加密保证数据在传输与静态存储时"看起来"安全,去标识化则在数据使用环节切断"直接识别"的痕迹。但这两道工序的真正功能,往往不是保护用户,而是让企业在监管检查、媒体披露与法庭诉讼时,能拿出一份漂亮的合规清单。
这是一种典型的"合规剧场"现象。监管学者普遍观察到,大型平台倾向于将合规支出集中投入到"可被观察、可被审计、可被报告"的环节,例如设立首席隐私官、发布透明度报告、采购第三方认证,而这些恰恰是法律文本中最容易被量化、最容易与"高级管理层"挂钩的部分;真正能改变权力结构的数据最小化、用途限定、可携带权等深层改革,则往往被推迟、稀释或选择性忽略。
加密与去标识化的真正受益者,是写规则的人、审计规则的人和按规则交保护费的人。普通用户得到的是心理安全感,而非真实的控制权。这恰恰是征求意见稿面临的现实困境:当一项政策的执行高度依赖技术手段,而技术手段本身又掌握在被监管者手中时,监管者与被监管者之间的"信息不对称"反而会被合规行为本身放大。
被高估的技术性安全
经济学中关于"被高估的安全"的论述,可以追溯到1970年George Akerlof在《经济学季刊》上发表的"柠檬市场"模型。在信息严重不对等时,买家只能通过降低出价来对冲风险,最终导致高质量产品被驱逐出市场。在数据隐私领域,这一机制反向运作——平台作为数据"卖家"、用户作为数据"买家",但用户既没有定价权也没有拒绝权。监管者试图通过强制加密和去标识化来提振用户信心,结果是用户在长期重复博弈中丧失了辨别真实安全与表面安全的能力,把一切"加密合规"都默认为理所当然。
更棘手的是"道德风险"陷阱。当企业被要求投入大量资源在技术性合规上时,倾向于认为已经"买了保险",于是更放心地收集与使用数据。欧盟数据保护委员会(EDPB)多年评估显示,GDPR生效后大型平台的平均数据收集量并未显著下降,反而因合规带来的法律确定性,跨境数据流转的活跃度出现明显提升。换言之,技术性合规并未抑制数据扩张,反而稳定了扩张的合法性。
去标识化本身也并非牢不可破。多伦多大学学者Khaled El Emam与团队对过去二十年14个公开再识别攻击案例做的系统综述表明:平均再识别成功率达26%,针对健康数据更高达34%;但其中仅有两次攻击的对象是按"既有标准"做过规范去标识化的数据集,针对健康数据的那次成功率仅为0.013%。换言之,去标识化并非全无作用,但它依赖的是"数据环境的封闭性"和"攻击者的算力上限"——这两者在大模型时代都不再是常量。当攻击者拥有跨平台、跨场景的关联算力时,传统去标识化的可逆风险会被几何级放大。
GDPR十年的合规账单
欧盟GDPR是这场全球数据合规运动的母版。自2018年5月25日生效以来,它以"加密、去标识化、匿名化、假名化"一套极为细密的技术性条款,定义了现代数据保护的语言。但十年过去,学术界与产业界留下的更多是一份昂贵的合规账单,而非一份令人安心的安全报告。
IAPP与EY联合发布的《年度隐私治理报告2025》显示,欧洲企业平均每年在隐私合规上的支出高达130万欧元,其中大型企业占据绝大多数。欧盟委员会司法总司2025年的研究披露,57%的欧洲小型企业每年GDPR相关支出在2万至4.5万欧元之间,中位数合规成本约占其营业额的0.2%—0.7%。在罚款一侧,EDPB执法统计显示2024年GDPR罚款达21亿欧元;DLA Piper 2026年初的调查指出,自2018年5月以来累计罚款已突破71亿欧元。IBM《2025年数据泄露成本报告》则提供了另一组数据:拥有经过测试的应急响应计划的企业,每次数据泄露平均可节省266万美元成本——这意味着合规投入中真正有回报的,不是加密与去标识化本身,而是事件响应与组织韧性。
更值得注意的是合规成本的非对称分布。同一份IAPP-EY报告指出,《财富》500强企业平均配备5.7名全职隐私专业人员,而中小企业的合规人员往往不到0.5人。这意味着,越是规模庞大、越具备合规团队的头部平台,越有能力消化GDPR带来的合规支出——而中小平台要么被迫退出欧洲市场,要么被大型平台以并购方式吸收。从结果看,GDPR实施十年后,欧洲数字广告市场的集中度并未显著下降,头部平台的市场份额维持高位。这正是监管捕获的一种"逆向版本"——监管本意是约束强者,实际却为强者提供了新的护城河。
中国《大型网络平台个人信息保护规定》的语境与GDPR并不完全一致——它更强调国家安全与公共利益,更强调数据本地化存储与境内数据中心负责人国籍要求,更强调对未成年人信息的特殊保护。但其"加密+去标识化"的技术工具箱与GDPR高度同构。这让我们必须直面的问题不是"我们能否写出更细的条款",而是"我们如何避免重蹈合规成本与市场集中度的双重陷阱"。
当制度成为唯一解药
在被反复证伪的技术性合规之外,国际数据治理界其实沉淀过若干更具结构性的替代方案。这些方案之所以长期停留在"未被采纳"的边缘,并非因为它们缺乏证据支持,而是因为它们会从根本上动摇平台经济赖以运转的数据集中逻辑。
其一是"数据信托"模式。这一设想在2017年前后由英国开放数据研究所(ODI)系统阐述,源于对个人数据控制权长期被平台集中的反思。数据信托的本质是在用户与平台之间嵌入一个独立的法律实体,由该实体代表用户行使数据收集许可、监督使用目的、决定跨境流转等权利;用户不是放弃数据所有权,而是将管理权委托给一个独立受信方。哈佛大学伯克曼互联网与社会研究中心2021年的政策报告指出,数据信托在医疗研究、城市治理等场景已被实证能显著降低再识别风险,并提高用户对二次使用目的的接受度。
其二是"个人数据金库"(Personal Data Vault)架构。万维网之父Tim Berners-Lee在麻省理工学院主导的Solid项目正是这一思路的代表。用户的数据不再集中存放在平台服务器,而是存放在自己控制的"金库"中,应用通过标准化API按需访问、随时撤回。这是一种从架构层面重构数据流向的方案——它不再要求平台做加密,而是要求平台根本无法物理接触到原始数据。在MIT与多家机构合作的早期试点中,Solid架构在医疗与教育场景的数据泄露事件均出现显著下降,因为数据从未离开用户授权的存储边界。
其三是差分隐私作为算法层面的硬约束。差分隐私通过对统计输出注入经过数学证明的噪声,使得任何单条记录的存在与否都不会显著影响查询结果。苹果与谷歌已在大规模生产环境中部署差分隐私以收集用户输入数据,但仅作为辅助手段;美国人口普查局则自2020年起对人口数据采用差分隐私,彻底放弃了传统的去标识化路径。这一转型的代价是数据可用性下降约5%—10%,收益则是任何第三方都无法通过合理手段从发布数据中反推个人信息。
中国并非没有这些工具的本土实践。早在2022年,国家金融监督管理总局就开始在反洗钱场景试点"数据可用不可见"的多方安全计算;浙江、广东等地的数据交易所,在底层架构上也借鉴了数据信托的部分功能。但这些碎片化、试点化的努力,尚未被整合进大型平台个人信息保护的统一框架之中。
回到《大型网络平台个人信息保护规定》征求意见稿,它应当被视为一次对话的开始,而不是结论。它所携带的"加密+去标识化"工具箱并不错——错的是我们可能再次把技术手段当作目的本身。在大型平台、监管者与十亿用户之间,真正的平衡点不是更多加密、更多认证、更多年度报告,而是把数据流向本身交还给产生数据的人。GDPR花了十年时间证明,仅靠技术性合规不足以重建数字信任;中国有机会跳过这一昂贵的实验期,前提是我们愿意认真对待那些"未被采纳的方案"。
加密之后,谁更安全?这是这份征求意见稿留给所有读者的真正问题,也是下一个十年数据治理的开篇。
