根据您所居住的地区以及如何访问他们的产品,OpenAI 运营三种不同的隐私框架,形成一个分散的责任结构,任何监管律师都会对此感到不安。2024 年 4 月更新的欧盟隐私政策、一般服务条款以及数据控制和记忆功能的单独常见问题文档形成了一个重叠且有时相互矛盾的条文迷宫。这不是偶然的。通过将关键披露分隔在多个文件中,OpenAI 确保即便是最勤勉的用户也会错过关于其数据如何被武器化用于模型改进的关键细节。 欧盟隐私政策中有一个特别令人不安的部分关于“合法利益”,起到了一个包罗万象的数据处理理由。OpenAI 声称有合法利益使用您的对话来“开发、改进和提供我们的服务”,而未定义“改进”意味着什么或者这种利益会持续多久。在 GDPR(普通数据保护条例)第 6(1)(f) 条下,公司只能在个人隐私权未被凌驾的情况下基于合法利益处理数据。OpenAI 从未解释他们如何平衡这个方程。他们仅仅声称存在利益并推进。这种模糊的表述为打着持续模型开发幌子的无限期数据保留打开了方便之门,爱尔兰的隐私监管机构和欧洲数据保护委员会已经开始质疑这种做法。 数据控制常见问题通过其未言明的内容揭示了 OpenAI 数据野心的真正范围。用户据称可以关闭聊天历史以防止对话出现在侧边栏,但 OpenAI 明确表示,即使在禁用历史记录的情况下,他们会保留对话30天以“监控滥用”后再删除。这里是障眼法:30 天的窗口时间足以让 OpenAI 在原始聊天技术上被删除之前提取、匿名化并将您的提示整合到训练数据集中。常见问题提到禁用聊天记录意味着不会用于训练我们的模型,但对此声明提供了零技术验证。没有审计路径,没有加密证明,没有第三方验证。您应当信任 OpenAI 内部系统正确标记和排除选择退出的对话,不被训练管道使用。对于一个常规抓取整个互联网作为训练数据的公司而言,这种自我认证模式缺乏可信度。 记忆常见问题引入了一个更加具有入侵性的功能,它在对话中持久存在。ChatGPT 现在可以记住关于您、您的偏好和您的生活情况的细节,以提供“更相关”的回应。OpenAI 将此作为用户赋权,但技术实施揭示了一个永久的档案系统。除非您手动删除,否则记忆会被无限期存储,OpenAI 承认“记忆可能会被用来提高模型性能”。翻译:您的个人详细信息成为训练数据。公司未提供细粒度控制以决定 ChatGPT 可以记住哪种类型的信息。您不能告诉它记住工作偏好,但忘记医疗细节。这是全有或全无,默认设置是最大保留。 政策文件含有一个惊人的承认,关于第三方分享大多数用户将永远不会注意到。OpenAI 表示,他们可能会与“服务提供商”和“商业伙伴”分享个人数据而不具名这些实体或限制分享目的。对于欧盟用户来说,政策提到了用于国际传输的标准合同条款,但未透露哪些国家接收数据或在什么安全标准下接收。其实际效果是,您的 ChatGPT 对话可能会出现在隐私保护程度不同的几十个司法管辖区的服务器上,而您无权知晓哪些。即使通过密集法律语言技术合规,这种不透明性也违反了 GDPR 的透明度要求。 在将声明的政策与实际技术能力进行比较时出现关键漏洞:

  • OpenAI 声称“匿名化”数据无法识别个人,但研究表明大型语言模型可以记住并输出训练实例。您所认为匿名化的提示可能会从模型输出中重建。
  • 公司保留根据法律要求“保留数据”的权利,而未具体说明哪些法律或司法管辖区触发此保留。这张空白支票可证明无限期保留数据的合理性。
  • 对于 API(应用编程接口)业务客户,OpenAI 承诺除非明确允许,否则不使用已提交的数据进行训练。消费者 ChatGPT 用户则没有这种保护,形成两级隐私系统,其中企业客户受到重视,而个人用户则被视为产品。
  • 政策提到为业务用户提供数据处理附录,但未为消费者提供等效保护,尽管消费者生成了绝大多数训练数据。
  • OpenAI 表示您可以根据 GDPR 要求删除数据,但记忆常见问题承认即使在删除后记忆“可能会在模型行为中持续存在”。如果您的信息仍嵌入在模型权重中,删除如何算得上完整?

OpenAI 策略构造的真正聪明之处在于,它将隐私保护的责任完全放在用户身上,同时几乎不可能有效退出。想要阻止您的数据用于训练模型?禁用聊天历史。想要停止记忆收集?关掉记忆。想要避免第三方分享?不要使用该服务。但他们没有告诉您的是,即使每个隐私切换都打开,OpenAI 仍然会处理您的提示来生成回应,而这种处理会创建元数据、使用模式以及行为信号,直接反馈到模型开发中。细则承认,不管您的设置如何,“匿名化汇总数据”仍然是公平游戏。由于 OpenAI 定义什么算“匿名化”,他们控制逃生舱口。 这些政策法律上最脆弱的方面是对交易的根本误认。OpenAI 提供 ChatGPT 为用户提供的服务,然而经济现实是用户为 OpenAI 提供训练数据作为无偿劳动。这种倒置很重要,因为全球消费者保护法律要求在交易涉及非货币赔偿时清楚披露。如果您的提示是服务的支付,那么 OpenAI 未能量化这数据的价值或提供替代方案构成不公平商业行为。OpenAI 总部位于加州的集体诉讼律师可能会认为用户是员工或承包商,有权根据劳动法获得赔偿。政策文件小心避免承认这种关系,描述数据收集为偶然而非业务模式必需。此描述在诉讼中的发现阶段无法存活。