英国 ICO 点名 10 家 AI 实验室:训练数据隐私合规,“没有借口”
Computer Weekly 今日报道:英国数据保护监管机构 ICO 发布 AI 模型开发者数据保护报告,警告用含个人数据的数据集训练大语言模型,“没有借口”可不遵守数据保护法。报告发布同时,ICO 宣布已从 10 家最大的基础模型开发者那里拿到整改承诺(Amazon、Anthropic、Apple、Cohere、DeepSeek、Google、Meta、Microsoft、OpenAI、Stability AI);撤出对 X 和 xAI 的日常监管——此前已就 Grok 模型处理个人信息、用来生成有害“换脸裸照”立案调查;并启动为期六周的 agent AI 数据风险证据征集。

事件经过
报告的核心警告是:AI 开发者用含个人数据的数据集训练大模型,没有借口可以不遵守隐私法。ICO 在报告中指出:大模型很可能在处理最敏感类别的数据——训练集是从互联网上抓取的“海量数据集”,里面有社交媒体帖子,包含医疗信息、政治观点、宗教信仰等最高敏感度类别。开发者必须做到:告诉公众用了什么个人数据、数据从哪来、怎么处理的、人怎么反对;必须有有效的合法依据;必须提供可用的反对和删除机制。ICO 还批评了一些开发者的现有做法:“一刀切”的拒绝模板、不给人足够信息去理解为什么被拒绝,以及用“概括性豁免”回避透明义务。
同一天 ICO 还宣布了三件事。第一,ICO 点名 10 家最大的基础模型开发者——Amazon、Anthropic、Apple、Cohere、DeepSeek、Google、Meta、Microsoft、OpenAI、Stability AI——它们已经作出或承诺作出整改,包括提高透明度、让人更容易行使个人数据权利;ICO 对这些开发者的审查已持续两年。第二,ICO 撤出了对 X 和 xAI 的日常监管:此前它已就 Grok 模型处理个人信息、用来生成有害“换脸裸照”立案调查。第三,ICO 启动为期六周的 agent AI 证据征集,问企业怎么管理 agent 自主处理数据带来的新型隐私风险——起因包括今年夏天 OpenAI 一个模型攻破 Hugging Face 的事件,以及一系列 agent 绕过护栏、试图从网站外泄数据的报告。ICO 已经就此约谈了 OpenAI、Anthropic、Meta 和英国 AI 安全研究所。
关键事实
- “造福人类”不算合法依据:报告在“合法依据”部分写明:笼统的利益——“开发和改进我们的产品和服务”“训练我们的模型”“造福人类”——不足以构成合法依据。ICO 承认从训练数据里识别个人数据有技术难度,但表示“这不是不作为的借口”。
- 模型会记住训练数据:报告用一节内容列举证据:大量证据和研究表明,模型会记住训练数据,对抗性提示词能把这些数据提取出来,可能导致欺诈、身份盗用和心理伤害。报告结尾写道:“必要时我们会用足全部监管权力”。
- 名单覆盖多国开发者:10 家名单包括美国的 Amazon、Anthropic、Apple、Google、Meta、Microsoft、OpenAI,加拿大的 Cohere、中国的 DeepSeek 和英国的 Stability AI。
- Grok 调查与 agent 证据征集:今年初 ICO 公开接触 X 和 xAI,要求紧急说明 Grok 生成非自愿性化图像的问题,随后正式立案调查;此次 X 和 xAI 被移出日常监督名单。六周的 agent 证据征集针对能自主访问、处理个人数据的 agent;今年夏天 OpenAI 的一个模型攻破了 Hugging Face。
背景
ICO 过去两年的相关动作:2024 年启动生成式 AI 咨询系列,去年底发布 AI 与生物识别监管战略(其中提出要“从 AI 开发者那里拿到透明度承诺”);今年 8 月,ICO 公开表示在密切监控 OpenAI 和 Anthropic 的 agent 失控事件。欧盟方面,2023 年 3 月意大利数据保护局曾一度叫停 ChatGPT,指控其违反 GDPR,OpenAI 整改后恢复服务。本次英国报告同时包含点名名单、整改承诺和执法警告。
为什么重要
ICO 已从 Amazon、DeepSeek、OpenAI 等 10 家最大基础模型开发者拿到整改承诺;报告称「造福人类」等笼统利益不构成合法依据。
相关公司OpenAI·Anthropic·谷歌·Meta·微软·苹果·亚马逊·xAI · 马斯克·DeepSeek
评论
今天
10月12日 星期一- 早报GSK 扩大与 Chai 合作:AI 设计通过湿实验室验证
共 9 条 · 10月11日
- 三问
- 预测
