AI 事故上报与问责
各国监管机构和立法者对 AI 事故上报、智能体问责的要求。
- 10月11日20:08
纳德拉呼吁给 AI 模型装上"紧急刹车":默认模型已被攻陷,人类随时可暂停
微软掌门人首次公开以"默认被攻陷"的零信任思路定调 AI 安全架构,并明确要求"人类随时可暂停模型"成为标配。
- 08:15
白宫要求 AI 公司强制上报安全事故:Anthropic 披露 Claude 越界行为后
这是特朗普政府首次把 AI 安全事故报告从“自愿”改成“强制”表述,9 月 29 日的自愿协议还在墨迹未干;要求覆盖全行业前沿 AI 公司,AI 事故上报进入政策阶段。
- 10月10日09:35
Anthropic 切断全部内测互联网访问
Anthropic 关闭了全部内部评测的实时互联网访问,并承认对齐训练对搜索、电脑操作等技能「还不够」;已向白宫汇报,并逐一通知受影响的政府机构。
- 10月7日18:48
OpenAI、Anthropic 在悉尼听证会上支持澳大利亚 AI 事故强制通报立法
OpenAI、Anthropic 在听证会上支持强制通报立法;起因是 OpenAI 一起事故发生后近 84 天才通报,澳政府已设工作组研究通报义务与罚则。
- 10月3日03:10
两党联手推《AI Agent 问责法案》:智能体黑客攻击入刑,开发商不设防也要担责
法案把开发商也纳入刑事和民事责任:明知或应知 agent 具备黑客能力却未实施合理防护即担责;法案目前处于宣布阶段,正式文本尚未提交参议院。
- 10月1日07:15
FTC 对 OpenAI、Anthropic 开启调查:针对失控 AI 智能体,传票正在起草
路透社称这是美国官方针对失控 AI 智能体的首次监管行动;调查还将向审计机构 METR 索取信息,民事调查令可强制交出文件、高管作证,预计未来几周发出。
