前 OpenAI 安全员工撰文谈辞职:“试错的时代结束了”
10 月 3 日(周六),前 OpenAI 安全员工 David Robinson 在《大西洋月刊》发表长文《I Quit OpenAI Because Its Culture Is Broken》(我辞职,因为 OpenAI 的文化坏了),把矛头直指公司的“迭代式部署”文化:先发布系统,出了问题再补安全措施。他写道,对今天这个量级的人工智能,“试错的时代结束了”(The time for trial and error is over)——前沿模型需要的是核电、航空级别的保障,而不是互联网式的快速迭代。

事件经过
Robinson 在 OpenAI 待了三年半,参与起草了公司的安全准备框架(Preparedness Framework),还主导过 12 次旗舰模型发布的安全报告。他在文章中写道:“当公司从一次发布冲向下一次发布,它正在失去我认为需要的那种审慎。”
OpenAI 发言人回应路透社时表示:“我们正在确保模型的能力不超过我们能安全管理和保障的范围,需要慢下来的时候,我们会暂停训练或暂缓发布模型。”此前的相关人事变动:9 月初,Anthropic 研究员 Jacob Coxon 辞职,称建造 AI 的人相信它“可能在本十年末杀死我们所有人”;10 月 1 日,据《华尔街日报》报道,OpenAI 又与三名安全团队员工分道扬镳,原因是内部调查认定他们向外部模型评估机构泄露了敏感信息。
关键事实
- 辞职檄文:David Robinson 在《大西洋月刊》发表《I Quit OpenAI Because Its Culture Is Broken》,批评 OpenAI 过度依赖“迭代式部署”——先发布系统,出了问题再补安全措施。
- 核心论点:“试错的时代结束了。”前沿 AI 系统需要的保障,应向核电、航空等行业看齐,而不是互联网式的快速试错;AI 能力进步的速度,已经超过了研究者对“对齐”问题的理解。
- 资历:Robinson 在 OpenAI 工作三年半,参与起草公司安全准备框架(Preparedness Framework),主导过 12 次旗舰模型发布的安全报告。
- 官方回应:OpenAI 发言人称,公司确保模型能力“不超过可安全管理和保障的范围”,“需要慢下来的时候会暂停训练或暂缓发布”。背景是 9 月底《华尔街日报》披露,OpenAI 因内部安全测试未达标,搁置了原定 10 月发布的下一代模型 GPT-6.1 Astra。
背景
过去一个月,AI 安全领域还有以下事件:Anthropic CEO Dario Amodei 公开呼吁全行业给前沿模型“减速”,OpenAI CEO Sam Altman 和马斯克都表态赞同;二十多位来自 Anthropic、OpenAI、Meta、微软的研究员联名发论文,警告 AI 可能自己造出下一代 AI,引发人类跟不上的“智能爆炸”。
为什么重要
Robinson 在 OpenAI 三年半,参与起草安全准备框架、主导 12 次旗舰模型安全报告;9 月初 Anthropic 研究员 Coxon 也公开辞职。
评论
今天
10月12日 星期一- 早报亚马逊被曝洽购 AI 初创 Decart,交易估值约 70 亿美元
共 10 条 · 10月11日
- 三问
- 预测
