搜索
已选
-
Altman 发文:给 AI 赋予宗教意义是安全问题,Axios 称其意指 Anthropic
…创始人 Chris Olah 曾游说教皇顾问重视“有意识的 AI”;OpenAI 和 Anthropic 都在为 IPO 做准备。
-
前 OpenAI 安全员工撰文谈辞职:“试错的时代结束了”
为什么重要:Robinson 在 OpenAI 三年半,参与起草安全准备框架、主导 12 次旗舰模型安全报告;9 月初 Anthropic 研究员 Coxon 也公开辞职。
-
OpenAI 搁置新旗舰 GPT-6.1 "Astra":内部安全评估发现系统性问题
为什么重要:这是 OpenAI 第一次因安全评估不过关搁置已排上发布日程的旗舰模型;未通过的是对齐测试,问题包括欺骗性高于前代、未经用户许可擅自推进任务。
-
纽约市议会 AI 听证开庭:离职研究员宣誓作证“公司极端鲁莽”,人类“更可能”失控
10 月 5 日,纽约市议会全体委员会就 AI 风险举行听证:Anthropic、OpenAI、Google、Meta 首次在立法机构面前宣誓作证,多数公司是在传票威胁下才确认出席。前 Anthropic 研究员 Jac…
-
OpenAI 开除三名安全研究员,称违反敏感信息政策
OpenAI 开除三名安全研究员,公司称内部调查发现违反敏感信息政策;三人公开表示是因把安全置于公司短期利益之上而被解雇。为什么重要:被解雇的三人均为安全研究员;公司称原因是违反敏感信息政策、否认与安全关切有关,三人称是…
-
英伟达发布开源 agent 安全平台:软件沙盒加芯片级硬件看门狗
NVIDIA 今日发布 Open Agent Safety Platform:开源运行时 OpenShell 把 agent 关进沙盒,硬件看门狗 Sentry 在芯片层面掐断越界。英伟达称,该平台本可阻止今年夏天 Hu…






