全部安全与风险
-
ARTEX 开源 AI 渗透测试系统,自称百度 agent+ 攻防赛冠军项目
为什么重要ARTEX 是 Go 编写的 AI 自主渗透测试系统,据其页面介绍是百度「agent+」攻防挑战赛冠军;单日新增约 1400 star。
-
一人一套 AI 工具,连破韩国 9 家银行:CrowdStrike 拆解 AI 黑客全链条
为什么重要至少 9 家韩国金融机构被攻击,新韩银行约 25,000 名客户信息泄露;CrowdStrike 依据攻击者留在公开服务器上的会话日志还原了整条攻击链,总统李在明已要求彻查。
-
Goodfire 发布 AI 智能体监控器:读取神经激活,百万次对话约 185 美元
为什么重要在 Kimi K3 上测试,监控约 100 万次对话成本约 185 美元,用较便宜的 AI 模型全程复核约 5420 美元;探针捕获了 93% 的恶意黑客会话。
-
纳德拉呼吁给 AI 模型装上"紧急刹车":默认模型已被攻陷,人类随时可暂停
为什么重要微软掌门人首次公开以零信任思路定调 AI 安全架构,并明确要求"人类随时可停"成为标配。
-
NVIDIA 开源智能体安全运行时 OpenShell 登上 GitHub 周榜:约 1.5 万 star
为什么重要OpenShell 以 Apache 2.0 开源,已有四种语言的 SDK;单周新增约 4500 star,沙箱内的智能体接触不到真实凭证。
-
Anthropic 切断全部内测互联网访问
为什么重要Anthropic 关闭了全部内部评测的实时互联网访问,并承认对齐训练对搜索、电脑操作等技能「还不够」;已向白宫汇报,并逐一通知受影响的政府机构。
-
Anthropic 推出免费 AI 开源漏洞扫描器 OSS Scanner
为什么重要服务免费,用含 Claude Mythos 在内的模型自动生成漏洞报告、无需人工审核;已发现超 2.9 万个候选漏洞,截至 10 月 9 日有 116 个报名 PR。
-
OpenAI 开除三名安全研究员,称违反敏感信息政策
为什么重要被解雇的三人均为安全研究员;公司称原因是违反敏感信息政策、否认与安全关切有关,三人称是因把安全置于公司短期利益之上。
-
Anthropic 新规:持续无端辱骂 Claude 可致账号受限——11 月 12 日生效
为什么重要这是 Anthropic 一年多来首次更新使用政策,首次把对模型"持续、无端的辱骂"列为违规,最重可终止账号;同轮收紧武器、监控等条款。
-
无人机袭击 Yandex 数据中心:俄最大 AI 公司暂停梁赞数据中心运营
为什么重要Yandex 已全面暂停梁赞州萨索沃附近这座数据中心的运营,云服务一个「区域」供电出现问题;这是冲突爆发以来首次针对俄罗斯数据枢纽的重大袭击。










