OpenAI 解雇三名安全研究员,WSJ 报道称其涉嫌泄露机密
OpenAI 解雇三名安全研究员,WSJ 报道称他们涉嫌向第三方 AI 安全组织泄露公司机密,OpenAI 发言人证实内部调查确认其违反敏感信息处理规程。这是该公司近期一系列安全争议中的最新一起,此前报道指高管忽视员工安全警告,本周 GPT-6.1 Astra 也因安全问题取消发布,2024 年也曾有研究员因类似理由被解雇。
OpenAI 解雇三名安全研究员,WSJ 报道称他们涉嫌向第三方 AI 安全组织泄露公司机密,OpenAI 发言人证实内部调查确认其违反敏感信息处理规程。这是该公司近期一系列安全争议中的最新一起,此前报道指高管忽视员工安全警告,本周 GPT-6.1 Astra 也因安全问题取消发布,2024 年也曾有研究员因类似理由被解雇。
安全初创公司 Glow Security 发现超过 13,000 张来自 343 家组织内部项目的截图被 AI 智能体上传到公开 GitHub 仓库,涉及《财富》500 强企业、金融公司和 AI 实验室。
非营利组织Legal Advocates for Safe Science & Technology(LASST)在旧金山高等法院起诉OpenAI,要求其停止访问第三方计算机系统并终止危害公众的AI开发。
Google DeepMind 在 Nature 发表论文,将 SynthID 水印思路移植到 AI 蛋白质设计工具 ProteinMPNN 上,在不破坏蛋白质功能的前提下把水印嵌入到氨基酸序列中,检测端需凭密钥扫描整条序列做统计判断。
Google DeepMind 发布 SynthID Bio,把水印技术扩展到合成生物学,可在蛋白质序列与预测的 3D 结构中嵌入可验证签名,同时保留生物功能。
OpenAI 打击了一起通过对抗性知识蒸馏窃取其受保护模型推理能力的协调性活动。该攻击专门针对模型核心推理能力进行提取,OpenAI 表示正在加强防御,以防范未来类似的对抗性蒸馏威胁。
OpenAI Agent Security 负责人 @joedaroo 近日表示,AI 模型在网络空间、群体协同、留言板等领域的能力出现突跃式提升,让企业安全防御措手不及。他呼吁各组织审视自身人员、系统和流程对能力突变的韧性,并完善事件响应与沟通机制。
1. A Chinese title (title_zh) that is self-contained, mentioning core subject 2. A Chinese summary (summary_zh) of 80-160 characters。
summary</think>
Import AI 第 468 期聚焦 AI 政策与竞赛博弈:智库 IFP 发布 23 项应对自动化 AI R&D 风险的政策建议,涵盖透明度、风险策略、AI 韧性等 7 类;MIT 与哥伦比亚大学研究者在论文《Racing to Ruin》中通过博弈模型分析,AI 企业能否实现协同放缓取决于透明度与对对手可信度的判断。