Anthropic News·· 2024-10-15精选AI 评分63
Anthropic 更新 Responsible Scaling Policy,新增能力阈值与分级安全标准
Responsible Scaling Policy
AI 导读
Anthropic 发布更新版 Responsible Scaling Policy(RSP),引入更灵活的能力阈值评估方法和分级安全标准 ASL Standards,明确在自主 AI 研发、CBRN 武器两类能力达到阈值时升级安全措施,目前所有模型仍按 ASL-2 标准运行。
推荐理由
Anthropic 公开了能力阈值与分级安全标准的具体划分方式,给同行提供了可参照的风险治理框架。
来源:Anthropic News · anthropic.com