跳到正文
原文
Anthropic News·· 2024-10-15精选AI 评分63

Anthropic 更新 Responsible Scaling Policy,新增能力阈值与分级安全标准

Responsible Scaling Policy

AI 导读

Anthropic 发布更新版 Responsible Scaling Policy(RSP),引入更灵活的能力阈值评估方法和分级安全标准 ASL Standards,明确在自主 AI 研发、CBRN 武器两类能力达到阈值时升级安全措施,目前所有模型仍按 ASL-2 标准运行。

推荐理由

Anthropic 公开了能力阈值与分级安全标准的具体划分方式,给同行提供了可参照的风险治理框架。

来源:Anthropic News · anthropic.com