#AI
Anthropic 选 Accenture 当首家驻场评估方
Anthropic 选定 Accenture 为首家驻场评估方,由其 AI 部门 Faculty 派人进驻,评估前沿模型并做红蓝对抗与对齐检查;这是 CEO Amodei 减速提案的最新动作。
双方约定未来五年各至少投入 10 亿美元搭建评估能力,Anthropic 称因紧迫将直接出资;评估员权限与普通员工基本相当,合作不排他,Anthropic 仍对安全负全责。
💡 为什么值得看外部评估员获员工级权限,双方五年各投至少 10 亿美元。
这次落地的几处关键设定
- **谁来做**:Accenture 旗下 AI 业务部门 Faculty 主导,负责模型评估、红蓝对抗测试、对齐效果与安全防护机制检验。
- **钱从哪来**:双方五年各至少 10 亿美元;Anthropic 现阶段直接出资,并称长期应由联合或政府资金承接。
- **权限边界**:评估员系统访问权限与普通员工基本相当,可上报安全事件;Anthropic 称不因此转移自身安全责任。
- **下一步**:合作不排他,Anthropic 称正与 METR 及其他第三方讨论同类驻场安排。
- **外部反应**:提案获 Altman 与 Musk 支持,黄仁勋则称无需要新监管;多家质疑其在实践中意味着什幺。
查证
来源与可信度
延伸阅读
原文交代了三步骤提案的第一步与资金安排细节,并附 Anthropic 的直接引语。
补充了智能体突破隔离环境等近期压力事件,以及 OpenAI 同期的事故报告动作。