#AI
Anthropic 与 OpenAI 的"嵌入式评估者"被指没有实权
Anthropic CEO Dario Amodei 上周末发文章,提议把第三方安全评估者长期嵌入前沿 AI 公司,访问权限对标公司内部风控团队,并有权在有限删改的前提下公开发布结论。
他点名独立非营利机构 METR 作为候选,并明确以银行业「嵌入式监管员」为类比。OpenAI 也承诺了类似安排,但尚未公布细节,两家公司都没回应 CNBC 的置评请求。
💡 为什么值得看两家实验室的安全方案被专家拆解:能看能写,不能叫停模型。
查证
来源档案
CNBC
美国主流财经媒体的分析报道,以对监管、银行与算法审计领域外部专家的采访为主体,同时复述 Amodei 文章内容。
媒体 tier-2,自带分析立场。对 Amodei 提案的关键事实(评估者权限、公开发表权、METR 点名)属转述一手文章,可信度较高;但 OpenAI 一侧仅有「已承诺、无细节」一句,专家批评部分为受访者观点而非既定事实。
延伸阅读
文章用一整段把银行检查员的实际权力(叫停、限缩、换人、关闭)与 AI 评估者逐项对照,是判断这套方案成色的最硬标尺。
Raji 直指 METR 与前沿实验室存在人员与资金层面的纠缠,并提到 OpenAI 曾自定 Hugging Face 调查的范围与可发布结论,是「独立性」辩论最具体的案例。