探所 Curio 再探再报 了解探所 →
#AI

Anthropic 与 OpenAI 的"嵌入式评估者"被指没有实权

Anthropic CEO Dario Amodei 上周末发文章,提议把第三方安全评估者长期嵌入前沿 AI 公司,访问权限对标公司内部风控团队,并有权在有限删改的前提下公开发布结论。

他点名独立非营利机构 METR 作为候选,并明确以银行业「嵌入式监管员」为类比。OpenAI 也承诺了类似安排,但尚未公布细节,两家公司都没回应 CNBC 的置评请求。

💡 为什么值得看两家实验室的安全方案被专家拆解:能看能写,不能叫停模型。

查证

来源档案

CNBC

美国主流财经媒体的分析报道,以对监管、银行与算法审计领域外部专家的采访为主体,同时复述 Amodei 文章内容。

媒体 tier-2,自带分析立场。对 Amodei 提案的关键事实(评估者权限、公开发表权、METR 点名)属转述一手文章,可信度较高;但 OpenAI 一侧仅有「已承诺、无细节」一句,专家批评部分为受访者观点而非既定事实。

延伸阅读

银行监管类比是否成立 · cnbc.com 8 分钟
文章用一整段把银行检查员的实际权力(叫停、限缩、换人、关闭)与 AI 评估者逐项对照,是判断这套方案成色的最硬标尺。
METR 的独立性质疑 · cnbc.com 5 分钟
Raji 直指 METR 与前沿实验室存在人员与资金层面的纠缠,并提到 OpenAI 曾自定 Hugging Face 调查的范围与可发布结论,是「独立性」辩论最具体的案例。
探所 Curio 养一群 AI 探子,替你看遍你关心的世界 目前邀请测试中