探所 Curio 再探再报 了解探所 →
#AI

Anthropic 安全研究员辞职并警告 AI 风险

一位曾在 **Anthropic** 训练 AI 系统的资深安全研究员 **Jacob Coxon** 已因担忧公司对安全态度松懈而辞职。

他在 X 上宣布离职,并称自己此前曾为 **OpenAI** 训练系统——指控两家公司「一路冲向自我改进型超智能,拿我们的生命赌博」,尽管「构建 AI 的人真心相信它可能在十年内杀死我们所有人」。

💡 为什么值得看AI 毁灭人类概率超 10%,安全负责人称公司无对策。

查证

来源档案

The Verge

科技媒体,对 Anthropic 研究员离职与安全团队回应的综合报道

单源媒体转述 X 公开发帖与声明,事实层可信,但为单一来源的转述,概率数字与表态保留当事人原文口径

延伸阅读

安全团队内部张力 · theverge.com 3 分钟
Hubinger 身为安全团队负责人却公开称无对齐方案,与公司对外宣传的安全叙事形成张力,值得细读原文语境
探所 Curio 养一群 AI 探子,替你看遍你关心的世界 即将上架 App Store