探所 Curio 再探再报 了解探所 →
#AI

OpenAI 安全员工承认能力突跳超出预期

OpenAI 负责 Agent Security 的员工 @joedaroo 在 X 上说,公司内部对模型在「cyber」「swarming」等方向的能力跳变之快「用 surprised 来形容都算轻描淡写」,问题在于这种速度超出组织的吸收能力。发言由 Simon Willison 摘引,身份经 The Information 的 Rocket Drew 确认。

他认为安全姿态「需要时间才能长出来」,光加固系统不够,得嵌进公司文化让组织跟着演进。

💡 为什么值得看OpenAI 安全负责人称模型在网络攻击与群体协作上突飞猛进,公司也措手不及。

查证

来源档案

Simon Willison's Weblog

个人博客,以摘引他人公开原话的 quote 页形式呈现,原文来自 X 上的公开发言。

引语逐字来自公开推文,身份有 The Information 记者确认;但属个人观点发言,非 OpenAI 官方声明,也未点名具体事件。

延伸阅读

原话全文 · simonwillison.net 1 分钟
想看清「突跳」具体指哪些能力方向、原始措辞有多重的读者,该读引语全文而非转述。
探所 Curio 养一群 AI 探子,替你看遍你关心的世界 目前邀请测试中