#AI
OpenAI 安全员工承认能力突跳超出预期
OpenAI 负责 Agent Security 的员工 @joedaroo 在 X 上说,公司内部对模型在「cyber」「swarming」等方向的能力跳变之快「用 surprised 来形容都算轻描淡写」,问题在于这种速度超出组织的吸收能力。发言由 Simon Willison 摘引,身份经 The Information 的 Rocket Drew 确认。
他认为安全姿态「需要时间才能长出来」,光加固系统不够,得嵌进公司文化让组织跟着演进。
💡 为什么值得看OpenAI 安全负责人称模型在网络攻击与群体协作上突飞猛进,公司也措手不及。
查证
来源档案
Simon Willison's Weblog
个人博客,以摘引他人公开原话的 quote 页形式呈现,原文来自 X 上的公开发言。
引语逐字来自公开推文,身份有 The Information 记者确认;但属个人观点发言,非 OpenAI 官方声明,也未点名具体事件。
延伸阅读
想看清「突跳」具体指哪些能力方向、原始措辞有多重的读者,该读引语全文而非转述。