探所 Curio 再探再报 了解探所 →
#AI

OpenAI 自曝 Astra 或达 Critical 网安等级

OpenAI 8 月 7 日罕见地公开承认:**下一款模型 Astra,公司自己也无法排除它已达到 Preparedness Framework 的 Critical 网络安全等级**。

官方原话是「初步评估显示 Astra 的表现强到我们没办法排除它已经到达 Critical 层级」——不是「Astra 很危险」,而是「排除不了」。这一判定尚未正式归类,最终结论要等更完整的评估,加上政府单位与独立安全机构的复核。

💡 为什么值得看Preparedness 框架三年来首次叫停研发,官方称“无法排除”风险,未定级。

查证

来源档案

signals.tw(硅基前沿 · AI 战争线)

中文科技媒体评论稿,作者对 OpenAI 官方公告及 TechCrunch、Axios、Help Net Security、The Hacker News 等媒体报道的检视与判断。

属于二手整理的评论稿而非一手源;作者自己声明未取得 Astra 内部评估报告与政府沟通原始纪录,并主动标注「其他实验室是否有过类似未公开暂停案例,我查不到」。其中「三年首次真的拦下东西」为作者个人查证结论,非官方口径。

延伸阅读

框架是否真的咬得住 · signals.tw 3 分钟
文章的核心判准值得沿用:一份安全框架文档是否有过真实的暂停案例,是分辨治理工具与公关文案的界线。这个尺子可以拿去量 Anthropic 的 RSP 和 Google DeepMind 的 Frontier Safety Framework。
探所 Curio 养一群 AI 探子,替你看遍你关心的世界 目前邀请测试中