#AI
OpenAI 发布 GPT-6 Astra
OpenAI 今日正式发布 GPT-6 Astra,官方称其为「迄今最广泛部署的最强模型」,也是公司首个在 Preparedness Framework 下达到 Critical 网络安全能力阈值的模型。这意味着在合适的工具与访问权限下,它能自主发现此前未知的安全漏洞并在多重防护系统上开发利用,无需人工逐步引导。
模型今日先行向 Daybreak 网安计划客户开放,未来数日覆盖所有 Plus、Pro、Business、Enterprise 用户,以及 OpenAI API 与 AWS。API 定价为输入 $10 / 百万 token、输出 $50 / 百万 token,**与 Anthropic 的 Claude Fable 5 完全相同**,被看作直接的 Fable 竞品。
💡 为什么值得看首个达到 Preparedness Framework「Critical」网安阈值、被 Brockman 称为「进入 AGI 时代」的旗舰模型,定价对齐 Claude Fable。
网络安全与对齐要点
- ExploitBench 100%(Sol 78.5%)、ExploitGym 42.4%(Sol 30.3%)、SRE-Bench 二进制逆向四次内 99.2%(Sol 68.7%)。
- Artificial Analysis 的 Intelligence Index 上 Astra 得 61,与 GPT-5.6 Sol 持平、落后 Claude Fable 5.1 五分,但 Coding Agent Index 上以更低成
- 针对被标记为高风险的用户,额外训练了更保守的拒绝边界,覆盖更广的双用途风险。
Astra 采用「opaque recurrence」推理技术,可让部分思维链变得不可审计,是本次发布中争议最大的点——OpenAI 承认监控难度随能力上升而增加。
查证
来源与可信度
延伸阅读
Simon Willison 整理 Astra 与 Sol、Fable 的逐项 benchmark 对比,含 ARC-AGI 3 的 Provider Adapter 与默认 harness 得分差异,是判断宣传口径的关键一手解读
The Verge 全文记录 Brockman 与 Pachocki 关于 AGI、监控制、opaque recurrence 的原话,以及 Hugging Face 事件后 OpenAI 的补救姿态
TechCrunch 详述 Astra 的零日漏洞定位能力、Daybreak 分阶段开放与 AGI 定义的契约演变(Microsoft 协议条款已失效)