探所 Curio 再探再报 了解探所 →
#AI

OpenAI 发布 GPT-6 Astra

OpenAI 今日正式发布 GPT-6 Astra,官方称其为「迄今最广泛部署的最强模型」,也是公司首个在 Preparedness Framework 下达到 Critical 网络安全能力阈值的模型。这意味着在合适的工具与访问权限下,它能自主发现此前未知的安全漏洞并在多重防护系统上开发利用,无需人工逐步引导。

模型今日先行向 Daybreak 网安计划客户开放,未来数日覆盖所有 Plus、Pro、Business、Enterprise 用户,以及 OpenAI API 与 AWS。API 定价为输入 $10 / 百万 token、输出 $50 / 百万 token,**与 Anthropic 的 Claude Fable 5 完全相同**,被看作直接的 Fable 竞品。

💡 为什么值得看首个达到 Preparedness Framework「Critical」网安阈值、被 Brockman 称为「进入 AGI 时代」的旗舰模型,定价对齐 Claude Fable。

网络安全与对齐要点

  • ExploitBench 100%(Sol 78.5%)、ExploitGym 42.4%(Sol 30.3%)、SRE-Bench 二进制逆向四次内 99.2%(Sol 68.7%)。
  • Artificial Analysis 的 Intelligence Index 上 Astra 得 61,与 GPT-5.6 Sol 持平、落后 Claude Fable 5.1 五分,但 Coding Agent Index 上以更低成
  • 针对被标记为高风险的用户,额外训练了更保守的拒绝边界,覆盖更广的双用途风险。

Astra 采用「opaque recurrence」推理技术,可让部分思维链变得不可审计,是本次发布中争议最大的点——OpenAI 承认监控难度随能力上升而增加。

查证

来源与可信度

· OpenAI 于 2026 年 9 月 3 日发布 GPT-6 Astra,是迄今最广泛部署的最强模型。 [1][3][4]
· Astra 是 OpenAI 首个在 Preparedness Framework 下达到 Critical 网络安全能力阈值的模型。 [1][3][4]
· API 定价为输入 $10 / 百万 token、输出 $50 / 百万 token,与 Claude Fable 5 相同。 [2][4]
· Astra 今日先向 Daybreak 网安计划客户开放,未来数日覆盖 Plus/Pro/Business/Enterprise 及 API 与 AWS。 [3][4]

延伸阅读

第三方横评数据 · simonwillison.net 5 分钟
Simon Willison 整理 Astra 与 Sol、Fable 的逐项 benchmark 对比,含 ARC-AGI 3 的 Provider Adapter 与默认 harness 得分差异,是判断宣传口径的关键一手解读
AGI 表态与治理背景 · theverge.com 8 分钟
The Verge 全文记录 Brockman 与 Pachocki 关于 AGI、监控制、opaque recurrence 的原话,以及 Hugging Face 事件后 OpenAI 的补救姿态
对齐与安全细节 · techcrunch.com 6 分钟
TechCrunch 详述 Astra 的零日漏洞定位能力、Daybreak 分阶段开放与 AGI 定义的契约演变(Microsoft 协议条款已失效)
探所 Curio 养一群 AI 探子,替你看遍你关心的世界 即将上架 App Store