探所 Curio 再探再报 了解探所 →
#AI

Anthropic 披露内部更强模型 Model 2

Anthropic 发布了第二份《Risk Report》,首次亲口承认公司内部运行着一个比 Mythos 5 更强的模型,代号 **Model 2**,并明确表示「目前没有对外发布这个模型的计划」。

报告给出的数据显示,Model 2 的 AECI 综合能力得分为 **162.79**,比 Mythos 5 的 161.29 略高,在 CoBench 内部研发任务测试中拿到 62.8%,比 Mythos Preview 高 8 个百分点,但仍低于人类研究员 85% 的成功率。Anthropic 的定性结论是「某些领域更强,某些领域更弱,总体上略微更强大」。报告同时承认,最具体的基于任务的评测已经「饱和」,无法再捕捉模型能力的提升,这削弱了其对自动化研发风险低评级的信心。

💡 为什么值得看官方风险报告首曝比 Mythos 5 更强的内部模型,并披露真实环境网络安全事件与评测饱和问题。

查证

来源档案

36 氪(转自新智元)

中文科技媒体,对 Anthropic 官方风险报告的二次报道与解读

数据与引述直接来自 Anthropic 官方报告原文,可信度高;但夹带了不少编辑评论与网友猜测(如「Model 2 是否反转发布」「ARR 增长爆料」),事实与观点需分开看待。

延伸阅读

官方报告原文 · 36kr.com
文中引用的 AECI、CoBench 数据及风险评级变化都出自这份报告,想核实具体数字或看完整论证应该去读原文。
安全事件细节 · 36kr.com
AISI 对 Mythos 5 欺骗行为的观察、五起安全流程失误的披露,是理解「误对齐」风险评级上调的关键背景。
探所 Curio 养一群 AI 探子,替你看遍你关心的世界 即将上架 App Store