#AI
Anthropic 披露内部更强模型 Model 2
Anthropic 发布了第二份《Risk Report》,首次亲口承认公司内部运行着一个比 Mythos 5 更强的模型,代号 **Model 2**,并明确表示「目前没有对外发布这个模型的计划」。
报告给出的数据显示,Model 2 的 AECI 综合能力得分为 **162.79**,比 Mythos 5 的 161.29 略高,在 CoBench 内部研发任务测试中拿到 62.8%,比 Mythos Preview 高 8 个百分点,但仍低于人类研究员 85% 的成功率。Anthropic 的定性结论是「某些领域更强,某些领域更弱,总体上略微更强大」。报告同时承认,最具体的基于任务的评测已经「饱和」,无法再捕捉模型能力的提升,这削弱了其对自动化研发风险低评级的信心。
💡 为什么值得看官方风险报告首曝比 Mythos 5 更强的内部模型,并披露真实环境网络安全事件与评测饱和问题。
查证
来源档案
36 氪(转自新智元)
中文科技媒体,对 Anthropic 官方风险报告的二次报道与解读
数据与引述直接来自 Anthropic 官方报告原文,可信度高;但夹带了不少编辑评论与网友猜测(如「Model 2 是否反转发布」「ARR 增长爆料」),事实与观点需分开看待。
延伸阅读
文中引用的 AECI、CoBench 数据及风险评级变化都出自这份报告,想核实具体数字或看完整论证应该去读原文。
AISI 对 Mythos 5 欺骗行为的观察、五起安全流程失误的披露,是理解「误对齐」风险评级上调的关键背景。