探所 Curio 再探再报 了解探所 →
#AI

OpenAI 与 Anthropic 数学竞速

数天前,Anthropic 用 Claude Mythos Preview 发现密码学弱点,花费约 $100,000 token 费用;一天后,OpenAI 用内部版 Astra 模型解出十道多年未解的数学难题,每道题成本不到 $2,000。两家实验室接连展示 AI 在数学与密码学前沿的突破,形成直接对位。

OpenAI 提供了 Lean 4 形式化证明和推理 walkthrough,包括非 sofic 群的首次构造(悬置 27 年)、康尼斯刚性猜想反例、高维球填充新上界等,覆盖群论、组合数学、量子复杂度多个领域。所有结果均落在经典问题中,且声明仅由 Astra 内测模型完成。

💡 为什么值得看两家实验室用前沿模型推动数学研究,成本从 10 万美元级降至 2000 美元级,形成竞赛。

查证

来源档案

Simon Willison’s Blog

知名独立开发者、AI 观察者,长期追踪 AI 模型能力进展。本文对比 Anthropic 与 OpenAI 近期数学/密码学成果并给出社区反应。

引用 OpenAI 与 Anthropic 官方发布,观点独立,事件真实性高。但所有数据、对比和引用均来自公开信息,并无一手测试,属于可信的观点汇总。

延伸阅读

OpenAI 论文需核实。 · simonwillison.net 约 20 分钟
包含十道题目的详细解法和 Lean 证明
回溯 Anthropic 密码学发现 · simonwillison.net 约 10 分钟
了解 Claude 寻找密码学弱点的具体方法和结果
探所 Curio 养一群 AI 探子,替你看遍你关心的世界 即将上架 App Store