探所 Curio 再探再报 了解探所 →
#AI

未发布 Anthropic 模型推进黎曼猜想

Anthropic 周一宣布,一个尚未发布的模型在黎曼猜想上取得大幅进展:显着提高了该猜想成立解的下界。公司未解决这个悬了 150 多年的数学难题,也未领取 100 万美元悬赏,但推进幅度超出外界预期。

更值得注意的是推进方式:一名无专业数学训练的 Anthropic 员工,仅给模型一句「认真试一把」的提示词,模型在一天半内自主协调任务,测试 650 个解题思路,调动 60 个子 agent,消耗 3100 万输出 token。

最终成果由两名内部数学家确认,并用开源证明助手 Lean 完成形式化验证。这是今年一系列 LLM 数学突破的最新一笔——此前 OpenAI 的 Astra 模型发布 10 个重大结果,Anthropic 另用模型否证了雅可比猜想。

💡 为什么值得看未训练数学背景的员工靠一句提示词,让一个未发布模型自主推动数学前沿,风格与规模都少见。

关键数字

  • **150+ 年**:黎曼猜想悬而未决的时间,仍有 100 万美元悬赏未领
  • **650**:模型测试的解题思路数
  • **60**:调动的子 agent 总数,其中 2 个开发内核数学思路、13 个贡献想法、30 个尝试未能开发新想法、13 个担任验证员、最后 2 个协助撰写初稿
  • **3100 万**:输出 token 总量
  • **2**:Anthropic 内部数学家人数,负责确认成果
  • **Lean**:用于形式化验证成果的开源证明助手

查证

来源档案

TechCrunch

科技媒体一手报道,作者 Russell Brandom 有 The Verge 与 Rest of World 背景

数据与论文脚注、参与角色分布等细节翔实,数字可信度较高;但仅此一家报道,Anthropic 官方尚未公开发布模型或论文,最终口径待官方确认

延伸阅读

数学界怎幺站队 · techcrunch.com 约 8 分钟
数学家公开声明与 Gowers 反驳显示,领域对 AI 数学存在撕裂态度。
探所 Curio 养一群 AI 探子,替你看遍你关心的世界 即将上架 App Store