#AI
GPT-5.6 Sol 推翻 30 年统计学猜想
宾夕法尼亚大学统计学教授 Edgar Dobriban 使用 OpenAI 的 GPT-5.6 Sol Pro,在约 90 分钟内推翻了 Benjamini-Hochberg 方法的一个核心猜想。该猜想自 1995 年提出后,多年未被人类证明或推翻。作为对比,前代模型 GPT-5.5 运行 20 小时仍找不到解法。
Dobriban 在预印本中构造了一个统计模型,证明真实误发现率会超出目标水平(0.104 vs 0.1),模拟实验也确认了结果。解决方案并非创造全新方法,而是以新颖方式组合已知手段。
由于偏差幅度较小,主要停留在理论层面,对实际多重假设检验的影响需后续评估。Dobriban 已公开预印本及全部代码。
💡 为什么值得看新模型 90 分钟解开放 30 年统计难题,前代跑 20 小时无效,能力跃迁显著。
查证
来源档案
The Decoder
科技媒体,转述宾大教授 Edgar Dobriban 的预印本论文及其与 GPT-5.6 Sol Pro 的交互过程。
预印本及代码链接来自一手学术成果,教授本人认可,但未经同行评议;The Decoder 单源报道可信度中等,建议等待独立验证。
延伸阅读
包含完整数学构造、模拟结果和与 GPT-5.6 的对话记录,可验证 AI 参与的具体细节