Claude Fable 5 在 FrontierMath 超越 GPT-5.5
Claude Fable 5 在 FrontierMath 数学基准最高难度层上达成 88% 准确率,超越 OpenAI GPT-5.5 的约 75%,领先 13 个百分点。对比 Anthropic 早前的 Opus 4.5 在该难度层不足 10% 的成绩,反映了短期内的质变级性能跳升。独立数学推理基准的跨代对标,通常被视为前沿模型能力水位的风向标。
Claude Fable 5 在 FrontierMath 数学基准最高难度层上达成 88% 准确率,超越 OpenAI GPT-5.5 的约 75%,领先 13 个百分点。对比 Anthropic 早前的 Opus 4.5 在该难度层不足 10% 的成绩,反映了短期内的质变级性能跳升。独立数学推理基准的跨代对标,通常被视为前沿模型能力水位的风向标。