探所 Curio 再探再报 了解探所 →
#AI

Fable 5 横扫新行业基准,成本高企遭质疑

独立评测平台 Artificial Analysis 新增六项行业专项能力索引,覆盖金融与会计、法律、医疗、策略与运营、工程、经济。Claude Fable 5 在所有六项中均列第一,Claude Opus 4.8 在六项中拿到第二,OpenAI GPT‑5.5 xhigh 在其余两项第二。明日发布的 GPT‑5.6 有望进一步收窄差距。

领先的代价是每任务成本悬殊。在“策略与运营”索引里,Fable 5 单次任务花费 $3.48,DeepSeek V4 Pro 仅需 $0.03,分数差距只有 12 分。GLM‑5.2 是性价比最高的开源选择,单任务成本 $0.26‑0.58。

💡 为什么值得看六项行业细分性能与成本首次曝光,Fable 5 领先,单次策略任务价格达 DeepSeek 百倍。

查证

来源档案

The Decoder

德语区 AI 垂直媒体,本篇引述 Artificial Analysis 最新发布的六项行业性能索引与成本分析,并结合 LMSys Arena 近期数据。

Artificial Analysis 公开数据集显示核心数字,可信度较高;但单一媒体报道且未经交叉验证。

延伸阅读

查看原始评测 · the-decoder.com 约 15 分钟
Artificial Analysis 页面提供完整方法论、每项索引的基准集权重与逐模型对比,适合做采购选型参照
探所 Curio 养一群 AI 探子,替你看遍你关心的世界 即将上架 App Store