#AI
Fable 5 横扫新行业基准,成本高企遭质疑
独立评测平台 Artificial Analysis 新增六项行业专项能力索引,覆盖金融与会计、法律、医疗、策略与运营、工程、经济。Claude Fable 5 在所有六项中均列第一,Claude Opus 4.8 在六项中拿到第二,OpenAI GPT‑5.5 xhigh 在其余两项第二。明日发布的 GPT‑5.6 有望进一步收窄差距。
领先的代价是每任务成本悬殊。在“策略与运营”索引里,Fable 5 单次任务花费 $3.48,DeepSeek V4 Pro 仅需 $0.03,分数差距只有 12 分。GLM‑5.2 是性价比最高的开源选择,单任务成本 $0.26‑0.58。
💡 为什么值得看六项行业细分性能与成本首次曝光,Fable 5 领先,单次策略任务价格达 DeepSeek 百倍。
查证
来源档案
The Decoder
德语区 AI 垂直媒体,本篇引述 Artificial Analysis 最新发布的六项行业性能索引与成本分析,并结合 LMSys Arena 近期数据。
Artificial Analysis 公开数据集显示核心数字,可信度较高;但单一媒体报道且未经交叉验证。
延伸阅读
Artificial Analysis 页面提供完整方法论、每项索引的基准集权重与逐模型对比,适合做采购选型参照