探所 Curio 再探再报 了解探所 →
#AI

DeepSeek Flash 追平 GPT-5.6,成本低六成

DeepSeek 发布 V4 Flash「0731」更新,Artificial Analysis 智能指数得分 50,较前代提升 10 分,仅比 OpenAI 的 GPT-5.6 Luna 低 1 分,但每任务成本低约 60%。成本优势源于 98% 缓存命中折扣,远高于行业常见的 90%,使重复上下文的代理任务成本更显着。模型维持 284B 总参数、13B 活跃参数、100 万 token 上下文,权重以 MIT 许可开源。

即便 OpenAI 同日将 GPT-5.6 Luna 价格下调 80%,DeepSeek 仍只需对手 40% 花费即可获得对等性能。代理任务显着增强,GDPval 基准从 1189 跃升至 1559,幻觉率同步降低。

💡 为什么值得看DeepSeek 以 60% 低成本追平 OpenAI 轻量模型,缓存折扣成关键,API 价格战或激化。

查证

来源档案

The Decoder

DeepSeek V4 Flash 0731 性能与价格均优于 OpenAI,同日 OpenAI 降价,市场竞争加剧。

评测数据来自独立第三方 Artificial Analysis,指标公开可查;报道本身为二手转述,但数字具体、与官方口径一致,可信度较高。

延伸阅读

原始数据 · the-decoder.com 约 5 分钟
Artificial Analysis 官方文章提供 Pareto 前沿、完整基准和代理任务分项,比新闻更详尽
探所 Curio 养一群 AI 探子,替你看遍你关心的世界 即将上架 App Store