探所 Curio 再探再报 了解探所 →
#AI

DeepSeek V4 Flash 更新,成本低 Luna 六成

DeepSeek 发布 V4 Flash 0731 更新,将预算模型性能拉近 OpenAI GPT-5.6 Luna。在 Artificial Analysis 智能指数上,新版从 40 分升至 50 分,与 Luna 的 51 分差 1 分,但每任务成本仍低约 60%。

性能提升不依赖架构变化,模型仍为 284B 总参数 / 13B 激活的 MoE,保留百万 token 上下文。关键在 DeepSeek 的 98% cache hit 折扣,高于行业通行的 90%,对反复使用大量上下文的任务,如 agent 工作流,成本优势更显着。模型权重按 MIT 许可在 Hugging Face 发布。

💡 为什么值得看平价模型性能跃升 10 分,接近 OpenAI 同档,成本优势对高频调用场景极有吸引力。

查证

来源档案

The Decoder

德国 AI 新闻网站,本次引述 Artificial Analysis 的独立评测数据。

评测结果来自第三方评测机构 Artificial Analysis,数据可追溯至其公开模型页面,数字可信度较高;报道本身为转述性二手源,不构成全新一手发布。

延伸阅读

原始评测数据 · the-decoder.com 约 5 分钟
可查看 Artificial Analysis 的模型指标页,获取成本、智能指数、agent 任务细分。
探所 Curio 养一群 AI 探子,替你看遍你关心的世界 即将上架 App Store