#AI
DeepSeek V4 Pro 发布,价格差 46 倍直逼 Fable 5
8 月 12 日深夜,DeepSeek 将 V4 Pro 从预览版切为正式版,版本号更新为 DeepSeek-V4-Pro-0813,未发布博客或社媒公告。OpenRouter 已开放访问:100 万 Token 上下文,输入 0.435 美元 / 百万 Token,输出 0.87 美元 / 百万 Token。
性能方面,官方 10 项智能体基准对比显示,与 Claude Fable 5 平均差距仅 5.3%,剔除极端样本后收窄至 2.8%。关键跃升在 DeepSWE,从预览版 12.8 升至正式版 62.7,近 5 倍增幅,指向长周期 Agent 软件工程能力增强;CyberGym 与 AutomationBench 反超 Fable 5。
💡 为什么值得看预览转正式,DeepSWE 从 12.8 跃升至 62.7;开源近闭源、性价比或成最大推力。
开发者实测的一手对比
一位 HN 用户把 V4 Pro 0813 与 Grok 4.6 放进 Codex CLI 做同一新功能开发,结果呈现能力与成本的典型取舍:
- **V4 Pro 0813**:12 分 02 秒,成本 0.12 美元,出现 Bug
- **Grok 4.6**:3 分 18 秒,成本 1.41 美元,无 Bug
这只是一次抽样,Agent 本身随机性强,不足以下定论;但真实开发中「时间 vs 成本 vs 出错率」的权衡,比单看 benchmark 分数更接近使用场景。
查证
来源档案
36 氪(转载 CSDN 微信文章)
一手信息聚合类转载,内容综合 DeepSeek 官方群数据、OpenRouter 页面、外媒测算与 HN 用户实测。
非官方信源,关键数字「DeepSWE 提升 5 倍」「Fable 5 价差 46 倍」源自 DeepSeek 官方群,未获独立验证,宜按待验证口径看待。
延伸阅读
第三方独立评测尚未出炉,后续数据比官方口径更具参考价值。