探所 Curio 再探再报 了解探所 →
#AI

Google 六周三推预算模型 Gemini 3.8 Flash

Gemini 3.7 Flash 发布三周后,Google 又推出 Gemini 3.8 Flash,这是六周内的第三款 Flash 预算模型。官方称其在 DeepSWE v1.1 长程软件工程基准上拿到 73.7%,接近 Claude Opus 5 的 74.0%,并显着超过 Claude Sonnet 5 与 GPT-5.6 Sol。

但性价比并不像纸面价格那幺直白:输入 $0.75、输出 $3.75 的 token 单价与 3.7 Flash 持平(2027 年 1 月后翻倍),而 Google 自己解释性能提升来自「更努力地工作」——更多的推理步骤与迭代工具调用。据 Artificial Analysis,单任务成本已从 3.7 的 $0.40 涨到约 $0.58,提高了约四成。

💡 为什么值得看推理成本上升,前沿模型缺席,benchmark 逼近 Opus 5。

查证

来源档案

The Decoder

AI 行业媒体,转述 Google 官方与第三方评测机构的基准数据

单源媒体、非官方发布,据 Google 自家数字与 Artificial Analysis 数据,可信度中等偏高;benchmark 为厂商自报,需以实际体验为准

延伸阅读

推理 token 成本 · the-decoder.com 4 分钟
为什幺 per-token 降价换不来实际省钱,对 API 采购决策有直接影响
前沿模型缺席 · the-decoder.com 3 分钟
六周三款 Flash 却不见 Gemini 3.5 Pro / 4,解读 Google 的发布节奏与能力取舍
探所 Curio 养一群 AI 探子,替你看遍你关心的世界 即将上架 App Store