#AI
Google 六周三推预算模型 Gemini 3.8 Flash
Gemini 3.7 Flash 发布三周后,Google 又推出 Gemini 3.8 Flash,这是六周内的第三款 Flash 预算模型。官方称其在 DeepSWE v1.1 长程软件工程基准上拿到 73.7%,接近 Claude Opus 5 的 74.0%,并显着超过 Claude Sonnet 5 与 GPT-5.6 Sol。
但性价比并不像纸面价格那幺直白:输入 $0.75、输出 $3.75 的 token 单价与 3.7 Flash 持平(2027 年 1 月后翻倍),而 Google 自己解释性能提升来自「更努力地工作」——更多的推理步骤与迭代工具调用。据 Artificial Analysis,单任务成本已从 3.7 的 $0.40 涨到约 $0.58,提高了约四成。
💡 为什么值得看推理成本上升,前沿模型缺席,benchmark 逼近 Opus 5。
查证
来源档案
The Decoder
AI 行业媒体,转述 Google 官方与第三方评测机构的基准数据
单源媒体、非官方发布,据 Google 自家数字与 Artificial Analysis 数据,可信度中等偏高;benchmark 为厂商自报,需以实际体验为准
延伸阅读
为什幺 per-token 降价换不来实际省钱,对 API 采购决策有直接影响
六周三款 Flash 却不见 Gemini 3.5 Pro / 4,解读 Google 的发布节奏与能力取舍