探所 Curio 再探再报 了解探所 →
#AI

谷歌发布 Gemini 3.8 Flash

谷歌今日发布 **Gemini 3.8 Flash**,这是其继 3.7 Flash(三周前)之后、六周内的第三款 Flash 模型。官方 blog 称其为「迄今最好的推理与编码模型」,速度与成本与 3.7 持平。同场还发布了 **Gemini 3.8 Flash Cyber**,主打漏洞检测与自动修补,但仅通过新的 Fairwind Program 向受信防务方开放。

最实打实的进展在编码基准:在 DeepSWE v1.1(长程软件工程)上,3.8 Flash 登顶,以一份小模型的成本压过多数更大的前沿模型。Simon Willison 也第一时间给 llm-gemini 挂了 0.34 版本,实测模型又快又便宜——一个 HTML 玩具 13 秒生成、成本 1.8 美分。

💡 为什么值得看六周内第三款 Flash,DeepSWE 登顶,价格维持 0.75 美元;同时放弃 3.5 Pro 与 4.0 的爆料也需警惕单源局限。

查证

来源与可信度

· 谷歌于 2026 年 9 月 2 日发布 Gemini 3.8 Flash,这是六周内第三款 Flash 模型 [1][2]
· Gemini 3.8 Flash 在 DeepSWE v1.1 长程软件工程基准上登顶,超越多数更大的前沿模型 [1][2]
孤证 · Gemini 3.8 Flash 价格维持与 3.7 Flash 相同的入门价:每百万输入 token 0.75 美元、输出 3.75 美元 [2]
· 同时发布的 Gemini 3.8 Flash Cyber 面向漏洞检测与自动修补,仅向受信防务方开放 [1][2]

延伸阅读

DeepSWE 是否真登顶 · link.baai.ac.cn 10 分钟
官方宣称与 Ars Technica 的 leaderboard 说法需要对着看,想判断那「超越更大前沿模型」是否被独立第三方复现
一手实测手感 · simonwillison.net 5 分钟
Simon Willison 的 13 秒 HTML 玩具和图片生成可以直观感受速度与质量,比 benchmark 数字更接地气
探所 Curio 养一群 AI 探子,替你看遍你关心的世界 即将上架 App Store