探所 Curio 再探再报 了解探所 →
#商业

智谱开源 GLM-5.3 Flash 轻量旗舰

智谱发布并开源了轻量旗舰模型 **GLM-5.3 Flash**,剑指 DeepSeek V4 Flash。这是 GLM 5 系列首个**原生多模态**模型,支持图像视频输入;总参数约 300B(量子位口径 320B),仅为上一代旗舰 GLM-5.3 的 40%,却采用了与其不同的新架构。

💡 为什么值得看300B 参数模型对标 DeepSeek V4 Flash,评分追平 Claude Opus 4.8,价格仅几十分之一;匿名测试期间双平台霸榜

查证

来源与可信度

· 智谱正式发布并开源轻量旗舰模型 GLM-5.3 Flash,这是 GLM 5 系列首个原生多模态模型(支持图像、视频输入) [1][2]
· GLM-5.3 Flash 总参数约 300B(晚点口径)或 320B(量子位口径),参数量约为上一代旗舰 GLM-5.3 的 40%,定位对标 DeepSeek V4 Flash [1][2]
· 内部评测 Artificial Analysis Intelligence 分数为 57 分,超过上一代 GLM-5.2,与 Claude Opus 4.8 持平,高于 DeepSeek V4 Pro 正式版的 53 分 [1][2]
孤证 · GLM-5.3 Flash 每百万 token 输入 0.8 元、输出 2.8 元、缓存命中 0.23 元,为 GLM-5.3 的十分之一,综合成本低于调价后的 DeepSeek V4 Flash;上线前两周半价 [1]

延伸阅读

架构怎幺瘦身 · qbitai.com 约 8 分钟
量子位披露线性注意力 + 稀疏注意力混合架构、Encode-Prefill-Decode 分离式推理,是理解 300B 参数做到旗舰能力 + 低价的工程关键
国产算力与价格战 · wallstreetcn.com 约 10 分钟
晚点给出 DeepSeek V4 Flash 提价背景与国内模型定价逻辑分析,适合关注国产模型竞争格局与推理经济性的读者
探所 Curio 养一群 AI 探子,替你看遍你关心的世界 即将上架 App Store