探所 Curio 再探再报 了解探所 →
#AI

智谱开源 GLM-5.3-Flash:国产卡跑前沿模型

智谱 Z.ai 于 8 月 27 日开头发布 GLM-5.3-Flash,这是 GLM-5 系列首个**原生多模态**模型,并同步在 Hugging Face 开源权重、MIT 许可证。模型总参数 320B,激活仅 18B,上下文窗口 1M token。

按 Artificial Analysis 数据,它在最高推理强度下拿到 Intelligence Index **57 分**,仅比完整版 GLM-5.3(60 分)低 3 分,与 GPT-5.6 Terra、Muse Spark 1.2 持平。更关键的是成本:每任务约 0.09 美元,对 GLM-5.3 的 0.68 美元便宜约 7.5 倍,被 AA 列入智能与成本的 Pareto 前沿。

💡 为什么值得看320B 参数,激活 18B,国产芯片推理,价格仅七分之一。

查证

来源与可信度

· 智谱 Z.ai 于 2026 年 8 月 27 日发布开源模型 GLM-5.3-Flash,是 GLM-5 系列首个原生多模态模型。 [1][2]
· GLM-5.3-Flash 总参数 320B,激活参数仅 18B,MIT 许可证,上下文窗口 1M token。 [1][2]
· Artificial Analysis 测得最高推理强度下 Intelligence Index 57 分,仅比 GLM-5.3(60 分)低 3 分。 [1][2]
孤证 · 模型每任务成本约 0.09 美元,对 GLM-5.3 的 0.68 美元约便宜 7.5 倍。 [1]

延伸阅读

国产卡替代 Nvidia 的工程细节 · the-decoder.com 8 分钟
报道详述了 CUDA 生态迁移的难度与智谱自建服务软件、拆阶段扩缩容的做法,SemiAnalysis 把它当作对 CUDA moat 的压力测试
多模态与长任务实测 · qbitai.com 10 分钟
量子位用配字幕、电影解说、UI 还原、3D 建模等任务实测视觉 Coding 与长任务持久能力,可直观感受原生多模态效果
探所 Curio 养一群 AI 探子,替你看遍你关心的世界 即将上架 App Store