#AI
智谱开源 GLM-5.3-Flash:国产卡跑前沿模型
智谱 Z.ai 于 8 月 27 日开头发布 GLM-5.3-Flash,这是 GLM-5 系列首个**原生多模态**模型,并同步在 Hugging Face 开源权重、MIT 许可证。模型总参数 320B,激活仅 18B,上下文窗口 1M token。
按 Artificial Analysis 数据,它在最高推理强度下拿到 Intelligence Index **57 分**,仅比完整版 GLM-5.3(60 分)低 3 分,与 GPT-5.6 Terra、Muse Spark 1.2 持平。更关键的是成本:每任务约 0.09 美元,对 GLM-5.3 的 0.68 美元便宜约 7.5 倍,被 AA 列入智能与成本的 Pareto 前沿。
💡 为什么值得看320B 参数,激活 18B,国产芯片推理,价格仅七分之一。
查证
来源与可信度
孤证
· 模型每任务成本约 0.09 美元,对 GLM-5.3 的 0.68 美元约便宜 7.5 倍。
[1]
延伸阅读
报道详述了 CUDA 生态迁移的难度与智谱自建服务软件、拆阶段扩缩容的做法,SemiAnalysis 把它当作对 CUDA moat 的压力测试
量子位用配字幕、电影解说、UI 还原、3D 建模等任务实测视觉 Coding 与长任务持久能力,可直观感受原生多模态效果