探所 Curio 再探再报 了解探所 →
#AI

智谱发布 GLM-5.3-Flash 砍向 DeepSeek

智谱正式发布 **GLM-5.3-Flash**,认领了此前在 OpenRouter 上匿名跑红的 Ox Alpha 模型。它是 GLM-5 系列首个原生多模态模型,3200 亿总参数、约 180 亿激活,可接收文本、图片和视频输入。

性价比是这次发布的核心信号:在 Artificial Analysis Intelligence Index 上拿到 57 分,高于 DeepSeek V4 Pro 正式版的 53 分;定价则是每百万 token 输入 0.8 元、输出 2.8 元,上线两周限时半价。官方称性能可比上代 Claude Opus 4.8,而价格只有它的 1/40。

💡 为什么值得看同参数的 Ox Alpha 认领为智谱 GLM-5.3-Flash:57 分性能超 DeepSeek V4 Pro,限时半价却不到其 1/40,直接冲击性价比招牌。

定价细节与国产算力

  • **缓存命中价格**:标准缓存命中价 0.23 元,半价期 0.115 元;DeepSeek V4 Flash 峰时 0.1 元、谷时 0.05 元——缓存这一项 GLM 反而更贵,对高缓存命中的 Agent 任务不占便宜
  • **国产算力底座**:匿名期单日处理量约 62 万亿 token,由约 10 万张国产芯片承担,据称来自华为、摩尔线程、海光;智谱自建 SGLang 推理引擎,称端到端性能较基线提升 3 倍
  • **开源权重**:GLM-5.3 为 MIT 开源权重,与 GLM-5.2 同基座、增益全来自 post-training;支持 SGLang、vLLM、Transformers 等框架部署,并支持 Ascend NPU

查证

来源与可信度

· 智谱发布 GLM-5.3-Flash,认领此前在 OpenRouter 匿名上线的 Ox Alpha 模型 [1][2]
· GLM-5.3-Flash 是 GLM-5 系列首个原生多模态模型,3200 亿总参数、约 180 亿激活 [1][2]
· 在 Artificial Analysis Intelligence Index 上 GLM-5.3-Flash 得 57 分,高于 DeepSeek V4 Pro 正式版的 53 分 [1]
孤证 · GLM-5.3-Flash 定价每百万 token 输入 0.8 元、输出 2.8 元,上线两周限时半价 [1]

另有 1 个来源跟进

延伸阅读

官方 benchmark 全文 · huggingface.co
GLM-5.3 官方模型卡给出 Terminal Bench 3.0、CyberGym 等数十项评测的完整口径与 harness 细节,想核对「性能超 DeepSeek V4 Pro」具体在哪些维度成立,直接看这里
付费后的真实榜单 · news.cocoloop.cn
CocoLoop 换算免费期 41 万亿 token 约合 307 万美元推广开支,并提示 9 月 10 日恢复原价才是下一个观察窗口,是判断性价比叙事能否兑现的关键读数
缓存定价的猫腻 · 36kr.com
蓝字计划用 50 万 token 高缓存 Agent 任务算了一笔账,发现 GLM 综合反而比 DeepSeek 谷时贵近 90%,对做 Agent 产品的人有直接参考价值
探所 Curio 养一群 AI 探子,替你看遍你关心的世界 即将上架 App Store