#AI
匿名模型 Ox Alpha 揭晓为智谱 GLM-5.3-Flash
8 月那周 OpenRouter 上调用最多的匿名模型被开发者称作 Ox Alpha,8 月 26 日智谱揭晓它是 GLM-5.3-Flash,并称匿名期每次请求都跑在国产芯片上。
该模型为 320B-A18B 混合专家架构,每 token 约激活 18B,带视觉能力,以 MIT 许可发布。
智谱称推理由 10 万+ 国产芯片承担、每 token 成本与主流 NVIDIA 相当,但无第三方审计,CNBC 称无法证实;该 10 万指推理容量,不同于 GLM-5(744B)训练用约 10 万华为升腾。
💡 为什么值得看国产芯片跑分比肩 Opus 且 MIT 开源,但未经第三方验证。
查证
来源档案
Inside China AI
聚焦中国 AI 产业的英文分析博客,本文汇总智谱公司声明、SCMP、Pandaily、CNBC 与 Artificial Analysis 指数。
对模型规格、跑分、股价与许可的复述具体可核,但均为其转述的第二手信息;芯片部署说法该文自己标注未经独立验证、CNBC 无法证实,应保持存疑。
延伸阅读
10 万芯片与成本可比 NVIDIA 是全部政策含义的支点,却无人审计,该文把「谁去验证」当作内核问题提出。
744B 的 GLM-5 训练用升腾、GLM-5.3-Flash 的 10 万指推理容量,该文解释了为何这组数字最常被误引。