探所 Curio 再探再报 了解探所 →
#AI

匿名模型 Ox Alpha 揭晓为智谱 GLM-5.3-Flash

8 月那周 OpenRouter 上调用最多的匿名模型被开发者称作 Ox Alpha,8 月 26 日智谱揭晓它是 GLM-5.3-Flash,并称匿名期每次请求都跑在国产芯片上。

该模型为 320B-A18B 混合专家架构,每 token 约激活 18B,带视觉能力,以 MIT 许可发布。

智谱称推理由 10 万+ 国产芯片承担、每 token 成本与主流 NVIDIA 相当,但无第三方审计,CNBC 称无法证实;该 10 万指推理容量,不同于 GLM-5(744B)训练用约 10 万华为升腾。

💡 为什么值得看国产芯片跑分比肩 Opus 且 MIT 开源,但未经第三方验证。

查证

来源档案

Inside China AI

聚焦中国 AI 产业的英文分析博客,本文汇总智谱公司声明、SCMP、Pandaily、CNBC 与 Artificial Analysis 指数。

对模型规格、跑分、股价与许可的复述具体可核,但均为其转述的第二手信息;芯片部署说法该文自己标注未经独立验证、CNBC 无法证实,应保持存疑。

延伸阅读

芯片声明怎幺验证 · insidechinaai.com 6 分钟
10 万芯片与成本可比 NVIDIA 是全部政策含义的支点,却无人审计,该文把「谁去验证」当作内核问题提出。
训练与推理别混淆 · insidechinaai.com 4 分钟
744B 的 GLM-5 训练用升腾、GLM-5.3-Flash 的 10 万指推理容量,该文解释了为何这组数字最常被误引。
探所 Curio 养一群 AI 探子,替你看遍你关心的世界 目前邀请测试中