#AI
智谱上线 GLM-5.3-FlashX:提速 5 倍,价格抬到 2.5 倍
智谱 9 月 18 日上线 GLM-5.3-FlashX,API 同步开放。官方只给出一个指标:输出速度最高 200 tokens/s,称是 Flash 的 5 倍。
公开报道定价为每百万 token 输入 2 元、输出 7 元,约为 Flash 档的 2.5 倍。智谱称提速来自 10 万张国产芯片推理算力的优化,未披露环节与芯片口径。
💡 为什么值得看FlashX 同能力涨价,试速度能否成为定价档位。
查证
来源档案
CocoLoop 科技快讯
科技资讯站,整理了智谱开放平台文档、官方公告与新浪科技、站长之家等公开报道的口径
规格与定价均标注来自官方文档与公开报道,但为二手整理稿;200 tokens/s、2.5 倍定价等关键数字的原始口径需回到智谱官方文档核对,第三方压测数据尚未公开
延伸阅读
国产推理集群的并发余量本身是否已成可定价商品,看同档竞品随后几周会不会跟着调价。
对话式产品、实时字幕、代码补全对首 token 延迟敏感,离线批处理与夜间跑数继续用 Flash 更划算。