#AI
xAI 发 Grok 4.7 低价抢量,基准落后 Claude 与 GPT-6
xAI 发布 Grok 4.7,称其为迄今最强编码与知识工作模型,定价为输入 $2 / 输出 $6 每百万 token,更像中国模型价位。
能力没跟上价格。Artificial Analysis 智能指数 v4.3.2 上 Grok 4.7 得 46 分,落后 Claude Fable 5.1 与 GPT-6 的 53 分;Terminal-Bench 4.0 上它仅 26%,GPT-6 Astra 为 60%、Claude Fable 5.1 为 55%,DeepSeek V4.1 Flash 以 27% 略超。Grok 4.7 已上 Grok API、Cursor 和 Grok Build。
💡 为什么值得看输入 $2/输出 $6 的定价贴着中国模型走,但 Terminal-Bench 只拿到 26%,不到 GPT-6 Astra 的一半。
查证
来源档案
The Decoder
AI 行业媒体,本篇转述 xAI 官方发布口径并引用 Artificial Analysis 独立评测数据。
基准与定价均可回溯至 Artificial Analysis 与 xAI 官方口径,数字可信;但其“远落后”的叙事框架属媒体解读,需与原始指数页对照。
延伸阅读
看 Grok 4.7 的 $2/$6 究竟压的是 DeepSeek 系还是 OpenAI、Anthropic 的低价档,判断 API 价格战下一轮落在哪个价位带。
Terminal-Bench 26% 与榜首 60% 的落差,决定 Grok 4.7 更像日常助手而非自动化编码代理的替代品。