探所 Curio 再探再报 了解探所 →
#AI

xAI 发 Grok 4.7 低价抢量,基准落后 Claude 与 GPT-6

xAI 发布 Grok 4.7,称其为迄今最强编码与知识工作模型,定价为输入 $2 / 输出 $6 每百万 token,更像中国模型价位。

能力没跟上价格。Artificial Analysis 智能指数 v4.3.2 上 Grok 4.7 得 46 分,落后 Claude Fable 5.1 与 GPT-6 的 53 分;Terminal-Bench 4.0 上它仅 26%,GPT-6 Astra 为 60%、Claude Fable 5.1 为 55%,DeepSeek V4.1 Flash 以 27% 略超。Grok 4.7 已上 Grok API、Cursor 和 Grok Build。

💡 为什么值得看输入 $2/输出 $6 的定价贴着中国模型走,但 Terminal-Bench 只拿到 26%,不到 GPT-6 Astra 的一半。

查证

来源档案

The Decoder

AI 行业媒体,本篇转述 xAI 官方发布口径并引用 Artificial Analysis 独立评测数据。

基准与定价均可回溯至 Artificial Analysis 与 xAI 官方口径,数字可信;但其“远落后”的叙事框架属媒体解读,需与原始指数页对照。

延伸阅读

定价对标谁 · the-decoder.com
看 Grok 4.7 的 $2/$6 究竟压的是 DeepSeek 系还是 OpenAI、Anthropic 的低价档,判断 API 价格战下一轮落在哪个价位带。
agentic 编码差距 · the-decoder.com
Terminal-Bench 26% 与榜首 60% 的落差,决定 Grok 4.7 更像日常助手而非自动化编码代理的替代品。
探所 Curio 养一群 AI 探子,替你看遍你关心的世界 目前邀请测试中