探所 Curio 再探再报 了解探所 →
#AI

xAI 发布 Grok 4.7:便宜,但跑分落后

xAI 发布 Grok 4.7,官方称其为最强编码与知识工作模型,价格仍为每百万输入 $2、输出 $6。

第三方 Artificial Analysis 智能指数中它仅 46 分,Claude Fable 5.1 与 GPT-6 均为 53 分;而 xAI 官方表格的编码数字为 38.0%。

xAI 另称其在 DeepSWE v1.1 等测试上压过 Grok 4.6,选型时应自行核对榜单。

💡 为什么值得看定价低,但 agentic 编码落后,选型需权衡便宜与够用。

官方自测口径

  • **价格**:Grok 4.7 与 4.6 同为 $2 / $6;GPT-5.6 Sol 为 $4 / $20。
  • **CursorBench**:Grok 4.7 为 46.3%,Grok 4.6 为 40.4%,Fable 5.1 为 51.8%。
  • **Terminal-Bench**:官方口径 Grok 4.7 为 38.0%,Grok 4.6 为 20.3%。
  • **专业任务**:Harvey Legal Agent Benchmark 19.6%,高于 Grok 4.6 的 15.8%。
  • **安全**:LatchBio 生物安全基准 62.4%;HackerBench 仅放行 3.3%。

上表为 xAI 官方口径,与第三方不一致。

查证

来源与可信度

· xAI 于 2026 年 9 月 21 日发布 Grok 4.7,定价每百万输入 token $2、输出 token $6,与 Grok 4.6 同价同速。 [1][3]
孤证 · Grok 4.7 在 Artificial Analysis 智能指数得 46 分,Claude Fable 5.1 与 GPT-6 各为 53 分。 [2]
孤证 · 在 agentic 编码测试 Terminal-Bench 4.0 上,Grok 4.7 按 The Decoder 引用数据为 26%,xAI 官方表格则为 38.0%。 [1][2]
· Grok 4.7 已上线 Cursor、Grok Build、Grok API,并接入第三方编码 harness 与模型路由、云平台。 [1][3]

延伸阅读

独立榜单的双口径 · the-decoder.com 4 分钟
Artificial Analysis 指数与 Terminal-Bench 的第三方数字和 xAI 官方表格并不一致,想看清差的来源值得对读两处。
性价比定位 · x.ai 5 分钟
官方把 CursorBench 4.0 的性价比当作主打卖点,附完整价格对照表,适合做选型时横向比价。
探所 Curio 养一群 AI 探子,替你看遍你关心的世界 目前邀请测试中